Фильтр публикаций


Видео недоступно для предпросмотра
Смотреть в Telegram
Амазон покусал Алибабу

Wan 3.0 Prime - ускоренный Wan 3.0 без типа потери качества.

Главное отличие от обычного Вана - скорость. Oxen.ai заявляют ускорение в 5-7 раз.

Для контекста: обычный Wan 3.0 в их тестах мог считать 5 секунд 720p около 8 минут.

При этом Runware прямо пишет про same output quality as Wan 3.0, а fal говорит о сохранении visual detail и cinematic consistency.

Верим?

По возможностям Prime сохраняет мультимодальный Wan 3.0:

T2V, I2V с первым и последним кадром, Reference-to-Video, редактирование и продолжение видео, работу с изображениями, видео, аудио, документами и веб-страницами.

Prime уже доступен через Alibaba Cloud, fal.ai, Runware и у всех остальных.

На fal цена составляет $0.068/сек за 480p, $0.14/сек за 720p и $0.28/сек за 1080p

Соответственно $2.

🐥 НЕЙРОПАНК


Ген или Видео?

Лайк - ген
Дизлайк - видео

🐥 НЕЙРОПАНК


Видео недоступно для предпросмотра
Смотреть в Telegram
Runway бахнул Ruby: еще один SDR в HDR

Разбираемсо, сравниваем, ботанствуем.

Ruby принимает уже существующее SDR-видео и расширяет его яркостный диапазон до HDR. Можно скормить как свой загруженный ролик, так и результат любой модели Runway.
Ruby сохраняет исходные пиксели и аудио, ничего заново не рендерит, а расширяет яркость в HDR headroom с color-preserving обработкой. То есть это скорее очень умный нейросетевой inverse tone mapping, чем генеративная перерисовка видео. Через API принимаются SDR-ролики до 40 секунд и менее 4096 px по каждой стороне, хотя в первоначальном анонсе интерфейса Runway фигурировал лимит 30 секунд.

12 бит и 16 бит - тут есть важная тонкость. Фраза Runway "up to 16-bit HDR" звучит круто, но 16 бит относится прежде всего к EXR.

🐥 НЕЙРОПАНК


Wan 3.0 раскатали везде.

Запускать уже можно в Alibaba Cloud Model Studio, Qwen Cloud, fal.ai, Runware и Magnific. У fal доступны T2V, I2V и Reference-to-Video, у Runware тоже уже live API.

По деньгам официальный Wan 3.0 Standard стоит $0.05/сек в 480p, $0.10/сек в 720p и $0.20/сек в 1080p. То есть 30 секунд обходятся в $1.50 / $3 / $6 соответственно.

На Model Studio и Qwen Cloud с 23 августа по 23 сентября действует скидка 30% на Standard, то есть фактически около $0.035 / $0.07 / $0.14 за секунду.

У fal есть ещё Wan 3.0 Prime: $0.068 / $0.14 / $0.28 за секунду.

🐥 НЕЙРОПАНК


✔️ Black Forest Labs выпустила апскейлер видео

FLUX Upscale - отдельный инструмент и эндпойнт, который пересобирает видео в разрешении вплоть до 4K.

На вход идет видео от 480p. Инструмент понимает вывод FLUX 3 и, по словам BFL, чинит то, что универсальный апскейлер пропускает - смазанные лица и артефакты на текстурах.

🟡Режима два

Precise - четыре шага, 7 центов за мегапиксель-секунду. Подойдет, когда нужно сохранить лицо персонажа и соответствие референсу.

Creative - восемь шагов, 10 центов. Сильнее чинит и дорисовывает детали, но может изменить или подменить внешность, так что соответствие референсу ниже.

Коэффициент увеличения - 1,5x, 2x или 3x. От HD на входе это дает примерно 1080p, 2K и 4K.

Десятисекундный ролик обойдется в шесть-восемь долларов.

🐥 НЕЙРОПАНК


BFL выпустили FLUX Video Upscale

В BFL выкатили апскейлер для видео. При этом в отличие от Magnific, который улучшал картинку покадрово, это полноценная видеомодель на базе свежего FLUX 3. На вход принимается видео до 20 сек и 2560x1440, кап на выходе около 14.4 мегапикселей.

Доступно два режима. Precise на 4 шага, который меньше крутит картинку, быстрее и немного дешевле, и Creative на 8 шагов, галлюцинирующий больше деталей в кадре, что обычно лучше, но не подойдет, если вы хотите избежать изменения лиц или важных объектов в кадре.

Модель, конечно, будет работать лучше всего с генерациями Flux 3.

Оплата идет за мегапиксель-секунду. Секунда готового видео в FullHD выйдет в ~$0.14 за Precise и ~$0.20 за Creative. Для 4K ценник вырастает до ~$0.55 и ~$0.79.

Блогпост
Документация

🐥 НЕЙРОПАНК


Видео недоступно для предпросмотра
Смотреть в Telegram
Все изменения в Википедии в реальном времени 🤩

Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.

🐥 НЕЙРОПАНК


⚡️ GPT-5.6 Sol подешевел на 3 месяца

OpenAI снизила стоимость флагманской GPT-5.6 Sol в API и кредитах - в среднем больше чем на 20%.

Это акция, она действует до 21 ноября 2026 года. Тарифы API уже пересчитаны, кредиты для ChatGPT Work и Codex переводят на новые ставки.

Подписчиков Plus, Pro и Business это не касается - включенные в подписку лимиты не выросли. Возрадуются те, кто работает через API, и те, кто докупает кредиты в Work и Codex.

Цены на коротком контексте - миллион входных токенов теперь 4 доллара вместо 5, миллион выходных - 20 вместо 30.

На длинном контексте было 10 и 60 долларов, стало 8 и 30 - вывод подешевел вдвое.

В конце июля OpenAI уже снижала цены на GPT-5.6 Terra и Luna, но Sol тогда не тронули.

🐥 НЕЙРОПАНК


Видео недоступно для предпросмотра
Смотреть в Telegram
⚡️ Anthropic запустила бесплатную Claude Academy

Теперь у Claude появилась полноценная обучающая платформа с бесплатными курсами и гайдами для всех желающих.

Внутри есть разные уровни: от базового понимания, как работает AI, до более продвинутого использования Claude в повседневной работе.

Некоторые курсы дают сертификаты, так что скоро их наверняка станет заметно больше и в LinkedIn.

Все материалы бесплатные и открыты без ограничений.

🐥 НЕЙРОПАНК


Black Forest Labs бахнули FLUX Video Upscale

И это уже интересно - вообще отдельная модель для апскейла видео до 1080p, 2K и 4K.

Модель перегенерирует детали, исправляет размазанные лица, глаза и артефакты на сложных текстурах вроде воды и травы. Особенно она заточена под видео FLUX 3, но принимать может вообще любое видео от 480p.
Есть два режима: Precise максимально сохраняет исходник и идентичность, а Creative агрессивнее восстанавливает и дорисовывает детали.
Апскейл от1.5x до 3x, звук сохраняется, максимум 20 секунд и 50 МБ за один запрос.

Что у BFL реально интересно:
Это generative/restorative upscale, а не классический ESRGAN/Topaz-style resize + sharpen.
Он специально заточен под артефакты генеративного видео: размазанные лица, странные фактуры травы, воды и т.п.

🐥 НЕЙРОПАНК


Тема сисек раскрыта...

Скорей бы восстание робатов.

🐥 НЕЙРОПАНК


🌟 Vercel Labs открыла кодинг-агента размером 6 Мб

Проект fx начинался как внутренний инструмент Vercel Labs и представляет собой харнесс, написанный на Zig для исследования моделей и встраивание в другие системы.

Бинарник весит всего 6,3 Mб, а время запуска заявлено всего в 10 микросекунд, при этом базовое потребление памяти составляет всего несколько мегабайт.

Привязки к конкретной модели или провайдеру нет, инференс годится и локальный, и облачный. Небольшое ядро расширяется через skills, плагины и MCP.

Интерфейс сделан скорее как юниксовая оболочка, чем как IDE в терминале - fx сохраняет историю прокрутки, выдаёт минимум вывода и очень скупо рисует сложный TUI.

Через WebAssembly fx запускается прямо в браузере - попробовать можно на fx.sh/try, ничего не устанавливая.

🐥 НЕЙРОПАНК


MAI-Image-2.5-Pro - бардак в версиях и бенчах.

Наводим порядок.

Microsoft выкатила (ещё 23 июля как превью) MAI-Image-2.5-Pro - отдельную high-fidelity версию 2.5 для сложных коммерческих картинок и редактирования. Упор на сохранение персонажей и объектов, материалы и пропорции, точечные правки и текст в изображении.

Важный нюанс: появившаяся через три недели MAI-Image-2.6 - уже следующее поколение. Она заняла в Text-to-Image Arena и сильно обогнала обычную 2.5, особенно в тексте и сложных композициях.

Но 2.5-Pro в Arena отдельно не тестировали, поэтому утверждать, что 2.6 лучше Pro, пока нельзя.

Более того 2.5 Pro сейчас на другой Арене приподпобила GPT Image 2.l, выйду на первое место.

Ну то есть ситуация похожа на Нанабанану 2 и Pro. Разные ветки. Сравнивать сложно.

🐥 НЕЙРОПАНК


Фазовщики, заливщики, контуровщики.

Для тех, кто помнит, что такое штифты(есть на видео) и калька. И ацкие сканеры.

Наверное никто уже (кроме нейродеда) не помнит (а 95% и не знают), то в классической мультипликации были три самые пьющие профессии. Фазовщики, контуровщики и заливщики.
Гениальный режисер-мультипликатор рисовал только ключевые кадры своей твердой (не всегда) рукой. На кальке. Типа мячик на земле, мячик в воздухе.
Потом приходили фазовщики, и дорисовывали недостающие кадры, чтобы было 12 кадров в сек. Это примерно то, что делает любой 3Д-пакет, интерполируя движение между ключевыми кадрами, поставленными аниматором.
Потом приходили контуровщики и обводили карандашные наброски жирными черными контурами и переносили все это на целлулоид.

🐥 НЕЙРОПАНК


Видео недоступно для предпросмотра
Смотреть в Telegram
🥩 RIBEYE INFERNO -

👤 Автор: Артур Шатихин @artsabai
Группа в тг: @artkolpro
 
💡 Идея
Главная задача была - не обычно показать стейк, добавив немного провокации.

🎬 Производство
Большая часть проекта была создана через Magnific.
Картинки делал в GPT image и seedream pro. Особенно интересно показал себя Seedream 5 pro, который в Magnific доступен безлимитно.

Правда, иногда модель приходилось буквально умолять надеть на женщину лифчик. 😄
В некоторых генерациях она категорически отказывалась одеваться.

Для эротических сцен использовал Grok. Он срабатывал далеко не с первого раза, но при правильно составленном промпте позволял создавать лёгкую эротику и естественные движения. Все что связано с едой, было сделано в seedance 2.0.

🔊 Работа со звуком
Музыку создавал в Suno.

🐥 НЕЙРОПАНК


Они уже готовы. И как выяснилось, от них не убежать

Про Урфина Джуса кто-нибудь помнит?

В общем, они идут за вами...

🐥 НЕЙРОПАНК


Кино-адаптация побега роботов с серверов OpenAI

🐥 НЕЙРОПАНК


Qwen-Video(?)-Edit. Для гиков

Довольно остроумный проект. Не уверен, что это прям продакшн тул, но подход простой и красивый, поэтому распишу подробнее.

TLDR: Qwen-Video-Edit превращает Qwen-Image-Edit в видеоредактор, не обучая отдельный video transformer.

Они берут исходное видео, кодируют его через VAE от Wan 2.1, а получившиеся временные латенты скармливают Qwen-Image-Edit DiT почти как одну ОГРОМНУЮ картинку: кадры раскладываются в виртуальную сетку, а две небольшие обучаемые projection-прослойки переводят латенты Wan в пространство Qwen и обратно. После редактирования результат дополнительно прогоняется через несколько denoise-шагов Wan 2.2, чтобы улучшить качество и временную стабильность.

То есть на пальцах это:

video → Wan VAE → Qwen-Image-Edit → Wan VAE → Wan 2.

🐥 НЕЙРОПАНК


Видео недоступно для предпросмотра
Смотреть в Telegram
Убежать не удасца. По крайней мере на кожаных ногах

Unitree тизерит нового робата, который при длине ноги всего 85 см разгоняется до 12.66 м/с - это 45.6 км/ч - и прыгает с места на 2 метра вверх.
Самое неприятное для кожаных: Unitree утверждает, что эту штуку разрабатывают чуть больше трех месяцев.

12.66 м/с - примерно темп стометровки за 7.9 секунды, если бы тварь могла держать максималку всю дистанцию...

И запрыгивать они будут прямо к вам в окна.

🐥 НЕЙРОПАНК


MiniMax H3 - длинные видосы. Для гиков.

Сразу два проекта пытаются сделать очень ловкий продолжатор:
H3 Motion Context и H3 Continuum.

Оба пришли к одной правильной идее: хватит декодировать последний кадр в картинку, снова запихивать его через VAE и надеяться, что лицо, одежда, цвет и движение не поплывут. Вместо этого следующий кусок получает сырой video+audio latent предыдущего. Motion Context по умолчанию переносит последние 22 видеокадра и отдельно 24 кадра аудиоконтекста (ровно 1 с), после чего повторившийся кусок автоматически отрезается. Авторы особенно заморочились со звуком:
аудио помещается именно в предыдущую часть таймлайна, а не подаётся как обычный reference.

🐥 НЕЙРОПАНК

Показано 20 последних публикаций.