Нейродайджест: что произошло с ИИ за неделю
Suno выкатила V6: это не просто очередной апдейт модели. Suno запустила сразу v6, v6-Wild и v6-mini —новые модели сделаны уже в рамках партнерств с Warner Music, BMG и Believe. То есть музыкальная индустрия постепенно переходит из стадии «засудить нейросети нахрен» в стадию «ладно, а как нам на этом заработать».
V6 — основная модель для более точного контроля результата, Wild — для экспериментов, mini — бесплатная версия. Но самое интересное здесь даже не качество музыки. Suno начинает строить легальную модель генеративной музыки: правообладатели участвуют, артисты смогут подключаться по opt-in и получать деньги. Кажется, именно так AI-музыка постепенно и будет превращаться из Дикого Запада в нормальный продакшн-инструмент.
OpenAI выпустила ChatGPT Images 2.5: новая модель лучше сохраняет лицо и особенности персонажа по референсу, дает более натуральный свет и текстуры и — что особенно важно — при редактировании лучше меняет именно то, что попросили, а не заодно половину картинки. Еще генерация стала до 50% быстрее относительно Images 2.0.
В API теперь две версии: GPT-Image-2.5 Flare — быстрее для повседневной генерации и Sunburst — когда нужна максимальная точность редактирования. Короче, главный апдейт не «рисует еще красивее», а становится управляемее. А для нормального продакшна это гораздо важнее.
Adobe решила наконец засунуть весь AI-зоопарк прямо в Premiere: и вот это, возможно, самая практичная новость недели. В Premiere появился Generative Media Tool: выделяешь нужное место прямо на таймлайне, пишешь, чего тебе не хватает — и генерируешь видео непосредственно в монтаж.
Причем Adobe не заставляет всех сидеть на Firefly. Прямо внутри Premiere можно выбирать Google Veo, Kling, Runway, Luma или Firefly. Можно скормить модели первый и последний кадр или несколько референсов прямо из проекта, чтобы генерация лучше продолжала соседние шоты. По сути, привычная схема «вышел из монтажки → пошел в нейронку → сгенерил → скачал → импортировал обратно» начинает потихоньку умирать.
Там же теперь можно генерировать sound effects, soundscape и музыку. Плюс появились AI-инструменты для разделения пересекающихся голосов, чистки аудио и автоматического ducking.
А в After Effects завезли AI Assistant: можно человеческим языком попросить его разобраться в слоях и композициях, решить техническую проблему или даже собрать expression.
И тут начинается самое интересное. У Adobe вообще уже здоровенный зоопарк сторонних моделей в экосистеме Firefly — включая Seedance. Но конкретно в новом Generative Media Tool внутри Premiere Adobe сейчас официально называет Veo, Kling, Runway и Luma. Так что пока не весь зоопарк въехал непосредственно в монтажку — но направление уже очевидно. Нейронки перестают быть отдельными сайтами и становятся частью монтажного пайплайна. И вот это уже реально серьезный сдвиг.
Runway показала GWM Worlds 2 — и видео начинает превращаться в мир: Runway продолжает копать уже немного в другую сторону. GWM Worlds 2 — это world model, которая превращает генерацию видео в интерактивную симуляцию в реальном времени. Задаешь окружение, персонажей, визуальный стиль, физические правила, атмосферу — а потом уже внутри этого мира управляешь персонажами и камерой командами. То есть вместо привычного:
prompt → 10 секунд видео → не то → еще prompt
мы постепенно движемся к:
создал мир → вошел в него → поставил камеру → управляешь сценой.
Если эта парадигма нормально масштабируется по качеству, то через некоторое время мы будем не столько «генерировать ролики», сколько снимать внутри сгенерированных миров. И лично мне это направление кажется намного интереснее очередных +15% к производительности очередной видеомодели.
Мы постепенно перестаем обсуждать «какая нейронка лучше генерит».
Теперь вопрос другой: как из всего этого собрать нормальный продакшн-пайплайн и не еб#нуться.
С вами был новостной дайджест тг-канала "Нейронутые"
Suno выкатила V6: это не просто очередной апдейт модели. Suno запустила сразу v6, v6-Wild и v6-mini —новые модели сделаны уже в рамках партнерств с Warner Music, BMG и Believe. То есть музыкальная индустрия постепенно переходит из стадии «засудить нейросети нахрен» в стадию «ладно, а как нам на этом заработать».
V6 — основная модель для более точного контроля результата, Wild — для экспериментов, mini — бесплатная версия. Но самое интересное здесь даже не качество музыки. Suno начинает строить легальную модель генеративной музыки: правообладатели участвуют, артисты смогут подключаться по opt-in и получать деньги. Кажется, именно так AI-музыка постепенно и будет превращаться из Дикого Запада в нормальный продакшн-инструмент.
OpenAI выпустила ChatGPT Images 2.5: новая модель лучше сохраняет лицо и особенности персонажа по референсу, дает более натуральный свет и текстуры и — что особенно важно — при редактировании лучше меняет именно то, что попросили, а не заодно половину картинки. Еще генерация стала до 50% быстрее относительно Images 2.0.
В API теперь две версии: GPT-Image-2.5 Flare — быстрее для повседневной генерации и Sunburst — когда нужна максимальная точность редактирования. Короче, главный апдейт не «рисует еще красивее», а становится управляемее. А для нормального продакшна это гораздо важнее.
Adobe решила наконец засунуть весь AI-зоопарк прямо в Premiere: и вот это, возможно, самая практичная новость недели. В Premiere появился Generative Media Tool: выделяешь нужное место прямо на таймлайне, пишешь, чего тебе не хватает — и генерируешь видео непосредственно в монтаж.
Причем Adobe не заставляет всех сидеть на Firefly. Прямо внутри Premiere можно выбирать Google Veo, Kling, Runway, Luma или Firefly. Можно скормить модели первый и последний кадр или несколько референсов прямо из проекта, чтобы генерация лучше продолжала соседние шоты. По сути, привычная схема «вышел из монтажки → пошел в нейронку → сгенерил → скачал → импортировал обратно» начинает потихоньку умирать.
Там же теперь можно генерировать sound effects, soundscape и музыку. Плюс появились AI-инструменты для разделения пересекающихся голосов, чистки аудио и автоматического ducking.
А в After Effects завезли AI Assistant: можно человеческим языком попросить его разобраться в слоях и композициях, решить техническую проблему или даже собрать expression.
И тут начинается самое интересное. У Adobe вообще уже здоровенный зоопарк сторонних моделей в экосистеме Firefly — включая Seedance. Но конкретно в новом Generative Media Tool внутри Premiere Adobe сейчас официально называет Veo, Kling, Runway и Luma. Так что пока не весь зоопарк въехал непосредственно в монтажку — но направление уже очевидно. Нейронки перестают быть отдельными сайтами и становятся частью монтажного пайплайна. И вот это уже реально серьезный сдвиг.
Runway показала GWM Worlds 2 — и видео начинает превращаться в мир: Runway продолжает копать уже немного в другую сторону. GWM Worlds 2 — это world model, которая превращает генерацию видео в интерактивную симуляцию в реальном времени. Задаешь окружение, персонажей, визуальный стиль, физические правила, атмосферу — а потом уже внутри этого мира управляешь персонажами и камерой командами. То есть вместо привычного:
prompt → 10 секунд видео → не то → еще prompt
мы постепенно движемся к:
создал мир → вошел в него → поставил камеру → управляешь сценой.
Если эта парадигма нормально масштабируется по качеству, то через некоторое время мы будем не столько «генерировать ролики», сколько снимать внутри сгенерированных миров. И лично мне это направление кажется намного интереснее очередных +15% к производительности очередной видеомодели.
Мы постепенно перестаем обсуждать «какая нейронка лучше генерит».
Теперь вопрос другой: как из всего этого собрать нормальный продакшн-пайплайн и не еб#нуться.
С вами был новостной дайджест тг-канала "Нейронутые"