ComfyUI Data


Гео и язык канала: Россия, Русский
Категория: Технологии


Инфо по комфи юи и не только

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Репост из: эйай ньюз
Видео недоступно для предпросмотра
Смотреть в Telegram
Kling 3.0, Omni 3.0 и Image 3.0

В теории это значит, что теперь Kling безоговорочная SOTA — он и так составлял достойную конкуренцию Veo 3.1, обладая более широким функционалом и разрешением 1080p (не только через API). O1 была не самой лучшей в плане качества, но уже мультимодальной, а теперь на вход генерации можно подавать голос и даже видео в качестве элементов. Вдобавок они выкатили еще и Kling Image 3.0. Судя по успеху motion control, новое поколение моделей должно быть крайне удачным.

Черипики у Klinga ну просто какие-то божественные, в слепом тесте я бы никогда не отличил от реальных футажей. Но это черипики, а у них они всегда были хорошие.

Генерации теперь до 15 секунд (было 10) с выбором длительности шота с шагом в 1 секунду. Появился Multi-shot как в Sora 2, прикрутили нативный звук в OMNI модель и обновили Elements 3.0. Вроде как улучшили и текст, хотя не помню, чтобы с этим были проблемы.

А вот редактирования видео я пока не увидел, его можно подавать как элемент, причём генератор будет референсить движение в кадре, в том числе мимику актера. Кстати, про русский язык в анонсе не написано, интересно, будет ли поддержка.

И всё-таки я всё ещё не фанат элементов, какие бы крутые они ни были — сгенерировать начальный кадр сейчас гораздо проще и даёт больше контроля, а видос по-прежнему генерить дорого, и я сомневаюсь, что результат будет лучше чем у бананы. В этом плане обновление Kling Image 3.0 звучит гораздо интереснее. Там, как всегда, всё стало лучше, а из новых фич добавилась генерация сторибордов, где по одному промпту генерится серия последовательных во времени кадров. NanoBanana тоже таким хвалилась, но что-то, видимо, у них не задалось, не видел, чтобы эта фича нашла применение, так ещё и гугл во всю режут лимиты и косты на компьют.

Новая версия доступна на плане Ultra, на других должно быть скоро.

Ну что, догнали Kling флагмана от гугл, как думаете? Буржуа с подпиской ультра, прошу, скидывайте тесты в комментарии!

Анонс видео
Анонс картинок
Kling 2.6

@ai_newz


Репост из: Psy Eyes
Riverflow 2, новый генератор/редактор картинок от Sourceful (октябрьский v1 как-то не попался на глаза).

Фичи:
* Фокус на фотореализме, чёткости, стабильных персонажах/объектах/освещении
* Апскейл по рефу для восстановления пожёванного галлюнами текста.
* Контроль текста и 2 шрифтов

Riverflow есть в вариантах Fast и Pro, заточенных на скорость и качество соответственно. Pro на Replicate стоит $0,15 за 1к картинку, и $0,33 за 4к.

Модель доступна только через агрегаторов: Replicate, Openrouter, Runware.

Сайт


Репост из: Psy Eyes
Luma: выпустили видеогенератор Ray3.14 (как Rape Me у Nirvana только "рэйпи").

Что нового:
* Нативное 1080p (я думал оно у них уже было)
* 720p генерит в 4 раза быстрее и в 3 раза дешевле
* Улучшения в стабильности, детализации видео, и следованию промту
* Работает с текстом, картинками и видосами на входе
* Изменение объектов на видео длиной до 18 сек

На бесплатном тарифе можно в режиме драфта погенерить. Правда неизвестно сколько времени это займёт.

По ценам: 20 кредитов/сек.

PS: сегодня Rape Me это песня, которую поёт кошелек.

Сайт
Анонс


Репост из: Нейронавт | Нейросети в творчестве
FSVideo: Fast Speed Video Diffusion Model in a Highly-Compressed Latent Space

Быстрый видеогенератор без кода от ByteDance на базе Wan2.1-14B-I2V

Прикрутили видеоавтоэнкодер, который сильно сжимает данные (соотношение даунсэмплинга 64 × 64 × 4), но при этом сохраняет качество реконструкции

Генерирует видео в несколько шагов с повышением разрешения, что делает их более чёткими и реалистичными.

Спасибо @m_franz

#image2video




Репост из: Нейронавт | Нейросети в творчестве
LTX-2 19B IC-LoRA Union Control

Универсальный контролнет от Lightrix для #LTX2

Еще у них есть улучшайзер деталей LTX-2 19B IC-LoRA Detailer и пачка контролнетов

Спасибо @alex31415926

#lora #controlnet


Репост из: Нейронавт | Нейросети в творчестве
ComfyUI-CacheDiT

Ускорение диффузных моделей в ComfyUI за счёт умного кэширования

Протестировано: Z-image, Z-Image-Turbo, WAN 2.2, LTX-2, Qwen-Image-2512

Спасибо @m_franz много ништяков принес сегодня

#comfyui #optimization


Репост из: Нейронавт | Нейросети в творчестве
BFS-Best-Face-Swap-Video

Лора - заменятор лиц #LTX2
На самом деле не лиц, а головы целиком, что круче

Позиционируется как инструмент для филммейкеров, VFX-художников и исследователей. А с таким замахом будь любезен предоставить высшее качество

Ну потестим

воркфлоу - автор криворукий, поэтому недостающие лоры тут и в коменты кидаю воркфлоу где я (тоже криворукий) заменил неправильные модели которых у него нет на те которые есть

Спасибо @m_franz @StanShumsky

#faceswap #characterswap #videoediting #lora


Репост из: Нейронавт | Нейросети в творчестве

Показано 9 последних публикаций.

46

подписчиков
Статистика канала