Ai Новости нейросети | Технологии ИИ


Гео и язык канала: Россия, Русский
Категория: Технологии


По вопросам: @R4d0stb

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Видео недоступно для предпросмотра
Смотреть в Telegram
БЕСКОНЕЧНЫЙ ИИ-агент flowith теперь доступен ВСЕМ юзерам — у него вообще нет ограничений на время работы и контекст.

Освежим память:

• Flowith Neo обрабатывает БЕСКОНЕЧНОЕ количество задач одновременно — кодит, пишет тексты, анализирует данные, ищет инфу в сети или дизайнит.
• Все таски варятся БЕЗ вашего участия — можете пойти пить кофе.
• Контекст каждой задачи — сумасшедшие 10 миллионов (!) токенов, а количество шагов достигает сотен тысяч.

Пробуем прямо сейчас и без инвайтов — здесь.


Veo 3 — новая лучша модель для генерации видео

Похоже, новая SOTA для видео. Кроме видео может генерить ещё и звуки, в том числе и диалоги! Все видосы в посте были сгенерены чисто через Veo 3. Будет доступна уже сегодня.

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть


Hunyuan Image 2.0

Tencent выкатил генератор картинок 2.0
Генерит мгновенно!
Высокая реалистичность.
Dual-Canvas Studio - редактор с холстом позволяет смешивать слои.

Как пользоваться - непонятно, все на китайском. Для начала надо войти по имейлу. Вот куда-то ткнул, сделал котика. Первая картинка с котиком - моя, просто по запросу Cat, непонятно новой моделью или старой.

Вообще выглядит впечатляюще

#text2image #realtime #imageediting


Видео недоступно для предпросмотра
Смотреть в Telegram
MoviiGen 1.1

Файнтюн Wan 2.1 с заявкой на кинокачество, видео по тексту.

720P и 1080P

Должно работать с любым родным Wan 2.1 t2v вокрфлоу

есть GGUF

#text2video


Wan2.1-VACE, All-in-One Video Creation and Editing model

WAN релизнули код и веса модели создания и редактирования видео.

Прежде была опубликована превью модель 1.3B

Теперь же доступны 1.3B и 14B

- видео по референсу
- видео по видео
- видео по видео с маской

Гитхаб
Веса
API
Ждем на wan.video

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть
#text2image #ComfyUI #workflow
#text2image #ComfyUI #workflow
#text2video #video2video #personalization #videoediting #referencing


ComfyUI-DreamO

Подвезли #ComfyUI враппер персонализатора-кастомизатора изображений

#personalization #referenceing #tex2image


Видео недоступно для предпросмотра
Смотреть в Telegram
TaylorSeer: From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers

Ускорение генерации FLUX, HunyuanVideo, Wan, HiDream "в 5 раз" (на самом деле вдвое) с портерей качества меньше чем у Teacache

Код
ComfyUI

#optimization #ComfyUI


FramePack_with_Video_Input

Форк FramePack, принимающий на вход видео и продолжающий его.

На примере первые 3 секунды видео - исходник, дальше - генерация FramePack

Ветка на официальном FramePack

#videoextension #video2video


Видео недоступно для предпросмотра
Смотреть в Telegram
FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios

Оживлятор персонажей по образцу движения от Tencent. Перенос движения на картинку.
На основе CogVideoX-5B

Код
Веса

#characteranimation #image2video #motion2video


ACE-Step: A Step Towards Music Generation Foundation Model

Генератор музыки в опенсорсе? базовая модель, пригодная для дальнейшего файнтюна.

Мультиязычный, есть русский!
Помимо собственно генерации музыки по тексту, умеет делать вариации, смену пола вокалиста, замену слов, замену музыкальных фрагментов.

Обещают лоры с контролнетами, генерацию стемов (отдельных партий), вокал по готовому аккомпанементу

Звучит пока не очень, надеемся на пластичность в файнтюне

Код
Демо
Веса

#music #text2music #musicediting


SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing

Редактор картинок текстом от ByteDance

Авторы обнаружили, что разные шаги генерации играют разные роли в генерации изображений, независимо от промта. В частности, диффузионные модели фокусируются на (а) глобальном макете на ранних стадиях, (б) локальных атрибутах объекта на средних стадиях, (в) деталях изображения на поздних стадиях и (г) стиле изображения на всех стадиях выборки. Это вдохновило их на использование VLM. На схеме видно что ее используют вместо CLIP

Код

#imageediting


F-Lite

Генератор картинок от Freepik
10B параметров

F Lite - базовая модель
F Lite-Texture - вариант F Lite, который создает лучшие текстуры и эстетику, но плохо работает с короткими промптами и менее эффективен для векторной графики (что?)

Гитхаб
Веса
Демо F Lite
Демо F Texture
ComfyUI

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть
#text2image #ComfyUI #workflow


Видео недоступно для предпросмотра
Смотреть в Telegram
⚡️ Имба: тулза NotebookLM от Google теперь умеет генерить ПОДКАСТЫ на русском языке!

Просто закиньте любой документ, нажмите «Аудиопересказ» — «Сгенерировать» и наслаждайтесь. По традиции, проверили обнову на пасте про батин суп ☕️

Это беспатно, залетаем.

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть


Видео недоступно для предпросмотра
Смотреть в Telegram
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis

Говорящий аватар / оживлятор портретов от Alibaba с контролем интенсивности движения. работает с разными крупностями кадра и позами, с разными типами персонажей

Сравнение с конкурентами впечатляет.

Построен на базе wan 2.1

Код

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть
#portraitanimation #image2video #speech2video #humananimation #lipsync #talkinghead


StepFun: выпустили Step1X-Edit для редактирования картинок текстом. Можно использовать для добавления / изменения / удаления объектов в кадре или смены стиля.

Неплохо справляется, например, с рекламным контентом, где объект хорошо выделен в кадре. С надписями работает хуже, чем KV-Edit.

Чтобы гонять локально без оффлоада в RAM, нужно 43 ГБ или 50ГБ VRAM для работы c разрешением 512 или 1024 соответственно. С оффлоадом 26 ГБ или 29 ГБ. Сообщество уже наваяло fp8 веса: самый лайтовый вариант запуска 18 ГБ VRAM.

Демо
Сайт
Гитхаб
Хаггинг

👉 ДОСТУП к каналу
#нейросети #технологии #ии #нейросеть
#imageto3d #textto3d


Видео недоступно для предпросмотра
Смотреть в Telegram
Hunyuan3D 2.5

Новая версия 3D-генератора, 10B параметров.
Авториг, многоракурсная генерация 3D, PBR текстуры

Попробовать - если сможете зайти. Я с wechat не смог

#imageto3d #textto3d


Higgsfield Turbo

Новая модель у видеогенератора Higgsfield

В полтора раза быстрее, на 30% дешевле.

Добавили 7 новых стилей движения

👉 ДОСТУП
#нейросети #технологии #ии #нейросеть
#text2movie #script2movie #text2image #image2video #motioncontrol #cameracontrol



Показано 18 последних публикаций.

4 037

подписчиков
Статистика канала