Репост из: Psy Eyes
Дайджест:
📹 ВИДЕО + АРТ 🎨
Pika 1.0 теперь доступен всем, а не только по вейтлисту.
AnyDoor: демо виртуальной примерочной.
MotionDirector: теперь можно настраивать стиль объектов в видео и как они должны появляться в кадре.
MotionCtrl: пришиваем контроль камеры к опенсорсным моделям. Пока работает с LVDM/VideoCrafter. Поддержка SVD и AnimateDiff подъедет позже, хотя в последнем контроль камеры точно есть.
HarmonyView: генерим из одной картинки разные углы обзора для получения 3D. Основано на SyncDreamer.
AGAP: редактируем 3D сцену через стилизацию, интерактивное рисование, и сегментацию.
PlatoNeRF: инструмент для получения новых углов обзора в 3D с использование NeRF и лидаров.
DreamDistribution: даём нейронке рефы и она генерит схожее в 2D или 3D.
LangSplat: сегментируем объекты в 3D, используя гауссианы.
OneFormer: тоже мультизадачный фреймворк для сегментации.
UniRef++: сегментируем что-угодно на картинках и видео по рефу.
SPM: удаляем или изменяем объекты на картинках так, чтобы они смотрелись концептуально выдержанно.
TF-T2V: text-2-video фреймворк для генерации видео на основе датасета без аннотаций.
HD Painter: инпейнтинг с учётом контекста.
Apple: тоже выпустили свой сегментатор объектов на картинках Ferret.
🎸 ЗВУК 🎸
Korus AI: в коллабе с лейблом mau5trap запустили конкурс AI-ремиксов на треки Deadmau5.
🤖 ЧАТЫ 🤖
MetaGPT: появился веб-интерфейс мощного фреймворка из AI-агентов, реализующего полный цикл разработки программного обеспечения.
Argilla: выпустили Notux 8x7B-v1 файнтюн Mixtral, который показывает себя лучше базовой модели.
Microsoft: используем Windows AI Studio для разработки и файнтюна разных LLM c Hugging Face локально или через Azure.
Также они выпустили Copilot на Android, с бесплатным чатом на GPT-4 и DALLE 3. Может понадобиться VPN.
OpenChat: ещё одна опенсорсная альтернатива GPT-3.5.
VCoder: это VLM, использующая сегментацию и карты глубины для улучшения чата по картинкам.
💬 Делайте выжимки из доков и чатьтесь по ним с помощью Claude
📹 ВИДЕО + АРТ 🎨
Pika 1.0 теперь доступен всем, а не только по вейтлисту.
AnyDoor: демо виртуальной примерочной.
MotionDirector: теперь можно настраивать стиль объектов в видео и как они должны появляться в кадре.
MotionCtrl: пришиваем контроль камеры к опенсорсным моделям. Пока работает с LVDM/VideoCrafter. Поддержка SVD и AnimateDiff подъедет позже, хотя в последнем контроль камеры точно есть.
HarmonyView: генерим из одной картинки разные углы обзора для получения 3D. Основано на SyncDreamer.
AGAP: редактируем 3D сцену через стилизацию, интерактивное рисование, и сегментацию.
PlatoNeRF: инструмент для получения новых углов обзора в 3D с использование NeRF и лидаров.
DreamDistribution: даём нейронке рефы и она генерит схожее в 2D или 3D.
LangSplat: сегментируем объекты в 3D, используя гауссианы.
OneFormer: тоже мультизадачный фреймворк для сегментации.
UniRef++: сегментируем что-угодно на картинках и видео по рефу.
SPM: удаляем или изменяем объекты на картинках так, чтобы они смотрелись концептуально выдержанно.
TF-T2V: text-2-video фреймворк для генерации видео на основе датасета без аннотаций.
HD Painter: инпейнтинг с учётом контекста.
Apple: тоже выпустили свой сегментатор объектов на картинках Ferret.
🎸 ЗВУК 🎸
Korus AI: в коллабе с лейблом mau5trap запустили конкурс AI-ремиксов на треки Deadmau5.
🤖 ЧАТЫ 🤖
MetaGPT: появился веб-интерфейс мощного фреймворка из AI-агентов, реализующего полный цикл разработки программного обеспечения.
Argilla: выпустили Notux 8x7B-v1 файнтюн Mixtral, который показывает себя лучше базовой модели.
Microsoft: используем Windows AI Studio для разработки и файнтюна разных LLM c Hugging Face локально или через Azure.
Также они выпустили Copilot на Android, с бесплатным чатом на GPT-4 и DALLE 3. Может понадобиться VPN.
OpenChat: ещё одна опенсорсная альтернатива GPT-3.5.
VCoder: это VLM, использующая сегментацию и карты глубины для улучшения чата по картинкам.
💬 Делайте выжимки из доков и чатьтесь по ним с помощью Claude