Postlar filtri


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 Нейронавт | Нейросети в творчестве

MiniMax Design

А вот и монетизация #MinimaxH3 подъехала. Десктоп-приложение от MiniMax (Windows и macOS)

Мультимодальный агент полного цикла видеопроизводства. Разбирает задачу на шаги, пишет сценарий, собирает раскадровку, генерирует кадры и ролики, монтирует, накладывает озвучку и субтитры и отдает готовое видео

- Сам решает, что взять за референс, что оставить, а что переделать и упаковывает все в формат для H3
- Режиссёрский 3D-инструмент для сложных кадров: расстановка персонажей, движение, ракурсы камеры до генерации сцены
- Подключение воркфлоу ComfyUI облачно или локально, агент помогает крутить ноды и параметры
- Работает с разными моделями: H3 для видео, GPT Image 2 и Nano Banana Pro для картинок, Music 2.6 и Speech 2.8 для звука

#directing #videoediting


📎 epsilon correct

Что-то я сюда не писал уже почти месяц, будем исправляться. Произошло много чего, анонсы через неделю уже никому не интересны, поэтому чуток расскажу про то, что запомнилось.

Gemini 3.7 Flash – первая модель от гугла, которой можно пользоваться для агентского кодинга, хоть и сама по себе очень специфичная. Она поглупее других, но из-за супер быстрого сёрвинга на >300 TPS превращается во что-то полезное. Или напрототипировать что-то для других агентов.

RSI Simulator – симулятор неолабы, которая пытается достичь recursive self improvement (RSI), когда модельки начнут бесконечно улучшать себя 📈. Начинается как простой кликер, потом тратим деньги, балансируя количество рисёрчеров, количество компьюта и баланс того, на что тратим деньги. Если у кого-то получится раньше, чем в 2029 году – пишите в комменты, как получилось!


📎 CGIT_Vines

Есть такая игра в стиме Turing Complete, в ней пошагово можно разобраться в устройстве работы низкоуровневых языков программирования и в итоге даже написать своей процессор.
Angaisb_ подключил к этой игре Codex Sol 5.6 и накодил виртуальный CPU и смог запустить сначала Space Invaders, потом Minecraft и потом по традиции Doom!

Отдельное удовольствие смотреть паутину графов! По Doom кину в комменты/


📎 Анализ данных (Data analysis)

⚡️ Qwen3.8-27B снова «разблокировали», но теперь аккуратнее

У Huihui-Qwen3.8-27B-abliterated-GGUF появилась новая серия UD-Q, собранная на базе unsloth/Qwen3.8-27B-GGUF.

В этот раз ablation применили только к слоям 18–51, остальные слои оставили нетронутыми. Идея в том, чтобы сильнее сохранить исходные способности Qwen3.8-27B, одновременно уменьшив количество отказов модели.

MTP и визуальную часть не меняли. После конвертации размеры GGUF могут отличаться от оригинальных сборок.

Доступны разные квантизации для локального запуска:

https://huggingface.co/huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF/tree/main


📎 Machinelearning

✔️ Black Forest Labs выпустила апскейлер видео

FLUX Upscale - отдельный инструмент и эндпойнт, который пересобирает видео в разрешении вплоть до 4K.

На вход идет видео от 480p. Инструмент понимает вывод FLUX 3 и, по словам BFL, чинит то, что универсальный апскейлер пропускает - смазанные лица и артефакты на текстурах.

🟡Режима два

Precise - четыре шага, 7 центов за мегапиксель-секунду. Подойдет, когда нужно сохранить лицо персонажа и соответствие референсу.

Creative - восемь шагов, 10 центов. Сильнее чинит и дорисовывает детали, но может изменить или подменить внешность, так что соответствие референсу ниже.

Коэффициент увеличения - 1,5x, 2x или 3x. От HD на входе это дает примерно 1080p, 2K и 4K.

Десятисекундный ролик обойдется в шесть-восемь долларов.


Работает через API Black Forest Labs и плейграунд.



#news #ai #ml


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 Нейронавт | Нейросети в творчестве

V-RAE

Тут предлагают строить сжатое представление видеогенераторов не на основе пикселей, а на основе смысла. Берут пониматоры видео и поверх них делают компактный слой. То есть образно говоря, вместо аудиозаписи нотная запись. В ней меньше деталей но видна видна структура, по которой можно сыграть заново даже лучше оригинала

- Генератору проще работать со смыслом, он сходится быстрее в разы и выдает лучшее качество
- Видео можно сжимать по времени без потери смысла
- Такое представление можно использовать не только для генерации, но и для предсказания следующих кадров

Веса есть но это исследовательский проект, а не прикладной

На видео V-RAE справа

Гитхаб
HF

#research




Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 NEUROHUB

✴️ Сэм Альтман рассказал, во что превратится ChatGPT.

В свежем интервью глава OpenAI рассказал о планах компании и признался, что по-прежнему сам разбирает почту и ведёт список дел, хотя Codex уже может делать это за него.

Главное:
🟡 Модели развиваются быстрее, чем люди и бизнес успевают к ним привыкнуть
🟡 Codex перестанет быть имбой только для программистов и возьмётся за любую цифровую работу
🟡 Будущий агент получит личный контекст, будет всегда рядом и сам предлагать действия
🟡 Нынешний ИИ Альтман сравнил со смартфонами до iPhone, технологии уже есть, а удобный интерфейс ещё не нашли
🟡 Ради развития агентских систем OpenAI закрыла Sora и свернула другие проекты
🟡 Компания хочет собрать единую платформу для людей и бизнеса по всему миру


Короче, ChatGPT готовят не к роли чат-бота, а к роли операционной системы для жизни.


📎 Миша, давай по новой

С понедельником ⭐!


📎 Ai molodca

Заставляем ГПТ точечно править картинку без шакалов 🗡

Большая часть моего взаимодействия с ЛЛМками сейчас — это крафт полезных продакшенов скиллов для студии (ну и лично для себя). Делюсь одним из.

В чем соль. Бывает, что нужно поправить деталь в картинке, но ГПТ генерит ее целиком, деталь поправлена, но изображение деградировало и покрылась фирменной шакальной паутинкой. Конечно, можно исправить (тоже для этого есть скилл, хехе), но можно предовратить.

Раньше брал кроп проблемного участка, генеративно правил его и вклеивал обратно в Фотошопе. Сейчас это делает скилл Frame Patcher прямо в ГПТ Ворк.

Cкилл в первом комментарии (ну или на Гитхабе), пользуйтесь присылайте результаты, проблемы, подмечалки — буду его улучшать. 😉


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 Технологии | Нейросети | Боты

📌 Сохраняем лучшие нейронаходки уходящей недели.

Codex Pets — каталог анимированных питомцев для Codex.
StillsLab — Pinterest для поиска киношных референсов под нейровидео.
Claude Code — сначала собирает макеты, а потом превращает их в рабочий интерфейс.
VoiceStudio — бесплатная локальная замена ElevenLabs для голосов, дубляжа и аудиокниг.
1K Papers — тысяча заметных ИИ-исследований за последний год с короткими пересказами.
Claude Academy — бесплатные курсы по Claude, агентам и промптам.
MiniMax Design — десктопная студия, где агенты собирают рекламу, ролики и раскадровки.

• Telegram @aiaiai

#нейросети #neural


📎 Derp Learning

thanks, 🧢




📎 Нейронавт | Нейросети в творчестве

MaskVidExperiments

Кастом пак #ComfyUI по работе с масками в видео.
Обработка замаскированного объекта внутри движущегося кропа, с последующей вставкой обратно в кадр без дерганья и видимых швов

- Subject Crop: стабильный кроп вокруг объекта по всему клипу — не дёргается от шума маски, окклюзий и кратких уходов, следует только за устойчивым движением
- Subject Uncrop: пиксельно точная вставка результата обратно с мягкой кромкой
- Mask Cleanup: чистит мусор и мерцающие пятна из видеомаски, сохраняя настоящий объект
- Mask To Latent Space: честно приводит маску к латентному разрешению через VAE - без размазывания трилинейным resize, чистая инпейнт-область (пример: машина → овчарка в LTX)
- Audio Mask To Latent: регенерация выбранных временных отрезков в аудио-латент (для MiniMax H3, LTX-2)
- Differential Diffusion (Soft): мягкие кромки в масках денойза на каждом шаге, стабильно по времени

Спасибо @m_franz

#segmentation


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 Технологии | Нейросети | Боты

👍 Ловите антистресс после тяжёлой рабочей недели.

Чувак за три часа навайбкодил игру, где на крошечной планете растут 49 тысяч клеверов. Нужно бродить по миру, всматриваться в траву и отыскать единственный четырёхлистный.

Лучший способ потратить ближайшие три часа.

• Попробовать


📎 Революция Чайных Пакетиков

Стрим завершен, запись по ссылке:
https://youtu.be/821Y8bxAyQc

Спасибо за ваши вопросы)
Прохождение на харде тогда в следующий раз😂




Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
📎 Технологии | Нейросети | Боты

На случай, если вы забыли, ради чего дорожает оперативка 😈


📎 Neurogen

MiniMax-H3 × Z-Image

На Hugging Face появился интересный эксперимент

Идея: взять движок MiniMax-H3 и перенести в него профиль пространственного внимания Z-Image, чтобы модель лучше работала с мелкими текстурами и деталями

🔘Получилось:

- более детализированное окружение
- улучшенная текстура лиц + сохраняется идентичность
- детализация стабильнее сохраняется между последовательными кадрами
- сохраняются возможности H3 по генерации видео + аудио

Все это без переобучения и вмешательства какого то в архитектуру

Работает как drop-in replacement для стандартных H3-чекпоинтов

Ну и самое главное что есть ггуф кванты сразу под разные vram

Q4_0 — 11.5 / 19.9 GB
Q5_1 — 15.2 / 25.9 GB
Q8_0 — 21.5 GB

Автор рекомендует именно curve-zs05 версии. Для 16 GB — Q4_0, для 24 GB — Q5_1, для 32 GB — Q8_0

Установка: файл помещается туда же, где лежат H3-чекпоинты, после чего выбирается в loader. Существующие H3 workflow менять не нужно

https://huggingface.co/joeygambino/MiniMax-H3-x-Z-Image-GGUF


А что если вообще забить на физику и просто обучить нейросеть для локализации? И по заветам Саттона (bitter lesson) - все получилось и результаты на видео! Точность локализации получилась примерно в 2 раза выше, чем при использовании физики.

Я думаю вообще такие системы: симулятор физики, плюс реальные сенсоры и актуаторы (в моем случае стучание по столу) + мощный ИИ (Fable 5) = next frontier of science.

20 ta oxirgi post ko‘rsatilgan.