Stable Diffusion | Automatic 1111 | ComfiUI


Гео и язык канала: Россия, Русский
Категория: Технологии


Видеоуроки и новинки ИИ
📌 YouTube: https://youtube.com/@StableDiff
📌RuTube: https://rutube.ru/channel/28380669/
📌 Курс "Automatic1111": https://stabledif.ru
📌 Курс "ComfyUI": https://stabledif.ru/comfyui
Канал в MAX: https://max.ru/stable_dif

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓Boosty: перейти

В этом видео:
☑️ Обзор обновлений LTX 2.5
☑️ Сравнение LTX 2.5, LTX 2.3, MiniMax H3
☑️ Как исправить старые схемы для запуска на LTX 2.5
☑️ Обзор моделей,
🔥 Gemini bot для написания подсказок
🔥 Авторский Workflow T2V + I2V и Lipsync Avatar

Мои ресурсы:
🎓 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK


MiniMaxH3 практический гайд, low vram, ускорение генерации, качество видео!

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓 Boosty: перейти

🖐Всем привет сегодня расскажу про модель MiniMax H3, покажу на что она способна, как писать prompt и как ускорить генерацию и снизить потребление видеопамяти.
🛠 MiniMax H3 - это опенсорс модель для генерации видео современного уровня, на уровне онлайн сервисов.
👌 Ее можно использовать в коммерческих целях.
🛠 LTX и Wan модели заметно слабее на фоне новой MiniMax H3.

☑️ Нам доступны две модели:
- FL2VA - модель для генерации видео по подсказке, по входному изображению и по первому и конечному кадру.
- Ref2VA - модель для работы с референсами.
Эта модель поддерживает до 12 референсов изображений, 3 референса аудио и 3 референса видео.
👌Подсказку естественно тоже поддерживает.
🔞NSFW тоже работает из коробки.
📌Видеопамяти ест много, но она отлично распределяется с RAM и получается запустить генерацию даже на RTX 3060 12Гб с некоторыми нюансами по схеме, которые мы разберем чуть позже в схемах 🚀
☑️ Скорость генерации медленная. 15 секундный ролик в 1 МП генерируется 450 секунд на RTX 5090 без turbo лор. С Lora будет быстрее, но качество будет хуже.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAХ \ 📎 VK


Style Selector (OreX) — обновление

В Style Selector (OreX) добавлен новый функционал и 120 поз.

🔹 Добавлен масштаб превью и он сохраняется между перезапусками ComfyUI
🔹 Добавлен полноэкранный режим выбора стилей
🔹 Добавлена возможность выбора стилей из разных файлов
🔹 Добавлена кнопка выбора всех стилей файла
🔹 Добавлен режим редактирования стилей и смены их позиции в списке. JSON редактируется прямо из узла
🔹 Добавлены 120 поз для Krea2
🔹 Позы и стили для Krea2 нормально сочетаются

В планах:
• Добавить функцию добавления стиля из URL
• Добавить вид съемки

Как установить:
Установите или обновите узлы Orex-nodes
и добавьте узел Style Selector (OreX)

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎 MAX
📎 VK


Floating Launcher OreX — обновление

Полностью переработанный лаунчер для быстрого запуска приложений. Тёмная тема, мультиязычный интерфейс, индивидуальные шаблоны оформления и монолитный EXE-файл в одной сборке.

🔹 Полностью переработано меню Settings и добавлены новые опции выравнивания и размера текста подписи.
🔹 Вынесена кнопка Settings (шестеренка).
🔹 Единое оформление для всех окон.
🔹 Каждый значок теперь можно оформить индивидуально — цвет фона, цвет текста и есть шаблоны.
🔹 Каждую вкладку теперь можно оформить индивидуально — фон и цвет текста и есть шаблоны.
🔹 Обратная совместимость: старые конфигурации без индивидуального стиля продолжают использовать общие настройки
🔹 Монолитный EXE-файл

❗️Не забывайте делать Export настроек в Settings на случай если что-то слетит. Позже сделаю авто сохранение backup в папке программы.

⏬ Скачать приложение: GitHub

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎 MAX
📎 VK


Видео недоступно для предпросмотра
Смотреть в Telegram
✂️ Krea2LoRACompressor — сжатие больших Krea2 LoRA

Подготовил программу для создания облегчённых версий Krea2 LoRA и LoKr в формате SafeTensors. Можно выбрать степень сжатия и заметно уменьшить размер модели.

🔹 Доступны уровни сжатия: 5%, 25%, 50%, 75% и 95%
🔹 Программа удаляет целые transformer-блоки от краёв архитектуры к центру
🔹 Исходная LoRA не удаляется и не перезаписывается
🔹 Результат сохраняется рядом с оригиналом под новым именем
🔹 Есть тёмный графический интерфейс и поддержка 12 языков
🔹 Portable-сборка уже содержит Python и необходимые библиотеки
🔹 Особенно полезно для LoRA размером около одного гигабайта и больше
🔹 Сжатие не проходит без потерь: вместе с блоками удаляются тензоры, поэтому качество, детали и стабильность генерации могут измениться
🔹 Это не замена правильно выбранному factor или rank при обучении: здесь уменьшается уже готовая модель
🔹 Результат рекомендуется сравнивать с оригиналом на одинаковых prompt, seed и настройках

⬇️ Скачать Portable версию
⬇️ Репозиторий GitHub
Тут примеры сжатия на больших форматах
Portable распаковать и запустить RUN.bat

Мои ресурсы:
🔥 Курс
🔑 BOOSTY
📺 СТРИМЫ
📎 MAX
📎 VK


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🛠 Boosty: скачать файлы со стрима

📣 Большой стрим по искусственному интеллекту где мы разбираем много нового и актуального. Будет много советов и практические применения по следующим тема:

📘 Разное
1. Презентация Powerpoint на Bionic
2. Cherry-Studio
3. Hermes - Установка и подключение локальной модели
4. Gemini Flow - Influencer - создания датасета на персонажа
5. Описание изображений
6. UI-Toolkit - Обновление и настройки

📕 ComfyUI
1. Identity Forge - создание персонажа из промпта
2. Ideogram создания датасета на персонажа
3. Krea2 - Стили
4. Krea2 - Эмоции
5. Krea2 - Постеры с текстом по референсу
6. JoyAI Image Edit - новая модель для редактирования изображений
7. Итоги стрима

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE
🎓 Boosty: перейти

🛠 Собрал масштабный узел с большой коллекцией стилей для Krea2 и Flux2 Klein.
☑️ Стили можно добавлять в избранное, чтобы не искать нужный стиль среди кучи других стилей и можно пачкой генерировать с выбранными стилями для теста моделей и схем.
☑️ Можно комбинировать стили. Один удобный узел с информативными preview сделает вашу работу в ComfyUI существенно удобнее.
👌 Узел и стили доступны бесплатно. А если нужно еще что-то интересное, то увидимся на Boosty.

🔗 Все ссылки на узлы и схемы бесплатно в описании под уроком на YouTube/Rutube.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓 Boosty: перейти

💥LM-Studio обновилась, точнее преобразовалась в Bionic Agent. Теперь этот интерфейс может не только работать с LLM моделями, но и выполнять агентные задачи.
🛠 Что такое агентные задачи - это возможность интерфейса: работать с файлами (создавать, удалять, изменять), отправлять почту, делать посты в соц. сети, деплоить проекты в GitHub и на другие ресурсы, работать с облачными дисками и так далее. Если кратко, Agent Bionic - это LLM с руками. Узлы LM-Studio orex так же будут работать с Bionic как с LM-Studio без изменений. По умолчанию Bionic имеет доступ только к песочнице, но вы можете предоставить ему доступ и к другим директориям вашего ПК. Снести данные без разрешений он не сможет.
🛠 Это локальный интерфейс, но он может работать как с локальными моделями, так и с онлайн моделями Kimi, GLM и DeepSeek.

📎 LM-Studio Bionic: ссылка

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK

3k 0 32 14 43

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE
🎓 Boosty: перейти

🛠 В этом видео вы узнаете как обучать Krea2 Lora онлайн бесплатно на modelscope.
🛠 Можно обучать по несколько Lora в день без задействования ресурсов вашего компьютера.
👌Эту Lora можно протестировать сразу онлайн.
👌 В ComfyUI и Forge Neo она так же работает.
🛠 Обучать Lora можно лицу или стилю.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ

📎 MAX / 📎 VK


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🔥🛠 FloatingLauncherOreX — это легковесный, плавающий менеджер ярлыков и папок для ОС Windows, созданный для того, чтобы навсегда освободить ваш рабочий стол от беспорядка.
👌🛠Программа позволяет удобно структурировать софт, директории и быстрые заметки по вкладкам, обеспечивая молниеносный доступ к нужным инструментам в один клик.
❗️🛠 FloatingLauncherOreX распространяется бесплатно.
📎 Ссылка на программу в описании под видеообзором!

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎 MАХ / 📎 VK

3.4k 0 23 26 29

KREA2 text 2 image, Edit, Controlnet, style transfer

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE
🎓 Boosty: перейти

📣 Сегодня поговорим про модель Krea2. Это одна из лучших моделей для генерации изображений в open source на сегодня она, уступающая только более тяжёлой Ideogram4.
👌 Krea2 это text 2 image модель, но благодаря его гибким возможностям к обучению на этой модель можно также делать и редактирование изображений.
🚀 Потребление видеопамяти в районе 15 Гб, но модель отлично работает на 12 Гб - модель доступная для пользователей!

🔞NSFW Lora и схему под нее приложу на Boosty бонусом.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎 MАХ / 📎 VK

4.4k 2 61 16 40

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE
🎓 Boosty: перейти

🛠🎭 Krea2 отлично подходит для обучения LORA на лицо или стиль

✅🔥 Я подготовил Portable Ostris UI-Toolkit на последнем окружении (бесплатно можно скачать по ссылке в описании под уроками) и записал этот подробный ролик с хорошо подобранными настройками для обучения лицу Lora
✅ Так же собрал рабочий процесс для пакетного описания изображений и их конвертации и сжатия на специально написанных для этого узлах.
🚀 Обучение Lora на RTX 5090 занимает 30 мин, это очень быстро. Training должен запустится от 12 Гб VRAM с выгрузкой слоёв модели.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK


⚙️ Обновил узлы ComfyUI-GigaAM - Audio to Text

❌ Если кто пользовался свежими сборками ComfyUI и деклассировал свой torch, то теперь эта жесть исправлена.
Проверено на torch 2.12. Последнее окружение ComfyUI на сегодня.

🤖 Установка:
Manager -> Install via git Url -> https://github.com/orex2121/ComfyUI-GigaAM.git
После этого устанавливаем зависимости, запустив:
custom_nodes\ComfyUI-GigaAM\INSTALL_DEPS.bat

🔗 Простенький workflow тут: ССЫЛКА

📼 Пост с переводчиком видео на этой штуке тут: ССЫЛКА


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE
🛠 Поговорим про обновленную технологию Scail 2, для переноса движения с видео. Scail 2 может работать с длинными видео❗️

🎓 BOOSTY: перейти

Что может эта модель:
✅ Scail 2 может переносить движение в новую сцену. Вы загружаете видео и изображение и изображение начинает повторять действия, которые происходят на видео. В итоге у вас получается полностью новая сцена.
✅ Вы можете заменять только персонажей в исходном видео, сохраняя фон в оригинале.
✅ Вы можете изменять стиль оригинального видео до момента смены объектов на этом видео.
✅ Модель Scail 2 основана на модели Wan 2.1, но потребление видео памяти всё же немного выше. Около 20Гб Vram потребляет генерация в 0,6 МП и около 24Гб в разрешении 0,8-1 МП.
❗️Но на 16Гб VRAM эти схемы точно работают. Время генерации 10 сек ролика в разрешении 0,6 МП на RTX5090 занимает около 150 сек. В разрешении 0,8МП около 200 сек.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MАХ / 📎 VK


🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓 Boosty: перейти

💥Boogu-Image — это универсальная фундаментальная модель для генерации и редактирования изображений.
🛠 Технологически Boogu выделяется тем, что это _единая архитектура_, которая изначально тренировалась не только на генерацию с нуля (Text-to-Image), но и на глубокое понимание структуры изображения для его редактирования. Лицензией Apache 2.0.
🛠 Boogu-Image представлена в 3х моделях:
- Boogu Image Base
- Boogu Image Turbo
- Boogu Image Edit
Преимущества:
- Хорошо работает с текстом, в том числе и на русском языке
- Отлично понимает сложные, многосоставные запросы
- Хорошо работает с разными стилями
- Низкое потребление VRAM (FP8 13.5 Гб и GGUF Q4 10.5 Гб)

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ+АРХИВ
📎  MАХ / 📎 VK


🔥 Перевод больших видео и транскрибация русской речи с GigaAM

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓 Boosty: перейти

☑️ Это многофункциональная схема для перевода видео на различные языки.
☑️ Схему можно использовать как транскрибатор аудио в текст.

🛠 Модель для транскрибирования аудио GigaAM - это модель от российских разработчиков Giga которая обучалась на Русском языке и с русской речью работает очень, хорошо ❗️, а так же быстро и с низким потреблением VRAM (в пределах 8Гб).
🛠 На выходе вы можете получать текст с таймингами с разными разбивками по словам или предложениями, а так же делать диаризацию говорящих (разделение по говорящим). В схеме используются LLM модели для корректировки транскрибированного текста и перевода. Чтобы LLM хватило контекста, текст разбивается на чанки (части).
🛠 Загрузчик аудио/видео специально разработан под эту схему, чтобы переваривать многочасовые аудио/видео. Озвучка переведенного текста может быть сделана на любой TTS модели, в этой схеме CosyVoice3 и OmniVoice3. Причем озвучку можно делать в режиме Multi Speak.
🛠Для склейки видео и новой аудио дорожки специально разработан для больших видео файлов - работает моментально.
👌Обязательно пользуйте меню, так как видео очень большое.

Мои ресурсы:
🔥 Курс по "ComfyUI"
🔥 Курс по "AUTOMATIC"
🔑 BOOSTY

📺 СТРИМЫ+АРХИВ
📎  MAX / 📎 VK


🔥 Перевод больших видео и транскрибация русской речи с GigaAM

🛠 Многофункциональная схема

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

🎓 Boosty: перейти


🔥 Gemini Pro - это мощнейшая LLM модель, на уровне Chat GPT и Grok, которая отлично подходит для написания кода и решения различных ошибок.
🛠 Nano Banana Pro мощнейшее решение для генерации и редактирования изображений.
🛠 Gemini Omni видео нейронка для редактирования видео.
☑️ Доступ к Gemini Pro с комфортными лимитами можно приобрести за 400-700 руб (цены меняются) на 18 месяцев.
👌В придачу получаете 5 Терабайт Google диска на 18 мес. И 1000 токенов для генерации видео на каждый месяц из 18. По Nano Banana никогда не доходил до лимитов, но они скорее всего есть.

🎓📎 Boosty: подробный урок

4k 1 62 55 42

🎦СМОТРЕТЬ НА YOUTUBE
🎦СМОТРЕТЬ НА RUTUBE
🎓Boosty: перейти

👌В этом видео разбираем свежий релиз — Ideogram 4.0. Разработчики пошли по правильному пути: перевели модель на открытые веса (open-weight, 9.3B параметров) и заточили её под реальные ❗️рабочие задачи, а не просто под красивые арты.
✔️Посмотрим на примеры генераций, проверим, насколько точно модель слушается сложных структурных промптов, и стоит ли внедрять её в свой пайплайн.
📌 Что обсудим в видео:
☑️ Честное 2K-разрешение: генерация идет сразу в высоком качестве (до 2048px). Без костылей и сторонних апскейлеров — сразу готово к печати.
☑️ JSON-промптинг: полный контроль над композицией. Теперь можно жестко задавать координаты объектов (bounding boxes) и цвета в HEX-кодах.
☑️ Лучшая генерация текста: нейросеть отлично понимает мультиязычные надписи, сложные шрифты, плакаты и многострочные блоки.
☑️ Открытая архитектура: модель доступна в ComfyUI.

Мои ресурсы:
🔥 Курс "ComfyUI"
🔥 Курс "AUTOMATIC"
🔑 BOOSTY
📺 СТРИМЫ
📎 MAX/ 📎VK


Видео является дополнением к прошлому видео:
 • PID Upscaler - Быстро и хорошие детали • 

👌🔥Выяснилось, что PID не хорошо работал на пропорциях отличных от 1:1, но в новой схеме я исправил это и теперь вы на любых пропорциях изображений будете получать отличные результаты по апскейлу.

🎓 Boosty: обновленный пост

🎦 СМОТРЕТЬ НА YOUTUBE
🎦 СМОТРЕТЬ НА RUTUBE

4k 1 38 5 43
Показано 20 последних публикаций.