Psy Eyes


Channel's geo and language: Russia, Russian
Category: Technologies


Креатив + AI + Web3... и мемы
Личная страница @AndreyBezryadin
За рекламой — в личку.

Related channels  |  Similar channels

Channel's geo and language
Russia, Russian
Statistics
Posts filter


Video is unavailable for watching
Show in Telegram
рисовая братва добралась до наших мемов


Adobe: внедрили в фотошоп фичу Relight в бета режиме.

Можно добавлять на холст 3 источника света и менять освещение, управляя их позицией, интенсивностю излучения, и рассеиванием лучей. При этом оригинальное освещение удаляется, чтобы можно было применить новое. Если выключить добавленные источники света, то останется только естественное освещение, как если бы мы выключили свет в комнате. При этом создаётся отдельный слой Relight Layer, чтобы изменениями можно было легко управлять.

Работает в десктопной бета версии фотошопа и требует наличия Creative Cloud. Изменение освещения производится в низком разрешении, а финальный рендер выдаётся, когда нажимаешь Done. За каждое нажатие снимается 30 кредитов ($0,15).

Хотя при желании это можно сделать и в Comfy. Кто-то даже уже наваял пенсорсную альтернативу на Qwen Image 2.1. Плюс вот вам лоры на Flux Kontext и Qwen Image 2509, которые уже подустарели, но поиграться можно.

Анонс


PlayCanvas: обновили 3D движок до v 2.23.

Что нового:
* Рендеринг WebGPU стал в 3,8 раз быстрее, а WebGL2 в 1,4 раза
* Сплаты, на которые направлена камера, теперь загружаются первыми, а остальные по ходу пьесы, что ускоряет загрузку сцены и освобождает ресурсы
* Улучшения в отображении статистики и инспектора
* Новые примеры игрового UI
* и не только

Гитхаб


Video is unavailable for watching
Show in Telegram
Suno: в бете добавили генерацию речи.

С её помощью можно создавать разговорную речь для персонажа, или делать озвучку для творческих или продуктовых видео. Есть ли возможность генерить 2 и более спикеров, чтобы делать подкасты, диалоги, итд пока не ясно.

В режиме Simple можно описать промтом, что ты хочешь получить, а дальше голос, музыка, и слова подберутся сами. Если же есть конкретные слова и предпочтения по стилю (например, тону, темпу, и эмоциональности), то стоит использовать режим Advanced. Там же можно задать вариативность, пол спикера, и выключить фоновую музыку, которую Suno добавляет по умолчанию.

Чтоб ElevenLabs и Fish не скучно было.

YouTube
Сайт


Fish Audio: выкатили превью генератор речи Drama 3.

Основное изменение — отказ от жестких аудиотегов из 1-2 слов в пользу обычного описания текстом интонации, темпа и характера персонажа.

Что умеет Drama 3:

* Можно точечно перегенерировать всего одно слово или фразу в уже готовой дорожке, не затрагивая остальной кусок.
* Модель способна переключаться на другой голос прямо посреди предложения.
* Генерация диалогов нескольких героев за один проход.
* Работает на русском.

Сначала я на сайте поигрался с версей 2.1, чтобы увидеть разницу. Выяснилось, что среди доступных голосов есть актёр Сергей Бурунов, и звучит его голос очень похоже. Исходя из тестов версии 2.1: теги не всегда срабатывают (конкретно crowd laughing и excited были проигнорены), а в ударениях часто промахи.

Переключился на Drama 3 и оставил промт тем же, только добавил пару описаний вместо тегов. Действительно текст читает чётче предыдущей модели и с более правильной интонацией. Да, crowd clapping тут было проигнорено, но в целом весьма неплохо.

Превью версия уже доступна бесплатно на сайте. Чтоб ElevenLabs не скучно было

Сайт








Video is unavailable for watching
Show in Telegram
Так, а если взять черновик Seedance 2.5 в 480p и не рендерить его в 1080p, а заапскейлить в 4к с помощью нового Starlight Fast 3 или Starlight Precise 2.6 в Topaz?

На данном 30 сек примере этот манёвр занял около 8 минут и стоил автору 49 кредитов = $12,25. То есть $0,41/сек, что вдвое дешевле финального рендера в 1080p через ноды Comfy.

При этом могут наблюдаться небольшие сдвиги по цветокору и по позиции объектов.

YouTube
Твит


Режим Seedance 2.5 Draft, позволяющий нам сначала сгенерить дешевое черновое превью в 480p для тестирования разных промтов, и затем уже пустить подходящий на финальный рендер в 1080p, заехал в Comfy, Pika, PicsArt, Krea, Runway, и другие агрегаторы.

Прямо в таблицах цен Draft часто нигде не расписан, ибо может проходить как обычный 480p. Но он примерно в 4-6 раз дешевле финального рендера в 1080p.

Цены там, где они прямо указаны:
* Comfy ~$0,15/сек черновик против ~$0,82/сек 1080p
* Pika ~$0,18/сек черновик против ~$1/сек 1080p

Черновик нужно финализировать где-то в течение 24 часов, а где-то в течение недели. Потом он удаляется.








Хотя чё нам Seedance — нас и Minimax неплохо кормит.

Лора на замену персонажей. Есть демо.
Лора на 3D анимацию.


Любопытное: ByteDance разрешают хостить Seedance 2 и 2.5 на стороне других платформ.

Конкретно эти модели есть у Fal и они утверждают, что в их версии ограничений на работу с лицами нет.

В твиттере Fal указывается, что в Seedance 2 можно генерить 1080p или 4к, но на странице модели видно только 720p за $0,37/сек. А вот на странице Seedance 2.5 уже есть 1080p и стоит $0.57/сек.

А недавно Pika обновили свою платформу, и опытным путём выяснилось, что там тоже нет запрета на рефы с людьми в Seedance 2.5 (см комменты).

Твит (Seedance US 2.0)
Твит (Seedance US 2.5)
Seedance 2 t2v (US)
Seedance 2 i2v (US)
Seedance 2 r2v (US)
Seedance 2.5 t2v (US)
Seedance 2.5 i2v (US)
Seedance 2.5 r2v (US)

PS: реквестирую слитие весов во имя Омниссии.






Comfy: запустили Comfy Router — облачный сервис для разработчиков, объединяющий генерацию изображений, видео, 3D и аудио под одним универсальным API.

Устанавливается Comfy SDK, добавляется API ключ взятый с Comfy Developer Platform, вписываются нужные модели (пока доступны Seedance 2.5, Nano Banana Pro, MiniMax H3, GPT Image 2, Kling, и Black Forest Labs), и затем выбирается провайдер с лучшей ценой и доступностью в плане очереди. Новые модели переключаются простой сменой текстовой строки в коде.

Пример запроса:
from comfy_sdk import Comfy

client = Comfy(api_key="comfyui-...")

result = client.models.run(
"openai/gpt-image-2",
arguments={"prompt": "aerial view of a neon coral reef at dusk"},
provider="fal",
)

Если выбранный хостинг недоступен, запрос не перенаправится «втихую» на другой, а вернет ошибку, сохраняя контроль над стоимостью и регионом вычислений.

Так как контент генерится порой десятки минут, через метод submit роутер мгновенно возвращает ID задачи, а встроенный менеджер очередей сам обрабатывает сетевые сбои и лимиты нагрузки, удерживая и продвигая задачу до победного конца.

Оплата только за API запросы с единого баланс кредитов в воркспейсе Comfy, без подписок. При этом проверка баланса происходит до валидации самого запроса — если кредитов нет, система сразу вернет ошибку 402, экономя ресурсы на обработку некорректных данных. Если соединение оборвется посреди транзакции, повторный запрос с тем же ключом вернет статус уже запущенной задачи, полностью защищая баланс от двойных списаний.

Загруженные входные ресурсы (assets) и сгенерированные файлы автоматически удаляются из облачного хранилища ровно через 24 часа.

Вектор Comfy понятен, но в нынешнем виде как по мне слишком много ручной работы, и из-за этого пропадает сама суть – роутер должен автоматически маршрутизировать задачи и выбирать самые дешевые / быстрые генерации из пула провайдеров. Тем более, что цены тут автоматом тоже не парсятся и тебе нужно вручную их отслеживать на на сайте Comfy.

Анонс
Comfy Developer Platform



19 last posts shown.