NEURO HYPE


Гео и язык канала: Россия, Русский
Категория: Технологии


все последние штуки в нейро движе что можно юзать

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Репост из: Метаверсище и ИИще
1. Как всё началось и откуда взялась эта идея?

Макс Фадеев: Всё началось с вопроса: а что если создать клип, где нет ни одного реального человека? Я давно мечтал отойти от работы с реальными артистами. Именно поэтому когда-то придумал Глюк'oZу: достаточно выключить тумблер, и анимационный персонаж никогда не позвонит и ничего не потребует. В начале нулевых мы тратили на клипы этого проекта десятки тысяч долларов и месяцы работы, страшно вспомнить. Притом что это были имиджевые траты - видеоконтент ничего не приносил.

В случае с -иди на мой голос- мы собрались с ребятами из российских и белорусских ИИ-кластеров, которые занимаются созданием генеративного видео и сделали что-то своё включая уникальные нейросети, чтобы всё выглядело не как у всех. Я познакомился с ними после выхода клипа SEREBRO -Song#2- в конце прошлого года, где мы (кажется) первыми в России использовали нейросети в музыкальном видео - тогда это был в основном Kling 1.5, пару кадров делали в Runway Gen-3. Тогда нам пришло много писем от компаний с предложением поработать вместе над музыкальными видео.
В этот раз мы поставили цель - уложиться в две недели. Когда я сказал команде, все думали, что я шучу. Но мы загорелись - и вот результат. Клипы сейчас либо дешёвые и с вайбом, либо дорогие и скучные. А мы, кажется, сделали что-то совсем новое: 70% — это ИИ, включая наши фишки, и 30% - магия художников.


2. Какие технологии использовали?

МФ: Я не технарь, так что без заумностей. Мы взяли передовые ИИ-инструменты для генерации видео - те, что сейчас на слуху, чтобы сделать 70% работы. Но просто взять готовое - не наш путь. Мы с нашей командой и партнёрами из России и Беларуси создали свои нейросети, чтобы добавить уникальности: доработать мимику, движения, текстуры - всё, чтобы персонажи были как мы. Загрузили кучу наших фото и видео, описали, что хотим, - и ИИ нарисовал целый мир. Окружение, движения - всё это мы прогоняли через наши кастомные алгоритмы, чтобы было живее, чем обычно. Потом художники подчищали 30% работы вручную - без всяких 3D-программ. Никаких рендеринговых движков, только наши нейросети и ручная доводка.

3. Сразу всё получилось или пришлось помучиться?


МФ: Если бы сразу… Первые версии персонажей были не очень: мимика не совпадала, глаза как у роботов. Мы почти неделю возились: дообучали нейросети, подправляли вручную. Но некоторые косяки мы решили оставить, чтобы сделать клип живым, с ИИ-душой. В итоге персонажи стали выглядеть как настоящие, идентичные реальным людям.

4. Какие были сложности? Что удивило?

МФ:Самое сложное - это заставить ИИ "поймать" настроение лабиринта, чтобы он выглядел не просто как рандомный набор стен, а как живой, давящий мир. Наши нейросети, которые мы создали с ребятами, иногда выдавали слишком "плоские" текстуры - будто из компьютерной игры. Приходилось дообучать их на наших эскизах и фото, чтобы кафель и бетон дышали драмой. А что удивило? Как креатор, я каждый день поражаюсь тому, как работает ИИ - это как новый инструмент в музыке, который постоянно открывает что-то неожиданное. Но когда я узнал, что мы можем создать свою модель с закрытым кодом, это перевернуло моё представление о возможностях. Это как получить в руки бесконечную палитру для творчества. Я до сих пор осмысливаю, какие огромные горизонты это открывает для создания чего-то нового.

5. Расскажите какой-нибудь кейс из работы над клипом

МФ: Был момент, когда мы чуть не попали с цифровым двойником Мины - нашей героини, чей прототип, корейская актриса, уже улетела обратно в Сеул. Ее мы создавали самой первой и в спешке. Мы снимали с ней много материала для ИИ, чтобы её копия в клипе была как живая, с её эмоциями и харизмой. Но в разгар работы поняли: данных не хватает, особенно для её выразительной мимики в ключевых моментах. Пришлось думать, как выкрутиться. Мы звонили ей и просили записать на телефон несколько дополнительных фото и видео с разными эмоциями, она за ночь прислала нам много материала, который сделала как могла. К счастью, в итоге все получилось.


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Нейропрожарка

Новый клип от Максима Фадеева, в котором его интегрировали в AI мир персонажа, которого он же и создал.

Качество тут: https://www.youtube.com/watch?v=vQMUD1CL7jg

Слово Максу (следующий пост, спойлер - бюджет 10M):

@cgevent


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Higgsfield "What’s Next?"

Хиггсы, похоже, хотят полностью исключить сценарную компоненту из создания контента. Ну то есть сценарий будет, но его будет писать, а точнее собирать из кусочков ИИ. Причем без всякого текста, а сразу видеокусками.

Новая фишка Хиггса "А что было дальше" позволяет загрузить ОДНУ картинку, а дальше ИИ предложит ВОСЕМЬ видео(!)вариантов развития событий. Выбираете нужный, идете в конец видоса, и снова выбираете один из восьми вариантов. История как бы ветвится исключительно на основе ваших (нет, не промптов) кликов.

И вот вы уже как крыса жмете на рычажок "ашодальше?" и путешествуете по мирам, семантику и логику которых придумал ИИ на основе вашей чахлой входной картинки.

Ну, за сценаристов.

P.S. Мне, правда, страшно представить, сколько это будет стоить в токенах..

@cgevent


Репост из: VAI
Продолжаю тему применения ИИ при создании концептов. Ранее я писал про персонажей, а теперь затрону тему концептирования локаций.

Сейчас мы вовсю делаем детские режимы для наших игр, поэтому и стиль, и тематика концептов ориентированы на детскую аудиторию.

Инструменты ИИ развиваются каждый день, и пайплайны можно менять так же часто. Раньше я уже пробовал создавать локации через ИИ, но тогда модели просто «не вывозили» объем контекста. Все ломалось, особенно когда нужно было сделать что-то логичное: концепт превращался в «кашу». Но сейчас ситуация изменилась: новые инструменты позволяют заметно ускорить разработку. Положительные сдвиги начались еще с Nano Banana - даже она показывала неплохой результат, но с Pro-версией всё стало намного лучше. 🔥

Я использую первую версию в AI Studio, так как там дают много бесплатных попыток в день: генерируя целый день с двумя Google-аккаунтами, я даже не успеваю израсходовать лимиты. А для Nano Banana Pro я купил подписку Gemini Pro. Там, помимо самой Gemini 3, можно прямо в чате генерировать изображения (Banana Pro) и видео в VEO 3.1. Минус в том, что в режиме чата Banana портит изображения: уже после 2-3 итераций картинка начинает сильно «шуметь». Поэтому в таком режиме приходится работать очень аккуратно.
И там и там нужен VPN.

Перейдем к самому процессу.
На старте как я вижу можно использовать разные подходы:

1️⃣ Набросок от руки: лайн или простенький скетч сразу в цвете.
2️⃣ Работа от референсов: собрать исходники, подходящие по стилю/качеству, и на их основе сделать первый вариант.
3️⃣ Комбинированный вариант: для более жесткого контроля (но и более трудозатратный) - сделать лайн и цвет, а затем отрендерить в нужной стилистике.

Все, как обычно, зависит от требуемого финального результата.

Для этой задачи я выбрал самый простой (на мой взгляд) способ: собрал референсы и работал с ними.

🔹 Закинул референсы в Banana и попросил на их основе создать изометрическую локацию.
🔹 Получив первый результат, начал его дорабатывать. Для этого использовал новый инструмент Qwen-Image-Layered (писал о нем ранее). Модель открытая, ее можно запустить локально или найти демки на Hugging Face. Суть в том, что она разбивает изображение на слои. Пусть слои не идеальные, но это уже слои!
🔹 Я подвигал элементы, поправил композицию, что-то удалил или быстро подрисовал (не особо стараясь, так как это набросок).
🔹 Снова закинул результат в Banana и попросил исправить рендер, вписав элементы в окружение.
🔹 Когда концепт начал меня устраивать, я обсудил его с командой. Убедившись, что это то, что нужно, перешел к детализации: добавил трубы, телевизор, телефон и прочее. Добавлял через маски: рисовал силуэт в нужной зоне и просил сгенерировать объект, соблюдая форму и стилистику.
🔹Получившийся результат прогнал через апскейлер. В моем случае это был Topaz (я пользуюсь им через Krea, но есть и другие варианты).


Конечно, не обошлось без косяков - кое-где пришлось «пробежаться» руками и доделать детали. Но это минимальная работа. 🤓

Сама локация тоже не финальная. Она скорее служит для понимания атмосферы, а итоговая версия будет выглядеть немного иначе. Покажу её уже после того, как соберём всё в Unity.

Технически пайплайн можно миксовать как угодно: тут всё, как и в промптинге, основано на фантазии и опыте.

Сейчас техническая реализация уже не является проблемой. Основная сложность - это идея. Если она есть, реализовать ее теперь не сложно.

Интересно послушать, как вы справляетесь с подобными задачами в новых реалиях? 🧐

P.S. Дальше по плану обсудим, как генерировать локации и персонажей в 3D и собирать их. Покажу на примере движка Unity.

P.P.S. Также закинул в комментарии еще один промежуточный вариант концепта, который не утвердили и другое освещение по рабочей локации.

@VAI_ART
#VAI_Practice


Репост из: эйай ньюз
Видео недоступно для предпросмотра
Смотреть в Telegram
Runway Gen-4.5

Whisper Thunder на арене оказался новой моделькой от Runway, она побила Veo 3 на 20 ELO. Доступ раскатают на всех подписчиков в течении пары дней. Как вам качество?

Блогпост

@ai_newz


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Нейропрожарка

LIFT. 18+

Автор: Олег, @OlegRed_STAV

Центральная сцена в лифте — была сделана из ОДНОЙ фотография сгенерированной в Midjourney.
Далее по этой фотографии анимация в Grok Imagine. Менялись ракурсы, движение камеры, освещение и действие внутри сцены через промпты.
В Midjourney догенерил еще 2 кадра, это коридор с лифтом и серверная.
Остальные сцены были сделаны с помощью — (Nano Banana) на основе 3 фотографий.
Анимация в Grok Imagine – коло 500 + генераций , 36 пошли в ролик.
Трек сгенерирован в SUNO в стиле (Sigilkore/Crash Funk)
Монтаж видео в DaVinci,

По деньгам:
Годовая Студенческая подписка Gemini Pro – 1000 руб.
Grok – 30$
Midjourney -30$
Suno 10$
Topaz SLm –локально.
Вся работа заняла около 50 часов , в течении 3х недель.


@cgevent


Репост из: Denis Sexy IT 🤖
Принес еще один клевый промпт для новой наны бананы – он полезен тем кто хотел бы чуть глубже окунуться в свои же генерации (потому что прикольно) или для тех кто работает с видео – на вход даете картинку, промпт и получаете 9 кино-ракурсов из вашей картинки; если какой-то понравился, можно написать название ракурса и попросить вернуть только его в большом разрешении; а потом передаете в какую-то видео нейронку как первый и последний кадр и готово, вы тарковский от мира АИ-слопа; ну или просто вдохновились и пошли снимать такое-же в реальном мире 

Промпт длинный:

Analyze the entire composition of the input image. Identify ALL key subjects present (whether it's a single person, a group/couple, a vehicle, or a specific object) and their spatial relationship/interaction.

Generate a cohesive 3x3 grid "Cinematic Contact Sheet" featuring 9 distinct camera shots of exactly these subjects in the same environment.

You must adapt the standard cinematic shot types to fit the content (e.g., if a group, keep the group together; if an object, frame the whole object):

Row 1 (Establishing Context):

Extreme Long Shot (ELS): The subject(s) are seen small within the vast environment.

Long Shot (LS): The complete subject(s) or group is visible from top to bottom (head to toe / wheels to roof).

Medium Long Shot (American/3-4): Framed from knees up (for people) or a 3/4 view (for objects).

Row 2 (The Core Coverage): 4. Medium Shot (MS): Framed from the waist up (or the central core of the object). Focus on interaction/action. 5. Medium Close-Up (MCU): Framed from chest up. Intimate framing of the main subject(s). 6. Close-Up (CU): Tight framing on the face(s) or the "front" of the object.

Row 3 (Details & Angles): 7. Extreme Close-Up (ECU): Macro detail focusing intensely on a key feature (eyes, hands, logo, texture). 8. Low Angle Shot (Norm's Eye): Looking up at the subject(s) from the ground (imposing/heroic). 9. High Angle Shot (Bird's Eye): Looking down on the subject(s) from above.

Ensure strict consistency: The same people/objects, same clothes, and same lighting across all 9 panels. The depth of field should shift realistically (bokeh in close-ups).

A professional 3x3 cinematic storyboard grid containing 9 panels.

The grid showcases the specific subjects/scene from the input image in a comprehensive range of focal lengths.

Top Row: Wide environmental shot, full view, 3/4 cut. Middle Row: Waist-up view, chest-up view, Face/Front close-up. Bottom Row: Macro detail, Low Angle, High Angle.

All frames feature photorealistic textures, consistent cinematic color grading, and correct framing for the specific number of subjects or objects analyzed.


Репост из: Psy Eyes
Simulon: приложение для вписывания и анимации 3D моделей в видео с реалистичным освещением и трекингом камеры вышло в публичный доступ. Ранее, когда оно ещё было в привате, я делал обзор.

Обновился интерфейс и теперь есть два подхода к созданию сцен:
* Take-based — каждая видеозапись создаёт свою 3D сцену. Удобно для работы над индивидуальными фрагментами.
* Scene-based — можно делать глобальные правки в конкретной сцене и подгружать дубли как камеры. Подойдёт при работе в мультикам режиме.

Между подходами можно переключаться.

Что ещё нового:
* Глобальный контроль анимации — можно поставить на паузу и сделать её сброс в любой момент. Если начать запись во время паузы, анимация начнётся с 1 кадра, позволяя получить предсказуемый результат.
* Улучшен удалённый авторинг в Блендоре
* Поддержка Alembic (.abc) файлов. Конвертер Simulon позволяет воспроизводить анимации в реальном времени на iPhone.
* Рабочие группы для совместной работы над проектами.

Приложение всё также доступно пока только на iPhone.

Сайт
Приложение
Твит


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Нейропрожарка

Шоурил от Дмитрия, где он попытался охватить несколько тематик и показать возможности нейросетей на длинных сценах.

На самом деле нейросети закрывают лишь малую часть работ, основное зависит от человека, который учитывает все детали монтажа и постобработки. Даже самые плохие кадры можно спасти, а самые красивые можно угробить.
Рынок АИ контента за этот год сделал качественный прыжок, и я уверен, что в следующем году нас ждет нечто большее, но это не заменит человеческий фактор, так как это не просто создать картинку и нажать на кнопку. За каждым кадром стоит кропотливая работа, благодаря чему ролик начинает жить.

Я любитель работать с длинными сценами, чтобы соединять кадры между собой, иногда, чтобы это было неожиданно и гармонично. И в этом ролике я продемонстрировал все чему я научился за этот год с нуля.

Процесс создания:
- Сценарий
- Отрисовка ключевых кадров (Seedream4, Nanobanana, Reve)
- Отрисовка дополнительных через Эдиторы.
- Апскейлы кадров
- Анимация (Минимакс, клинг 2.1 / 2.5)
- Липсинг / озвучка 11labs
- Суно для генерации трека с репом, остальные АртЛист.
- SFX эффекты (библиотека АртЛист / 11labs / mirelo )
- Монтаж / цветокор / пост обработка - Давинчи.

Буду благодарен конструктивной обратной связи. Возможно стоит доработать некоторые детали, которых я не вижу.
@dm_creator369

@cgevent










Репост из: mimagie
Видео недоступно для предпросмотра
Смотреть в Telegram
Prompt: LIVE‑ACTION PHOTOREAL CINEMA. NOT animation, NOT storyboard, NOT illustration.
One continuous shot, single take. DO NOT CUT. 24 fps, natural motion blur (180° shutter look).
Camera: gimbal dolly backward at constant speed; slight handheld micro‑jitter under 1.5%.
Framing: MEDIUM SHOT chest‑up; subject stays center‑weighted and same scale for all 12 s.
Lens & DOF: spherical 28–35 mm equivalent; shallow depth of field; eyes tack‑sharp, background softly defocused with natural round bokeh and mild vignetting.
Lighting & grade: natural daylight, soft top‑light through tree leaves; filmic highlight roll‑off; neutral‑warm skin tones; subtle film grain; no toon/line art/text overlays.

Concept: show nearly a year of routine in a single unbroken walk from his front door to the trash can. The background evolves as if time advances day by day (seasons, weather, decorations), but feels like real live‑action environmental changes behind him. The man walks toward camera at a steady pace; the camera glides backwards keeping him framed identically.

Subject identity (lock it): one consistent man, late‑20s/early‑30s, short ginger hair, light freckles, small hoop earring, gold chain, denim jacket over neutral tee. Preserve his face and body continuity across the full shot.

Recurring neighbors (keep them consistent whenever they appear in the background):
• Attractive female neighbor, 30s, short dark hair, pink T‑shirt with yoga mat; friendly glance.
• Smug office manager, 40s, cheap suit with lanyard; slightly antagonistic.

Continuity rules for BIG events:
• Wardrobe special: from 2.6–4.6 s he wears a BLUE Adidas‑style tracksuit (with stripes). Keep this outfit continuous during that window only; then revert to baseline denim afterwards.
• Hair change: abrupt change at ~4.9 s (either bright blue dye OR close buzz cut). After that moment, hair gradually grows back over time; keep the chosen path consistent.
• Black eye: appears suddenly at ~7.6 s; then fades out gradually and completely from 7.6–8.6 s.

Background evolution notes (realistic, not cartoon): every few frames the environment behind him shifts as if to new days—trees with and without leaves, sun → overcast → rain → wind → light snow, holiday lights, umbrellas, scattered puddles—while the sidewalk and “route to the trash can” remain semantically the same. Use physically‑plausible parallax and weather FX; do not change his scale or camera move.

Beat plan over 12 s:
• 0.0–2.4 Establish the walk; subtle leaf shimmer, late‑summer sun; neighbors may appear far back.
• 2.4–4.8 He continues; from 2.6–4.6 s hold the BLUE tracksuit while backgrounds keep advancing through different days.
• 4.8–7.2 Abrupt HAIR CHANGE at ~4.9 s; from there hair slowly regrows. Show a quick “hungover morning” read in his eyes without breaking pace.
• 7.2–9.6 BLACK EYE appears at ~7.6 s and fades 7.6–8.6 s while snow/wind/rain moments pass; smug manager cameo in background walkway.
• 9.6–12.0 Approach the trash can. At 11.6 s he tosses the bag and MISSES by a few inches. Hold his deadpan reaction to 12.0 s.

Audio (generate with video): one continuous RISING SUSPENSE bed across 0.0–12.0 s (no melody), plus subtle diegetic ambience that matches weather (soft rain patter, wind rustle, footfalls), mixed under the bed. No final sting; let the anticlimax land dry at 11.6–12.0 s.

Hard constraints: NO CUTS. NO timelapse. NO speed ramping. NO freeze‑frames. Preserve subject identity and both neighbor identities. Keep subject scale/position constant; keep camera move perfectly continuous.
Forbidden styles: animation, 2D/3D toon shading, sketch lines, low‑poly, comic, posterization.

Показано 14 последних публикаций.

2

подписчиков
Статистика канала