Продолжаю тему применения ИИ при создании концептов.
Ранее я писал про персонажей, а теперь затрону тему концептирования локаций.
Сейчас мы вовсю делаем детские режимы для наших игр, поэтому и стиль, и тематика концептов ориентированы на детскую аудиторию.
Инструменты ИИ развиваются каждый день, и пайплайны можно менять так же часто. Раньше я уже пробовал создавать локации через ИИ, но тогда модели просто «не вывозили» объем контекста. Все ломалось, особенно когда нужно было сделать что-то логичное: концепт превращался в «кашу». Но сейчас ситуация изменилась: новые инструменты позволяют заметно ускорить разработку. Положительные сдвиги начались еще с Nano Banana - даже она показывала неплохой результат, но с Pro-версией всё стало намного лучше. 🔥
Я использую первую версию в
AI Studio, так как там дают много бесплатных попыток в день: генерируя целый день с двумя Google-аккаунтами, я даже не успеваю израсходовать лимиты. А для Nano Banana Pro я купил подписку
Gemini Pro. Там, помимо самой Gemini 3, можно прямо в чате генерировать изображения (Banana Pro) и видео в VEO 3.1. Минус в том, что в режиме чата Banana портит изображения: уже после 2-3 итераций картинка начинает сильно «шуметь». Поэтому в таком режиме приходится работать очень аккуратно.
И там и там нужен VPN.
Перейдем к самому процессу.
На старте как я вижу можно использовать разные подходы:
1️⃣ Набросок от руки: лайн или простенький скетч сразу в цвете.
2️⃣ Работа от референсов: собрать исходники, подходящие по стилю/качеству, и на их основе сделать первый вариант.
3️⃣ Комбинированный вариант: для более жесткого контроля (но и более трудозатратный) - сделать лайн и цвет, а затем отрендерить в нужной стилистике.
Все, как обычно, зависит от требуемого финального результата.
Для этой задачи я выбрал самый простой (на мой взгляд) способ: собрал референсы и работал с ними.
🔹 Закинул референсы в Banana и попросил на их основе создать изометрическую локацию.
🔹 Получив первый результат, начал его дорабатывать. Для этого использовал новый инструмент Qwen-Image-Layered (писал о нем ранее). Модель открытая, ее можно запустить локально или найти демки на Hugging Face. Суть в том, что она разбивает изображение на слои. Пусть слои не идеальные, но это уже слои!
🔹 Я подвигал элементы, поправил композицию, что-то удалил или быстро подрисовал (не особо стараясь, так как это набросок).
🔹 Снова закинул результат в Banana и попросил исправить рендер, вписав элементы в окружение.
🔹 Когда концепт начал меня устраивать, я обсудил его с командой. Убедившись, что это то, что нужно, перешел к детализации: добавил трубы, телевизор, телефон и прочее. Добавлял через маски: рисовал силуэт в нужной зоне и просил сгенерировать объект, соблюдая форму и стилистику.
🔹Получившийся результат прогнал через апскейлер. В моем случае это был Topaz (я пользуюсь им через Krea, но есть и другие варианты).
Конечно, не обошлось без косяков - кое-где пришлось «пробежаться» руками и доделать детали. Но это минимальная работа. 🤓
Сама локация тоже не финальная. Она скорее служит для понимания атмосферы, а итоговая версия будет выглядеть немного иначе. Покажу её уже после того, как соберём всё в Unity.
Технически пайплайн можно миксовать как угодно: тут всё, как и в промптинге, основано на фантазии и опыте.
Сейчас техническая реализация уже не является проблемой. Основная сложность - это идея. Если она есть, реализовать ее теперь не сложно.
Интересно послушать, как вы справляетесь с подобными задачами в новых реалиях? 🧐
P.S. Дальше по плану обсудим, как генерировать локации и персонажей в 3D и собирать их. Покажу на примере движка Unity.
P.P.S. Также закинул в комментарии еще один промежуточный вариант концепта, который не утвердили и другое освещение по рабочей локации.
@VAI_ART#VAI_Practice