Gnedkov.AI


Гео и язык канала: Россия, Русский
Категория: Технологии


• Учу делать визуалы и ролики с помощью нейросетей
• Простые инструкции, фишки, кейсы — из практики
• Персональное наставничество

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Значится, какие новости

1. С Syntx AI я пока что больше не работаю. На пару постов выше был промокод, вероятнее всего он больше не работает. Не успел отснять ролики, которые от меня требовались, но думаю, что ещё придут позже.

2. Лучшую на данный момент видеомодель Seedance 2.5 стали добавлять в агрегаторы. Немного потестировал. Сто процентов стало более кинематографично, держит кучу референсов и особо не рассыпается, но цена очень сильно кусается 💸
И это пока в качестве 720р. Какие цены будут в более высоком качестве, вообще страшно представить.

3. В конкурсе от Higgsfield походу ничего не выиграл. Но там уже объявили новый, с призовым фондом в миллион долларов. Думаю пойти в соло или поискать команду, хотя одному мне как-то больше нравится работать.

Как-то так. Вот вам пару изображений увлажнителя сделал. Я бы себе такой домой хотел, а вы? 👀


Видео недоступно для предпросмотра
Смотреть в Telegram
🎬 Не люблю я участвовать в конкурсах, там ведь и проиграть можно, а это удар по самолюбию. Но тут решил вписаться.

Увидел, что у Higgsfield можно выиграть грант на 100 000 кредитов, в перерасчёте на наши деньжата это где-то 200-250к, плюс двухнедельное обучение с их командой.

Сразу подумал, что можно попробовать добить свою работу, которая лежит уже месяца 4, и её подать. Но потом понял, что слишком много там нужно переделать, да и нет конечной картины в голове, как это всё должно выглядеть. Решил придумать что-то новое.

👴Сел набрасывать сценарий, прописывать детали мира, в котором это всё происходит, и каким-то образом вышел на человека-медведя, живущего в тайге. Может, на подкорке лежало, что недалеко от моей деревни видели мишку, который рыбку кушал. В общем, как-то так.

Дальше начался долгий процесс по подбору персонажей, локаций, окружения. Собрал пак кадров и пошёл анимировать. Проверял результат и новый круг генераций, пока не получался нужный мне кадр с той съёмкой, которую и задумывал.

Так как площадочка зарубежная, решил попробовать сделать на английском. К слову, я вообще не уверен, что там в закадровом голосе и в диалогах нет ошибок. Надеюсь, всё чисто. Если кто-то хорошо знает английский, отпишитесь в комментариях. Но забавно, когда один из персонажей выдаёт: «Николай Иванович, мы с женой вчера хиикали с этого» 😅

Я как-то опять упустил все сроки, и монтировать пришлось в последний момент. Какие-то недостающие кадры делались уже за час до сдачи. Но как есть.

Сколько ушло денег на это всё, даже считать не хочется. Но примерно тысяч 15, и это с учётом того, что у меня есть безлимитные инструменты.

Результатов конкурса пока нет. Но даже если ничего не выгорит, за эти 15 тысяч я получил реально много нового опыта, который буду применять в других проектах и заказах


Видео недоступно для предпросмотра
Смотреть в Telegram
✍️ 1200 изображений и 270 роликов

Большой пост для тех, кто любит читать. Прошлая неделя была адовенькая на количество работы 😮‍💨 Только сейчас собрался с мыслями, чтобы поделиться.

Так получилось, что у меня очень амбициозная жена с классными идеями, а я товарищ, который любит всё откладывать на последний момент. Таким макаром я попал в ситуацию, где нужно было сделать 12 роликов, каждый не меньше минуты, за неделю.
Все эти разговоры «да нейронка всё сама сделала» меня очень бесят. Я тут свой ролик 2 месяца доделать не могу, а тут 12 😅

Как так получилось. Василина решила сделать танцевальный перформанс, а от меня требовалось сделать подводку к каждому танцу. Она отдала мне истории девочек, и началась работа.

Нужно было продумать визуальный ряд под каждую историю. У нас была одна главная героиня, которая появлялась в каждом ролике, и она же была главным рассказчиком. Внешность уже была готова, так как ранее я делал афишу для этого мероприятия.

Начали с подбора голоса. Перебрали кучу разных вариантов, сразу ничего не нравилось, но вроде бы определились. Дальше пошли генерации.

Первый ролик начинался с монолога героини на минуту 20 секунд. В очередной раз убедился, что самая слабая вещь в видеогенерации это липсинк. Выглядит не очень реалистично, но выжали максимум.

Сделали один ролик, второй, третий. И где-то на шестом Василина сказала чертовски правдивую вещь. Голос главной рассказчицы, который идёт закадром через все ролики, слишком цифровой.
Выход нашли такой. Василина записывала 14 минут озвучки, затем я переозвучивал голос в нейронке. Получилось вообще замечательно 🔥

Правда, иногда голос выходил быстрее, чем изначально записывали, и приходилось перемонтажить ролики.
Последние доделывались уже в день выступления, прямо на площадке. Проверка, как будет выглядеть на экране и звучать в колонках, подгонка по звуку и монтажу, и снова проверка 🫠

По итогу мы сделали очень прикольную историю, которую не стыдно пересматривать. А если при просмотре местами появляются мураши, значит всё удалось 🙂

В чём делал:
Анимация — Kling 3, сложные сцены в Seedance 2
Липсинк — HeyGen
Озвучка — ElevenLabs, лучше сейчас всё равно ничего нет
Музыка — пару треков в Suno, остальное подбирал в интернетах


✍️ Теперь я дружу с Syntx AI

Други и подруги. Кто хотя бы немного увлекается нейросетями, точно слышал про Syntx AI. Это один из крупнейших агрегаторов нейросетей в России. Если вы давно хотели пользоваться классными нейронками и не возиться с зарубежными картами, то их сайт вам точно подойдёт. Просто берёте свою карту и оплачиваете подписочку.

С сегодняшнего дня я с ними дружу, и ребята предложили промокод на 15% для моих любимых подписчиков. Если кто-то уже пользуется их услугами, тоже можете применить его при оплате.

Также вот моя реферальная ссылочка. И вам скидка, и мне какой-то бонус 🤝

Промокод: gnedkov
Ссылка: https://go.syntx.ai/gnedkov


Видео недоступно для предпросмотра
Смотреть в Telegram
✍️ Сиденс не для бедных

В начале июля или в середине должна выйти Seedance 2.5. Двойка на данный момент лучшее, что есть в видеогенерации.

Коротко, что известно про 2.5:

30 секунд видео с одной генерации
до 50 референсов на вход (у двойки было 12) и точечное редактирование отдельных кусков кадра.

Я не представляю, что там будет по ценам. Но сегодня захотел попробовать сделать генерацию в 4К на 15 секунд в Seedance 2. Даже с учётом того, что лопасти крутятся не туда, качество поражает. ТГ его пережмет, но вы мне поверьте. Честно, после такого не хочется генерировать в чём-то другом)

🤯 Но цена на это 15-ти секундное видео, плюс-минус 3 тысячи рублей. Есть места где дешевле, есть где дороже, но это уже не игрушка для нас простых ребят, а инструмент для крупных компаний с бюджетами.

Расстраиваться не будем. Что-то кайфовое можно делать и бесплатно, главное это сильные идеи и видение, которое нейронки пока не заменят 🕺


Видео недоступно для предпросмотра
Смотреть в Telegram
👋 Давайте расскажу вам об интересном генераторе изображений - Reve

Эта моделька и раньше была неплохой. А тут вышла Reve 2.0 и стала генерировать сразу в нативном 4К разрешении.
Главная фишка - после генерации можно вносить точечные правки. Выбираете отдельные объекты сцены и корректируете.

Нормально генерирует русский текст. На арене text-to-image встала на второе место, обошла Nana Banana 2 и уступила только GPT Image 2.
Из минусов - местами потеряла свой стиль по сравнению с прошлой версией, некоторые даже просят вернуть старую модель.

🎬 В качестве примера прикладываю своего поросёнка, вы тоже можете попробовать по ссылке. Доступны бесплатные генерации.


Видео недоступно для предпросмотра
Смотреть в Telegram
Почему бы не полетать над Смоленском в такой замечательный день

Коптеры запрещены, но в нейронках же можно)

Когда появится возможность точечного редактирования, можно будет собрать сцену 1 в 1 как в жизни, но это чуть позже


Видео недоступно для предпросмотра
Смотреть в Telegram
✍️ Почему теперь я беру предоплату

После залетевшего ролика ко мне пришло несколько заказчиков. Один из них был достаточно крупный. 40 тысяч в запрещённограме, 20 тысяч на ютубе, ну и в ВК прилично. Не берусь оценивать качество подписчиков, но короче на первый взгляд серьёзные ребята. Пришли они с ролика по буктрейлеру и хотели такую же киношную историю, но с собой в главных ролях. Обговорили все детали, даже договорились сделать после этого ещё ролик, короче всё классно

Основная проблема, которая до сих пор существует, это полная уверенность людей, что можно нажать кнопку и получить полных клонов себя, которых этой же одной кнопкой можно загнать в фильм и будет кайф

Короче я день убил на статику, чтобы потом её анимировать, а жена мне сразу сказала — бери предоплату, кинуть же могут. Умная она у меня всё же.

История закончилась грустно. На этапе статики получил обратную связь, что ну не 1 в 1 они получились, хотя это и невозможно на данном этапе развития нейросетей. Хочется им и эмоции как в фильмах, и чтобы прямо эти же люди были. Сказали «подумаем что можно сделать и вернёмся к тебе».

А то, что я под задачу оплатил нужные нейронки, день сидел делал картинки — это всё никого уже не волнует.
Грустная, но поучительная история.

Как говорится, опыт — сын ошибок трудных. Так что скажу спасибо этим ребятам, что помогли это ещё раз осознать 🫡


✍️ Большое обновление от Google

Вчера у Гугла было большое обновление, кучу всего улучшили, но так как я тут пишу про визуальные вещи, то подробнее расскажу про Google Omni Flash 🔥

Это достаточно серьёзное обновление, так как на вход для генерации можно подавать не только изображения, но и отснятые вами видео и вносить в него точечные правки.

Сменить освещение, добавить какие-то новые детали, что-то вроде Kling Motion Control, но качественнее и точечно. Вчера быстро сделал видео и загрузил в запрещённую сеть, можете посмотреть если хотите 👀

Из минусов. На общих планах теряет детали, нужно делать апскейл видео, чтобы было не так заметно. Если жёстко не прописывать, что делает персонаж, то может поломаться физика, опять же на общих планах. На крупняках всё более стабильно.
Если оценивать просто видеогенерацию, без вашего видео на входе, то Seedance 2 по киношности и динамике будет значительно сильнее.

А вот текст написать, что для многих видеомоделей огромная проблема, результат сильно стабильнее 👍

Для самых платных подписчиков можно создавать отдельно персонажа, хоть себя, и вставлять в любую генерацию.

Ещё они выпустили отдельный редактор изображений Google Pics. Теперь нейросеть сама разбирает фото на отдельные объекты: людей, одежду, фон, аксессуары и любые детали. Можно точечно менять что угодно буквально в пару кликов, от лица человека до всей сцены целиком.

Попробовать всё это добро можно в приложении Gemini, в Google Flow и в YouTube Shorts 🤙


Сегодня в нейронках от Google будет большое обновление, уже начинают расскатывать на пользователей. У меня тоже есть доступ, но еще ничего не тестировал.

Но что мы всё про Омэрику. У Яндекса тоже обновление, они покрутили свои модельки и теперь Алиса может генерировать изображения с текстом на русском языке.

Советуют: чтобы получить сразу нужный результат, берите надпись в кавычки и пишите весь текст заглавными буквами. Попробовать обновлённую функцию уже можно в чате с Алисой AI или приложении.


✍️ Неочевидная штука в ChatGPT

Давно не писал сюда, исправляюсь. Может кто-то знает, но думаю, что таких тут немного. В GPT можно генерировать за раз 10 изображений. Соответственно для вас открывается возможность генерить презентации минуты за 3.

Просите создать последовательную презентацию из 10 изображений, задаёте тему и через пару минут получаете 10 картинок, которые можно собрать в презентацию.

Из минусов:
• Может немного поехать типографика, но если это не презентация для какого-то заказчика, а для подготовки к выступлению, лекции или детям показать, то подойдёт отлично
• Может чуть переврать факты или показать позицию, с которой вы не согласны, но это всё можно и в промпте прописать.

Пользовайтесь, короче. Прикреплю пару слайдов, которые он мне выдал


Видео недоступно для предпросмотра
Смотреть в Telegram
Давайте буктрейлер посмотрим, огонечки может какие-то поставим

Еще есть версия в 4к на ютубе, если кто-то на телевизоре хочет посмотреть😁


🥰 Сделал симпатичненький буктрейлер по якутской сказке

Это типа как трейлер фильма, только книги

Покажу вам пару кадров, а уже после сдачи на конкурс закину сюда

Красиво, правда?


Большой пост

Когда вышел ChatGPT Image 2, захотелось его нормально потестировать. В агрегаторах цена на него высокая, но и официальная подписка стоит 20 долларов. Чтобы совесть меня не грызла за траты, я придумал себе задание — с помощью GPT создать презентацию в едином стиле.

У меня был текст презентации и я начал с агрегаторов. Закинул что-то типа «сделай красивый слайд, подходящий под мою тему». Сравнил GPT и Nana Banana, понял, что для задачи подходит GPT.

Оформил подписку за 20 долларов и пошёл генерить. Цель была следующая: закидываю текст выступления, он сам мозгует, что взять на слайд, и делает мне картинку. Если что-то не то, редактирую её прямо в чате. Главным показателем для меня было удержание единого стиля всех слайдов, с примерно одинаковой типографикой, цветовыми решениями и так далее.

Закидываю слайд для примера, отдаю полностью текст и прошу сгенерировать в таком же стиле второй слайд. Он делает, смотрится отлично. Прошу третий — начали уходить в желтизну, и с каждым новым слайдом всё больше и больше. Рамка, которая есть внизу слайда, тоже видоизменилась. Снова взял первый слайд и пошёл в новый чат. В новом чате сделал лучше, но после второй и третьей картинки снова скатываемся в плохие результаты, которые уже визуально трудно подтянуть под единую презентацию.
Тут я подумал, что я глупый дурак, что спалил 20 долларов, а презентация так и не получилась. Полез в настройки чата и понял, почему была беда с картинками.

Сейчас важно. Если вы хотите, чтобы Image 2 делал нормально, всегда включайте думающую модельку. Картинка генерируется дольше, но вероятность того, что вы получите то, что просили, сильно выше. Как включить думающую модельку — смотри скрин 3.

Я подключил думающую модельку и всё пошло. Стиль держит, рамки держит, текст держит. Короче, если вы такой же задрот как и я, то в GPT можно собрать прикольную и красивую презентацию. Но сразу говорю, это будет не просто. Придётся переделывать, подкидывать изображения на слайды, если они нужны, и так далее.

Презентацию из 30 слайдов я сделал. Дальше начались тесты на моих творческих задачах, но там будет информации ещё поста на два, так что не будем. Основные плюсы и минусы указаны в посте для ленивых. Если тоже что-то делали в Image 2, можете отписаться в комментариях. Хороших вам выходных 🤙


Сейчас будет 2 поста про Image 2 от ChatGPT. Один для тех, кто не любит читать, второй большой, с раскрытием темы и лирическими отступлениями. Если читаешь этот пост, то он для ленивых.

Чем хорош. Лучший по генерации текста на изображении, побивает всех и сильно. Отлично подходит для подготовки раскадровок, одной картинкой может создать целую историю. Хочешь фотокарточку с собой и с товаром — тоже сделает, но может споткнуться. Нужен постер или плакат — можно смело открывать Image 2. Лучше понимает промпты и расположение предметов в сцене, чем Nana Banana.

Из минусов. Проигрывает в фотореализме. Крепкая такая цензура. В фотореалистичные сцены через раз подкидывает какое-то пережатое месиво, которое потом уже не отредактируешь. Картинка для примера в посте.

Как-то так, пойду писать большой пост ✌️


Чего-то делаю, но вам не покажу. Пару дней назад оплатил GPT, завтра напишу, что там к чему с генерацией изображений (ну не убийца Nana Banana)

А пока просто красивая картинка из Миджорни


OpenAI ничего официально не объявляла, но уже у многих пользователей картинки генерируются на новой модели — GPT Image 2.

Как проверить, обновилась ли она у вас. Заходите на сайт chatgpt.com
Попросите создать изображение в соотношении сторон 21:9. Если результат по пропорциям 21:9, то у вас новая модель. Работает даже для бесплатных аккаунтов.

Я за GPT не плачу, но у меня уже новая моделька, вы тоже можете проверить. Закину пару вариантов, что генерирует эта штука 👇


✍️ Что известно про GPT Image 2

В начале апреля на LMArena засветилась новая модель для генерации изображений от OpenAI. Точнее, сразу три штуки под кодовыми именами packingtape-alpha, maskingtape-alpha и gaffertape-alpha. Через несколько часов их оттуда убрали, но люди успели погонять и поделиться результатами. Судя по всему, это и есть долгожданная GPT Image 2. Картинка из неё, кстати

Что обещают:
Наконец-то убрали тот самый жёлтый оттенок, который был визитной карточкой предыдущих версий. Помните, генерируешь что-то, а оно как будто через тёплый фильтр прошло. Вот этого больше не будет.
Текст на изображениях стал работать почти идеально. Показывают скриншоты Windows и YouTube, которые можно спутать с настоящими. Комиксы с читаемыми репликами, рукописные записи — всё это теперь модели по силам.
Сильно прокачали «знания о мире». Просишь IKEA ночью или интерфейс Minecraft — получаешь не усреднённую фантазию, а реально узнаваемую картинку со всеми деталями.

По слухам, модель вшьют прямо в семейство GPT-5, а не отдельным модулем.

Чувствую, что ребята из Google сильно напрягутся


🫴 Обещал написать пост по итогу ролика. Делаю.

Первое, что нужно знать, это то, что для этих пяти кадров пришлось сгенерировать 250 изображений.

Затык номер 1. Я не до конца понимал, как должен выглядеть итоговый ролик. Василина прислала референсы, но я не понимал, как их примерить к девчонкам. Решил пойти от обратного, начал искать референсы на Pinterest и в Kosmos.

Затык номер 2. Основным инструментом я выбрал Nana Banana Pro, чтобы сделать изображения. Уперся в то, что на Pinterest красиво, а у меня нет. Крутил промпты туда-сюда, местами получалось даже похоже, но не красиво. Отсутствовал стиль, это большая проблема Nana Banana.
Вот вам решение: берёте картинку и говорите «возьми позу, свет, освещение и замени девушку из изображения 1 на девушку из изображения 2». Только так получалась эстетика в нейронке.

Затык номер 3. Как бы нам ни говорили, что просто закидываешь внешность человека, промпт — и случается магия. В 80% случаев человек будет не похож на себя так, чтобы это можно было брать в работу. Нужно перебрать 100 изображений, и только в 4-х его внешность нормально перейдёт в генерацию. Так что девочкам пришлось делать пластику через фотошоп 😁

По инструментам: Nana Banana Pro с рефом из Pinterest и Seedream 4 для изображений, на Саше сработал только Seedream 4. Анимация — Kling 3.0 и Minimax 2.3.


Видео недоступно для предпросмотра
Смотреть в Telegram
Сделал девочкам афишу под мероприятие.

Вам тоже могу, пока можно просто огонёчки поставить🫠

Завтра точно обещаю написать пост, почему сделать такой ролик было сильно сложно

Показано 20 последних публикаций.