НИИ им. Лутаенко


Гео и язык канала: Россия, Русский
Категория: Технологии


Работаю директором по ИИ в Narrators (Е-Promo Group)
Руковожу студией подкастов Слушай Сюда
Делюсь опытом использования нейросетей в бизнесе и жизни
Не продаю курсы, все бесплатно и от чистого сердца.

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Кстати, еще интересный факт. Что бы получить видео для новости я просто прислал в Claude Code ссылку на видео с ютуба и сказал вырезать такой то фрагмент.

Я еще помню те времена, когда для решения этой задачи надо было искать сервис для скачки, открывать монтажную программу, вырезать фрагмент и рендрить кусок.


Видео недоступно для предпросмотра
Смотреть в Telegram
Так как я большую часть своей жизни руковожу видеопродакшнами, тема ИИ-агентов для видео будоражит меня больше всего.

Посмотрел новое видео Студии Игор с хорошим примером, как можно визуализировать данные. Если коротко: чувак скармливает агенту свою дорожку с голосом, агент её расшифровывает, разбирается в теме и рисует анимацию. Выглядит очень наглядно.

Как это может помогать лично вам? Например, можно сделать обучение сотрудникам, презентацию клиенту, эксплейнер на сайте.

Записали зум-конференцию, где рассказываете про итоги работы компании, — и через 20 минут у вас готовый ролик с подробным визуалом.

На данный момент есть два самых распространённых инструмента, которые помогают агенту сделать такую анимацию: Remotion и HyperFrames. Не надо даже разбираться, как это работает, просто открываете свой Codex или Claude Code и говорите: «Сделай из моей записи голоса видео с помощью Remotion». Агент сам установит что нужно и сгенерирует видео.

Ещё буквально год назад для такой задачи нужен был моушн-дизайнер, монтажёр и десятки тысяч рублей, а сейчас — одна строчка в контекстном окне.

318 0 17 1 17

Периодически на этом канале я отвечаю на вопрос: как заработать в интернете на ИИ?

Короткий ответ — никак. Абсолютно всё, что вы могли увидеть в интернете на эту тему, — обман. Всё в лучших традициях сыра в мышеловке: зарабатывают на вас, а не вы.

Почему вообще говорю на эту тему? Люди, которым мне получается доказать ценность нейросетей, буквально сразу попадают в лапы алгоритмов и смещают внимание на этот инфошум.

Сразу к делу. Контент-заводы не работают. Идея сделать автоматизированную сборку видео и зарабатывать на этом подарит максимум блокировку всех аккаунтов. Это работает с переменным успехом на готовой базе подписчиков, не с нуля.

Холодный лидген таргетированных сообщений компаниям — блок аккаунта в мессенджере.

Генерация поздравительных видео в стиле Пиксар — смерть в нищете. Рынок перенасыщен и задемпингован, количество вливаемых сил не сопоставимо с маржинальностью.

Нейросети классно помогают высвобождать время, это тоже в свою очередь заработок, просто не такой очевидный.

Моя личная рекомендация — начинать использовать ИИ-агентов для решения своих рутинных задач. Стройте отчёты, делайте презентации, исследуйте темы, автоматизируйте работу с данными. В общем, просто ищите то, что отнимает у вас время, и просите агента помочь.

Современному человеку абсолютно точно нужно понимать возможности ИИ, без этого знания жить будет становиться всё сложнее.

320 0 6 11 31

Когда изучал корп-подписки разных сервисов для интеграции в наше агентство, поймал себя на любопытном наблюдении: а Клод-то единственный, у кого нет собственной модели для генерации изображений.

У OpenAI — GPT Image, у Google — Nano Banana, у xAI — Grok Image, у Anthropic — .

Они вроде как и не распыляются: у Клода лучшие облачные модели для кодинга на рынке. Но я порой испытываю необходимость быстро нагенерить ассетов для интерактивной презентации, а возможности такой нет.

Именно поэтому всем, кто у меня спрашивает, какую подписку купить, всегда отвечаю: ChatGPT. Это прям самый-самый сбалансированный вариант. Он быстрый, хорошо дизайнерски мыслит, нативно генерит изображения. Ещё и лимиты скидывает постоянно.

Gemini от Гугла прямо тотально сдулась: модель тупая, Нану Банану забыли, Антигравити похоронили. А ещё можно купить подписку и узнать, что она не работает в вашем регионе, точнее работает только текстовый чат.

А вот Grok уже интереснее, они стали залетать в офисную нишу. Качнули модель работать с документами, презами, эксельками. Анализирует, сопоставляет, запускает оооочень долгие агентские сессии, генерирует картинки (новый Grok Image щас в топ выходит) и видео генерирует практически без цензуры. Итого средний обывала может и отчётики сделать, и мемов с голыми титьками наклепать.

Хотел просто написать короткое наблюдение, что Клод — последняя модель, которая не умеет картинки генерировать, но вышел полноценный обзор на рынок.


Увидел фотку Мистера Биста в твиттере и вспомнил свой же тейк: мне жалко знаменитостей, потому что они лишены возможности поприкалываться над собой в нейросетях.

Ни Nano Banana, ни GPT Image ни за какие угрозы не согласятся генерировать лица селебрити. Остаётся только опенсорс?


Друзья, все привет. Я чуть подвыпал из процесса, хорошо что отложки работали. Не знаю видели ли в интернете причину моего отсутствия, но я возвращаюсь, интересности за неделю накопились.


Видео недоступно для предпросмотра
Смотреть в Telegram
Я постоянно стараюсь чёто изучать, чтобы развивать мозг. Когда-то учил тайский язык, учился строить стены с контроллера в Фортнайте, Пайтон учил. А щас нейросети отнимают заменили мне все, и как будто учиться чему-то перестало быть нужно.

И вот я нахожу Strudel — сервис, где музыку можно программировать. Все началось с одного рилса, где девушка программировала музыку.

Я окончательно понял, что мне удобнее воспринимать мир через математику. Я люблю всё параметрическое: создаёшь паттерн, потом меняешь одну цифру — и это меняет весь трек. В этом такая же магия, как во фракталах.

Очень рекомендую поизучать эту штуку. Мне понадобились сутки, чтобы врубиться в синтаксис и прилипнуть окончательно. Сервис однозначно попадает в мой «самолётный список» — занятия, которыми можно заниматься в самолёте, пока нет интернета.

strudel.cc

526 0 7 11 21

Я написал скилл, который автоматизирует получение загранпаспорта. Как вам такой #юзкейс ?????

На прошлой неделе мне скинули pdf-инструкцию, как получить ЭЦП, чтобы пользоваться электронным документооборотом. И мне пришла гениальная мысль: зачем самому париться, если это можно поручить агенту? А чё, инструкция есть, доступ к браузеру у него есть — бери да делай. Вот он и сделал.

В некоторых сервисах (в Магнифике в частности) стал встречать такие формулировки: «Если хотите установить наш плагин, напишите своему агенту это...». Понимаете, к чему всё идёт? Зачем писать инструкции человеку, который обязательно накосячит, когда можно написать агенту. Подход прикольный ещё и тем, что нейросеть быстро ориентируется, даже если сервис поменял интерфейс.

Короче, раз с ЭЦП прокатило, мысль эволюционировала: я сделал скилл, который правильно заполняет заявление на загран, проверяет и подсказывает. Отправляете агенту инфу, которую он просит, и идёте пить чай.

Если паспорт реально получу — скилл опубликую.


Видео недоступно для предпросмотра
Смотреть в Telegram
Китайцы обновили самую популярную опенсорс-модель в мире

Судя по описанию, Квен понял своё предназначение, и теперь это идеальная модель для офисной работы. Умеет читать доки, PDF-ки, таблицы, анализировать, долго работать, достигать результатов.

В рекламных материалах, как обычно, говорится, что это убийца Fable 5, но этим нас уже не удивишь (спойлер: ещё ни одна модель в мире не подошла близко к Фейблу).

Почему это хорошая новость для нас? Да потому что скоро ваши Алисы, Маруси и прочие домашние ассистенты сильно поумнеют. Надеюсь, понимаете, по какой причине ))))))


А чё, вроде модельки становятся лучше в моушн-дизайне.

Попросил сделать анимацию с тезисами про GPT 5.6 и Fable 5, прикрепил единственный референс (девушка с буллетами) и получил HTML с анимацией в канвасе.

Да, есть косяки с перекрытием плашек друг другом, но всё решаемо. Получилось реализовать бесшовную процедурную анимацию с одного промпта.

Причём специализированные инструменты типа ReMotion и HyperFrames выдали результат на голову ниже. А ещё удивительно, что в модизе GPT шарит лучше Фейбла.


Видео недоступно для предпросмотра
Смотреть в Telegram
Seedance 2.5

Ой как хорошо щас было после просмотра. Трейлер просто целиком состоит из гвоздей, которыми заколачивают гробы всех видеогенераторов. 50 рефов на вход + жрёт мокапы и 3D-болванки. Последние два пункта и в предыдущей версии были, но раз это попало в трейлер — сообщение чёткое: Seedance зашёл на поле профессионального продакшна.

Я сегодня вдруг осознал, что китайцы №1 на рынке генерации видео (Kling, Seedance). Была американская Sora — приложение похоронили, модель раздают по API. Гугловский Omni силён в редактировании, но в генерации Сиденсу не соперник. Буду честен: альтернатив нет.

Итог: убили конкуренцию, взвинтили цены, красавчики.


Видео недоступно для предпросмотра
Смотреть в Telegram
Хиггсы — молодсы

Казахстанский стартап Higgsfield уникален — это один из первых агрегаторов нейросетей на планете, если не самый первый. Хиггсфилд мне напоминает диджея: ярко выглядит, играет чужие треки, но своих не сочиняет.

Чуваки нашли своё УТП в том, что создают комьюнити. У них на днях вышел просто офигеннейший раздел на сайте, где можно посмотреть, как делались проекты: промпты, параметры, модели, количество генераций, пайплайны. Это внатуре клад для тех, кто занимается AI-генерациями в рекламе и кино, потому что вы можете учиться у лучших и буквально видеть их исходники.

Тут и розовые очки послетают, что сгенерить ролик просто и дёшево. Часто на 1 простой шот отлетает по 30 перегенераций, а если ещё и в SeeDance — то снимать вживую могло бы выйти дешевле.

Короче, сейчас Higgsfield — это самая мощная тусовка на планете. А подписки у них хуйня — не было и месяца, чтобы не вскрывалась какая-то скам-схема.


Вот это я понимаю слаженная работа. Очень не хочу думать что нытье помогает достигать результатов, но спасибо, друзья!


#юзкейс как я сделал аудиокнигу из книги

Продолжаю пополнять копилку кейсов того, на что способны ИИ-агенты. Неделю назад купил электронные книги Линдси Гибсон (кто знает, тот знает, что за автор), но осознал, что читать разучился — подкасты меня испортили.

И тут я думаю: блин, а может можно из текста сделать аудиокнигу? Каждый раз в такой момент думаю: да ну неее, эту задачу точно заруинит. Но, забегая вперёд, скажу, что всё получилось, и я уже 10% книги прослушал.

Как всё было: я прихожу к Клоду, говорю, мол, родной, бля, ну сделай из книги аудиокнигу, я её честно купил, хочу для себя просто послушать. И Клод мне отвечает: да говно вопрос.

Он скачал локальную TTS (модель для озвучивания текста голосом), разбил всё на главы, подтянул обложку и предложил выложить на ютуб по закрытой ссылке, чтобы удобнее было слушать такой длинный файл. И всё.

Немного техинфы. Генерация 6 часов голоса заняла 4 минуты, модель Silero v5, голос Xenia. FFmpeg собирал финальный ролик 15 минут.

Этот пост — очередное напоминание себе: сначала дай попробовать сделать агенту, только потом решай сам.

672 0 13 15 21

С момента как родился мой сын я чуть подпропал, и от этого канала стали отписываться люди. Каждый день цифра уменьшается, и для меня, как для максималиста, это авиакатастрофа. Ещё в мае оставалось каких-то 5 подписчиков до круглой цифры 500, а теперь тг-канал показывает стабильный отрицательный рост, и я задаю сам себе вопрос: зачем всё это? Вообще этот вопрос полезно себе задавать каждый день, потому что ближе к 40 меньше всего хочется делать что-то бесполезное.

Один мой друг написал банальные, но очень важные слова: «Люди не отписываются, а отфильтровываются». Я не могу заставить всех любить то, что я делаю, но я могу делать то, что люблю. Два месяца от меня отписывались люди, я это видел, но канал не бросил. И сегодня увидел +2 новые подписки. Потому что я люблю то, чем я занимаюсь.

Расскажите про этот канал тем, кому он может быть полезен. Можно не делать сторисы-хуерисы, а просто в лс ссылку скиньте. Пусть сюда придут новые люди, увидят этот пиздострадальческий пост и всё сразу поймут 😂

606 0 0 13 36

Репост из: Миша Наер
Видео недоступно для предпросмотра
Смотреть в Telegram


MCP-серверы появляются у всё большего числа сервисов. Это интересный тренд, обязательно расскажу про него, как слова подберу.

Тестил коннектор Магнифика (это агрегатор нейросетей для генерации видео / картинок / звука и тп). Магнифик буквально говорит: «Чел, нахрен тебе заходить на наш сайт? Нажми 2 кнопки в своём Кодексе, Клоде или Гроке, и мы с агентом сделаем всю работу». В выигрыше все, сервису глобально без разницы, где вы жжёте свои токены — у них на сайте или у себя в агенте.

А вам MCP открывает возможность взаимодействовать с сервисом, не задумываясь, какие модели лучше генерируют фото, а какие видео. В моей задаче я просто попросил взять меня, сына и сделать сюжет на 15 секунд, где мы дерёмся. Это буквально весь мой промпт.

Дальше агент сам лезет в сервис, берёт нужные модели, генерирует сюжеты, проверяет на виузальные ошибки (приложил выше, агент отсеил эти варианты автоматически), создаёт видео и склеивает отдельные генерации между собой. Результат — хуйня, но и задачи сделать хорошо не было.

Помните, года 3 назад мечтали, что можно будет просто написать сюжет какого-то тупого рилса, и нейросеть всё сделает. Вот, сделала.


Claude Opus 5

Круче Фейбла, в 30 раз лучше в агентном кодинге, чем Opus 4.8 и GPT 5.6.

В твиттере еще позавчера слили тесты, там отвал кабины. По цене, как старый Опус.

Вау


Нейросеть сделала пончик в Блендере

Пару месяцев назад увидел такую новость, но не успел поделиться рефлексией, как реагировать на подобные инфоповоды.

А реагировать надо так: всем тридешникам пизда. Да, пока модель сделала простую задачу, которую осилит даже ребёнок. Но пончик — это таймер обратного отсчёта до момента, когда нейросеть будет эффективнее любого живого человека в этой области.

Мы проходили это в области генерации изображений и видео. Сейчас воспринимаются как данность возможности LLM в кодинге, психологии, анализе и ресёрчинге. Переводчики — официально первые, кто прикурил с факта, что их услуги стали менее востребованы. Вторыми в очередь встали иллюстраторы.

Как сейчас помню бойню на реддите: уж в индустрии ВИДЕО точно не стоит ждать переворота в ближайшей перспективе. Года не прошло, а Сиденс похоронил амбиции большинства съёмочных продакшнов на планете.

Если видите новость, что до вашей ниши добралась нейросеть — расчехляйте план Б.


#юзкейс в области моделирования

Работая много с ИИ-агентами, я забываю простую вещь: в сложных задачах можно сначала попросить нейросеть всё сделать, а если не получится — начать думать самому.

На выходных хотел напечатать на 3D-принтере крепление для видеоняни, которая имеет сложную (ну, относительно сложную) форму. Провозился во Fusion 360, искал подходы, очень хотелось, чтобы всё село плотненько. Но ничего не получилось. Знаний о твердотельном моделировании сложных тел мне не хватило.

И тут я подумал: так может попросить агента подсобить? Сфоткал три проекции с линейкой в кадре и кинул Клоду со словами: «Отец, выручай, сделай 3D-модель, которую я могу использовать как болванку для крепления».

Fable 5 без лишних слов не просто сделал модель, но ещё и сгенерил веб-вьювер для удобства оценки результата.

Итог вы видите. Крепление встало как влитое.

Этот пост — напоминание себе: сначала дай попробовать сделать агенту, только потом думай сам.

Показано 20 последних публикаций.