Пресидский залив


Гео и язык канала: Россия, Русский
Категория: Технологии


Pre-seed'ский, не персидский! Я Надя Зуева DL engineer, который хочет стать акулой бизнеса. Рассказываю про успехи и фейлы 🦈
вместе с @mnk_stories строим Aesty (Antler Portfolio)
@im_moonko - сотрудничество, платные консультации

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


мы выложили запись в коментах!


когда клод не работает больше 30 минут пора объявлять национальный выходной?


Как заставить зумера со спаном внимания 8 секунд пройти онбординг из 15 экранов? 🤨

кмооооон да никак 😳

В 2026м году медианный completion rate онбордингов по приложениям всего 50%. 50, КАРЛ

Посмотрите сессии своих пользователей - едва ли они вдумчиво отвечают на каждый вопрос, наверняка большинство кто доходит до конца пролетает онбординг на автопилоте, не читая ни одного экрана и это уже стандарт индустрии, спасибо тик току и другим платформам шорт контента за клиповое мышление у целого поколения 😂
Ну а чего, представьте показывать восьмилетнему ребенку вместо мгновенной выгоды слайды, которые можно пролистнуть не читая

Новые проблемы как обычно требуют новых решений и мне кажется мой друг @eduardbaksheev (Эдик кстати нам оч помогает с дизайном aesty!) придумал интересное решение для своей прилы peri ai (вопросы по женскому здоровью), у него онбординг это чат с персонализированными вопросами и голосовым вводом 🍿

Прокликать такое невозможно - следующий вопрос не появится пока не ответишь, и каждый ответ меняет сценарий. Через минуту апп знает обо мне больше чем классический онбординг узнал бы за 15 экранов и мне лично отвечать было интереснее, чем заполнять форму, так как я получала какой-то отклик после каждого вопроса (но справедливости ради зумер я по нижней границе 😧)

Мне стало интересно, где еще это есть и я нашла парочку примеров (ну как я, клод нашел, а я командовала, все как обычно) Airtable собирает воркспейс из разговора с AI, Clay генерит первый воркфлоу из ответов welcome survey, Pi и Replika знакомятся с тобой как человек, ну и конечно Duolingo вообще ставит урок до регистрации, так что думаю это вполне можно считать новым трендом - персонализированный чат вместо формы ответов на онбординге 🐵

Ну и вишенка на торте - если продукт сам по себе чат, значит онбординг это уже первое использование продукта. Наталкивает на мысли что надо пробовать у себя, мы сейчас как раз первую сессию переделываем - показать функционал и объяснить, что не надо все вещи фоткать отдельно скорее всего будет очень удобно, как будут цифры - поделюсь

Ставлю на то что через год чат-онбординг будет у половины consumer аппов, скриньте 😅

@neural_prosecco


всем спасибо за стрим! было круто 💗
запись - в коментах!

канал Андрея - @mnk_stories




через час проведем стрим! ссылка появится за 5 минут


в коментах просили накидать еще каналы, которые я читаю. Скажу честно, что не прям каждый пост, но вот те, за которыми наблюдаю и кого сходу вспомнила 💗
и да, тут много моих друзей, куда уж без этого 😂

эйай/tech
@boris_again
@dealerAI
@neuraldeep
@senior_augur
@kantor_ai
@seeallochnaya
@grokaem_seby
@lovedeathtransformers
@denissexy
@ai_newz

прикладной ai/marketing/growth
@golden_nuggets
@ilya_krasinsky
@marketlead_me
@o_product
@sexyllm
@apple_developer_news
@veravtech
@solokumi

венчур/стартапы/лайфстайл проекты
@burninganna
@tldr_tany
@okhlopkov
@bogdanisssimo
@denisovaanastasia24
@eduardbaksheev
@svstartups
@startups_not_scary
@doraakulshina
@vsevolodustinovchannel


глянула вопросы - там явно выделяются несколько тем. Дисклеймер - не претендую что я знаю все-все, будем делиться своим опытом и мнением по этим вопросам


а докажи что ты не эйай 😠

На самом деле ситуация забавная и стремная одновременно. Окей, допустим, я запишу кружочек в доказательство того, что я реальный человек - и сейчас в 2026м году еще можно наметанным глазом отличить генерацию от реального видео. А что будет в 2028м?

Сегодня на KYC часто используются digital сервисы которые делают верификацию по паспорту и видео - просят покрутить головой, улыбнуться и сфоткать документ. Это частично обходится уже сейчас - атака подменяет видеопоток на уровне виртуальной камеры или сдк. Такие атаки выросли за год в 30 раз, и уже существуют теневые injection-as-a-service, по сути подписки на обход KYC 🔪

Пожалуй, самый яркий прецедент это история, как сотрудник перевел мошенникам почти 30 миллионов долларов после видеозвонка, где ВСЕ его коллеги были СГЕНЕРИРОВАНЫ. Я бы потом словила птср 😑

Про то, что AI контент будет помечаться мы говорили пару постов назад, но сегодня эти метки все еще часто можно убрать небольшими аугментациями. Да и речь не только про контент, а про саму личность, что глобальнее 🍿

Так что проверить через какой-либо потенциально генерируемый контент (голос, видео, капча) человек ты или нет становится все сложнее. То, что нас отличает - что-то физическое, привязанное к нашей личности - например, радужка глаза, отпечаток пальца, чип в паспорте, secure enclave телефона - и дальше носишь с собой криптографический пруф, который нельзя сгенерировать (или нельзя в обозримом будущем, про истории продажи своих личностей мы пока не говорим, но это точно будет иметь место). Кстати, оказалось что zoom уже тестирует бейдж "верифицированный человек", как это было например со знаменитостями в инсте

Теперь вопрос про дистрибьюшен и то, как эти пруфы получить.
Мне вспомнилось, что на Бали, чтобы заплатить за электричество, нужно прийти в любой продуктовый у дома - платежная точка встроена в магазин. Ну или помните автоматы для пополнения счета на телефоне, которые стояли повсюду. А еще как вариант чтобы несколько других верифицированных людей поручились, что ты тоже человек, в общем набрейнстормить идей можно много 🤔

Вот вам сетап для нового киберпанка - зашел в пятерочку за хлебом, посмотрел в сканер у кассы, вышел с кодом верификации для соцсетей 🤨

Вариантов много и у всех свои плюсы и минусы. Самое время делать KYC стартапы? 🤑

@neural_prosecco

1.5k 0 13 16 32

кажется шутка в коментах немного вышла из-под контроля 😳

ребят я не эйай аватар у нас трансляция вообще-то в воскресенье 23го августа в 12:30 по Москве

а пока можете поискать метку ai gen на моем селфи 😆


как выглядят вотермарки в ai gen контенте в 2026м году 🤔


Что картинки и видео включают в себя лейблы давно не новость. На прошлой неделе антропик (разработчик клода) включили невидимые вотермарки в текстах, а в начале августа suno анонсировали то же самое для музыки. Давайте разберемся как это работает и какие комментарии дают крупные игроки на этот счет. Итак, какие бывают вотермарки:


1️⃣ метаданные (они же c2pa) - подписанный паспорт внутри файла: чем сделано, когда, что редактировали. Проверить может кто угодно, ключи не нужны. Довольно ненадежная история, так как нет защиты от скриншота и слетает при сжатии в соцсетях 🧠


2️⃣невидимая метка в самом сигнале (например synthid от гугла) - находится в пикселях, звуке или выборе слов. В пикселях кстати ее довольно быстро нашли умельцы из твиттера. Скриншоты и сжатие переживает, но все что можно узнать - только сгенерировано или нет. Какой моделью, когда - эта информация не хранится. Кстати, в мае 2026го года таких файлов было уже больше 100 миллиардов 😮



Ожидаемый вопрос, а как это работает в текстах? 😂

Если у вас была версия, то скорее всего она правильная, потому что это вроде как единственный разумный вариант. Когда модель выбирает между равноценными словами, например "интересно" или "любопытно", выбор делается не случайно, а по криптографическому ключу. На смысл это не особо влияет, но статистика выборов становится узнаваемой. Ожидаемо это плохо работает на документах и коде, где нет творческой вариативности, но справедливости ради, как по мне так писать руками код в 2026м году это уже какое-то извращение 😠 По словам авторов, небольшие правки метку не убирают, а вот переписанный своими словами текст целиком - вполне


зачем это все? 🐵

Увы, не из любви к человечеству и гневным коментаторам в тик токе, которых достал эйай. Антропик в июле подписали европейский кодекс по маркировке ии-контента, это новое требование ai act, которое кстати уже вступило в силу, а suno анонсировали вотермарки на фоне исков от universal и sony. Все упирается в авторские права и правовую плоскость


Надя, а ты сама писала этот пост или ...? Щас проверим 😅

Ну почти, антропик анонсировал api проверки эйай/не эйай для сторонних разработчиков, но он еще не запущен, даты нет, в справке так и написано "детали будут в будущей документации". Как по мне это юридическая отмазка и точно не приоритет (пока)

Кстати, youtube и X уже автоматически лейблят видео, читая и c2pa и synthid, причем независимо от того раскрыл автор или нет, частично замечала автометку на pinterest. Но в большинстве случаев раскрытие AI пока остается ручным. Текст платформы не проверяют - только картинки, видео и звук. Могут проверять массовость реплаев и искать агентов, которые ведут соц сети за вас (так недавно снесли 40 тыс аккаунтов в твиттере) 🎧

Есть ли официальные комментарии про охваты?

Youtube при запуске отдельно сказали, что помеченные видео не режутся в рекомендациях и не теряют монетизацию. Но сам факт, что платформа теперь умеет отличать одно от другого автоматически и без вашего участия - это рычаг, которого раньше просто не было. Да и у части продуктов большие репутационные риски за использование ai контента, тот же гуччи с ai-визуалами к неделе моды в Милане, которых разнесли за "дешево и лениво". А aerie сделали ровно наоборот, выкатили кампанию с памелой андерсон и слоганом "you can't prompt this" и получили +23% к продажам в квартале.

Это конечно не значит что эйай контент нельзя использовать, можно и нужно, но стоит изучать отношение вашей аудитории к этой теме, даже если платформы не урежут охваты 🤑

@neural_prosecco

2k 1 19 23 40

сегодня хочу поделиться каналом @budnipilot который я люблю читать. Пожалуй это единственный ресурс в тг, не связанный со стартапами/ml, среди тех что я регулярно читаю... и он про самолеты 🤔
В детстве я обожала смотреть "расследование авиакатастроф" от national geographic плюс мои родители авиационные инженеры и мой папа по шуму двигателя умеет определять, что за самолет летит. Кстати, я его пару лет назад проверила через флайрадар - он и правда угадал 3 из 4 😧

Это не реклама и не интеграция, мы не знакомы с автором. Мне просто хочется поддержать крутейший канал про авиацию и самолеты, который ведет настоящий пилот с разборами разных кейсов из авиации и обсуждением новостей. Мой папа конечно же тоже на него подписался уже 😎


Финальный анонс трансляции 😎

🤯 переносим на неделю вперед - 12:30 МСК 23 августа

ссылка появится за 5 минут, поговорим в свободном формате, вопросы/темы можно накидывать в коменты или в форму


что такое build in public тренд в 2026м году 😎


build in public - это когда кто-то делает продукт открыто, то есть частично делится метриками и решениями в реальном времени. Началось это с инди-хакеров типа Питера Левелса aka levelsio (он кстати еще ангелом в cursor заходил) в середине 2010х, сейчас это уже мейнстрим - половина стартап-твиттера живет и растит аудиторию именно так

зачем это нужно? 🤔

Аудитория b-i-p - это почти всегда другие фаундеры и технари, а не твои пользователи, поэтому b-i-p это в первую очередь канал дистрибуции для личного бренда фаундера, а не реклама продукта.
Ну и свежий тренд - показывать метрики и решения, нишу, но продукт явно не называть.
AI клон рабочего продукта собирается за недели (а то и быстрее), и по сути конкурентам отдается не только идея, но и валидация: вот ниша, вот работающий пейволл, вот юнит-экономика - копируйте не гипотезу, а проверенный ответ. Правда, цифры без продукта непроверяемы и часть таких аккаунтов это просто сторителлинг с нарисованным мрр, и наверняка читатели это понимают. Есть даже проекты которые проверяют метрики из revenue cat и дают "сертификацию" что метрика реальная 🐵

как по мне, прятать проект имеет смысл только в трех случаях, и кстати ни один не мой

1. сомнительная аппка - около скам в духе упражнений чтобы стать выше, лукмаксинг, похудей за 7 дней, шадоу-механики - про такое обычно не пишут, но вот метрики там красивые. Есть прецеденты, когда человек становился слишком публичным и привлекал внимание ревьюеров к приложению и оно улетало в бан

2. аудитория b-i-p не пересекается с ЦА и зашумляет аналитику на старте. У нас половина платящих - парни, часто технари, которые хотят выглядеть стильно. Я регулярно нахожу супер-юзеров прямо из своего твиттера и для меня лично это тоже канал привлечения, пусть и не самый большой

3. бесплатная валидация новой ниши для клонов. Я видела минимум 6 наших копий в апсторе, скриншоты и креативы прям с нашими креаторами воруют регулярно, один раз даже вместе с моим лицом (видимо, решили, что я сгенерированная 😧) но все эти клоны появились не из моих твитов, а просто потому что аппка есть в сторе, реклама есть в инсте/тик токе, скрытый b-i-p от этого не спасает

продукт с тех стеком уже пару лет как не конкурентное преимущество, дистрибьюшен уже тоже скоро им не будет, а вот личный бренд фаундера и комьюнити вокруг приложения быстро не скопировать - поэтому я думаю, что когда основатель публично пишет про свой продукт это всегда в плюс. Ну и совсем все детали вам рассказывать не обязательно - достаточно пары метрик которые вы выбираете сами, причем они не должны всегда расти, ведь интересно как вы справляетесь (или не справляетесь) с трудностями 😂

@neural_prosecco


меня приняли в original content rewards в X! 🐵

это новая монетизация вместо revenue sharing, которую запустили на прошлой неделе. Старую закрывают 7 сентября - ранее надо было набрать в сумме 5М органических просмотров за последние 3 месяца (в мае я кстати набрала 4.8M и почти прошла 🎧), теперь правила и строже, и лояльнее одновременно. Для меня лично - лояльнее, так как я теперь прохожу 🤣

В новой системе платят только за оригинальный контент и только за просмотры от premium юзеров (с подпиской) в главной ленте. Реплаи, репосты и накрутки не считаются

Чтобы подать заявку, нужно 500 фоловеров с подпиской на X и 500к показов таким пользователям за 90 дней. Проверить проходите ли вы можно в creator studio. Формально порог ниже старых 5 миллионов, но теперь учитываются только те, кто верифицирован подпиской

Похоже, что мой build in public формат идеально лег под критерии, и в целом есть тренд, что из-за увеличения количества контента платформы разворачиваются от engagement bait к оригинальности и это круто. Расскажу, сколько получу 28 августа (дата первой выплаты), может ничего не получу, явно не раскрывают как это работает 😐

Жаль, что в телеграме такого нет, мне кажется что тут это еще актуальнее, ведь твиттер все равно про более короткий контент


научила называется 😳 (автопредложение от клода)


научила называется 😳


Seedance 2.0 vs Seedance 2.5

вчера вышла новая версия и без того топ-1 модели по генерации видео от китайского ByteDance (владеют тик током)

для теста дала обеим моделям сложный промпт - показать экран приложения как бы случайно, но так, чтобы зритель успел его считать, плюс посмотреть как модели будут работать с геометрией, и вот что заметила

1) у 2.5 все значительно лучше со звуком и "пластиковостью" картинки
2) тест на логику и геометрию в кадре (а именно что скринщот надо было перевернуть или не писать aesty на задней панели телефона) обе модели провалили

впрочем, за 3-4 итерации можно было бы уже прям супер годноту сделать (явно прописать положение руки, дать перевернутую картинку как реф и тд). В общем выглядит многообещающе

кстати, еще важная оговорка, что fal ai который я раньше использовала как провайдера API для моделей пережестили с фильтрами и режут довольно безобидные промпты своими safety filters, поэтому я сейчас перешла на kie ai. Не реклама, мне этот переход значительно упростил жизнь

@neural_prosecco


9:00 - радуюсь, что нашла нативный mcp от meta ads 🐵

9:05 - понимаю, что у меня там доступны только статичные креативы, а видео через него заливать нельзя - еще не на всех раскатили 😐


умеют ли ллм слушать аудиодорожки? 🎧

я, конечно, не просто распознавание речи в текст, но и про то как разбирать интонации и разные акустические события

С видео все давно понятно - почти любая модель режет его на кадры с требуемой частотой кадров и разбирает как картинки. Со звуком - большинство агентов запускают скил на распознавание речи, но есть и исключения, где анализ более объемный


классический пайплайн выглядит так: перевести в текст - ллм анализирует вход и выдает текст - текст генерируется в речь, то есть модель получает расшифровку, а не звук, так работает например voice mode у клода. Быстро и дешево, но по дороге теряется тон, ирония, эмоции, кто говорит, неречевые события 😳


Впрочем есть и нативные аудио-модели, у которых звук подается прямо в контекст как токены, наравне с текстом. Технически это делается двумя способами: либо аудио-энкодер переводит сырой звук или спектрограмму в эмбеддинги, либо нейрокодек сжимает звук в дискретные токены - и во втором случае модель умеет не только слушать, но и говорить сама, без стороннего синтеза речи. Проще говоря, для одних ллмок для работы со звуком нужны внешние тулы (будь то простое распознавание речи или комплексный анализ эмоций и тональностей), а другие при обучении видели не только картинки и текст, но и аудио (а точнее все вместе), а это значит, что умеют с ним работать 🤑

вот пара примеров таких моделей:

• Gemini - самый универсальный вариант, разбирает музыку и не-речевые звуки (жанр, эмоция трека, шумы на фоне), различает спикеров, понимает таймстемпы. Правда, пока не настолько хорошо, чтобы стабильно разобрать любой трек на аккорды

• OpenAI - в июле выкатили апдейт, где модель слушает и говорит одновременно, поддакивает «mhmm» и перебивается как живой человек и умеет понимать простые речевые события и интонации

• Qwen3-Omni - лучший опенсорс по результатам замеров на бенчмарках - анализ музыки по стилю и ритму, 19 языков. И единственная модель, которую я все еще не попробовала в контексте музыки и звука 🤨


Предполагаю, что это активно используется в ai кол-центрах (например анализ эмоций клиента), вся работа с генерацией музыки, разметка звуковых событий, и из менее очевидного что мне запомнилось - мониторинг различных инструментов на предмет поломок на заводе (например станков) или даже подсчет птиц в лесу.


"Зачем я прочитал этот пост, если я не работаю в аудио стартапе" - могли подумать вы 😑 Мое личное предположение - использовать для поиска и генерации трендовой музыки в маркетинге, как сейчас многие уже делают с видео креативами. Ну и просто потому что 7 лет моего опыта в аудио процессинге никуда не делись и мне все равно интересно поглядывать, что там происходит 🐵

@neural_prosecco

Показано 20 последних публикаций.