Кружок Пономаря


Гео и язык канала: Россия, Русский
Категория: Блоги


Медиаменеджер, предприниматель, digital эксперт и т.д. Кофаундер агентств «Палиндром», «Фейк» и HYG, старший партнер koven.io. Экс-издатель «Лайфхакера».

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Блоги
Статистика
Фильтр публикаций


Подписка на Claude оказалась в 5 раз выгоднее Codex

SemiAnalysis замерили, сколько токенов на самом деле дают AI-подписки. В пересчёте на стоимость того же объёма токенов через API подписка на Opus 5.5 оказалась примерно в пять раз выгоднее подписки на GPT-6.1 Sol при одинаковой цене тарифа.

Например, Claude Max за 200 долл. дает месячный объем использования, который по API обошёлся бы в 11 726 долларов. ChatGPT Pro за те же 200 баксов — всего 2084 доллара (при полном расходовании лимита и профиле агентской нагрузки из исследования).

Вообще рекомендую посмотреть первоисточник, там много классных графиков, очень подробно описана методология и уделено отдельное внимание китайским моделям (Minimax и GLM весьма щедро спонсируют свои подписки, а вот Kimi — не очень).

Отдельный вывод — наилучшие условия дают подписки «от производителей», у того же Cursor лимиты на модели OpenAI и Anthropic заметно хуже.

—
Пономарь


Наглядный пример кризиса серверных мощностей — один из моих хостинг-провайдеров начал «распродажу» VPS с объемами оперативки в 1.25 GB, 2.5 GB и т.д.

Такое нарезание памяти кусочками на моей памяти впервые. Ну и цены на все конфигурации выросли примерно в 1.5-2 раза. И это у одного из самых бюджетных хостеров.


Ровно 15 лет назад, 5 октября 2011 года, умер Стив Джобс. Ему было 56.

За день до этого Apple представила iPhone 4S с Siri. С тех пор сменилось столько поколений устройств, что тот телефон уже выглядит музейным экспонатом. Но сам Джобс при этом почему-то до сих пор не кажется человеком из далёкого технологического прошлого.




Решил дать большой комментарий Илье Карбышеву о непростой судьбе UGC-проектов на Руси на примере vc.ru, Лепрозория (настоящего), Хабра и Пикабу.

Все UGC-проекты, которые я знаю, можно довольно условно разделить на две категории: массовые и тематические, экспертные. И вот попытки совместить одно с другим обычно заканчиваются не очень хорошо.

Проблема тематических сообществ примерно всегда одна и та же. Никто не хочет ни за что платить, все постоянно чем-то недовольны, но при этом у аудитории очень быстро возникает ощущение, что платформа ей что-то должна.

В итоге любой такой проект рано или поздно оказывается перед выбором.

Либо мы остаёмся уютным местом для профессионалов или просто небольшим тематическим сообществом — и постепенно начинаем схлопываться.

Либо идём в массовость, расширяем тематику, привлекаем новую аудиторию, учимся на ней зарабатывать — но постепенно теряем ядро и ту самую уникальность, ради которой всё когда-то и затевалось.

Потому что на сообществах, к сожалению, вообще довольно сложно зарабатывать.


Полный текст — у Ильи в канале по ссылке, а сюда закину аудио-версию. Вдруг кому хочется послушать 5 минут моих рассуждений :)


Все чаще встречаю запрос на новую роль, которую можно назвать Automation Engineer. Это человек, который садится рядом с командой, разбирается, как у нее устроена работа, и автоматизирует то, на что раньше не хватало рук. Причем тенденция касается в том числе крупных компаний — все чаще инхаус-инженеров направляют в бизнес-юниты, чтобы построить связь между AI и реальными процессами.

Создать автоматизацию стало проще, но понять, что именно стоит автоматизировать, по-прежнему сложно. Условный запрос на доступ к сервису может одновременно касаться IT, HR, юристов и других юнитов — у каждого свои требования, часть правил нигде не записана, а согласование держится на человеке, который «всегда этим занимался». Нужно разобраться во всем этом, договориться с участниками и довести систему до состояния, в котором ей действительно пользуются.

С одной стороны, вокруг этого уже складывается востребованная специализация — нужны технические навыки, понимание AI и способность разобраться в чужой работе. Конечно, инженеры по автоматизации существовали и раньше, меняется прежде всего доступность и востребованность такой работы для отделов, у которых никогда не было «своего программиста».

Но все же с российским рынком у меня пока другое ощущение. Недавно мы в Палиндроме искали специалиста по автоматизации для собственных задач и нас буквально засыпали отклики — их было больше тысячи. Понятное дело, по одной вакансии вывод делать нельзя, число откликов не равно числу подходящих специалистов. На том, что предложение настолько опережает спрос, очевидно, сказываются и общее состояние рынка труда, и то, что компании все еще относительно медленно движутся в сторону тотальной автоматизации и внедрения ИИ. По крайней мере, медленнее, чем люди уходят в эту специальность.

Так что перспективность роли и легкость поиска работы в ней — пока две разные истории.

—
Пономарь


В соцсетях все чаще вспыхивают обсуждения на тему «люди уходят от гадалок, астрологов и таролочниц тарологов в чатгпт». С одной стороны, это немного забавно, с другой — всё же несколько печально, что раздел «Прочее» магазина плагинов к оному выглядит вот так:


Трамп велел американским ведомствам называть ИИ «суперинтеллектом» — SI и у домена Словении .si тут же попёрла новая аудитория — по данным TechCrunch, за одно 30 сентября зарегистрировано 11 тысяч адресов. При цене 12 долларов в год против 90 у .ai энтузиазм вполне объясним.


Карпаты(й) пишет, что мы будем тратить всё больше времени не на выполнение задачи, а на то, чтобы понять, что сделала нейронка.

Как человек, накануне перевозивший сервер на другой хостинг и не написавший ничего сложнее пары консольных команд, кажется, я уже там.

Андрей Батькович даёт интересный совет — для более понятного ответа попросите нейронку объяснить его по правилам ASD-STE100 — упрощённом техническом английском, который придумали для инструкций по обслуживанию самолётов. Стандарт довольно жёсткий, поэтому Карпаты(й) иногда просит следовать ему «процентов на 80». А если текста всё равно много, можно попросить оформить ответ как интерактивную HTML-страницу или даже короткое объясняющее видео (все уже в курсе, как хорош новый Опус собирает видео). Последнее, впрочем, пока скорее экспериментальная опция.

Мне тут интересен сдвиг в привычке. Мы привыкли продираться через сложные ответы сами — или игнорировать их. И то, и другое может приводить к неприятным последствиям. Теперь же можно получить ответ в любой, максимально понятной и проверяемой форме.

Да, эта HTML может прожить минут десять и отправиться в корзину, но если она помогла заметить ошибку или принесла важный инсайт, свое она отработала.

—
Пономарь

412 0 12 1 15

Как известно, люди делятся на 2 типа — те, кто не делает бэкапы, и те, кто уже делает.

Нескольких моих товарищей забанили в Claude. Судя по сообщениям в разных источниках, волна масштабная, и это повод настроить бэкапы вполне реальный. ChatGPT лучше тоже на всякий случай.

Для переписок на claude.ai можно запросить штатный архив через Settings — Privacy — Export data. Ссылка приходит на почту и живет 24 часа. Важные файлы проектов, скиллы и артефакты я бы сохранил отдельно — этот архив нельзя импортировать в другой личный аккаунт.

С Claude Code другая история. Его сессии лежат на компьютере, и я отобрал пока что несколько инструментов под разные задачи:

— Claude-Session-Backup сохраняет в Git исходные транскрипты, работу субагентов и результаты инструментов. Бэкап запускается через hooks и планировщик; удалённую локальную сессию можно вернуть командой csb restore, а затем продолжить через csb resume. Если нужно именно восстановление сессии, это выглядит как подходящий выбор.

— SessionVault пригодится, если агентов и компьютеров несколько. Он отправляет новые и изменённые файлы истории в Cloudflare R2 или локальное хранилище. Шифрование есть, но по умолчанию выключено — перед отправкой переписок в облако его стоит включить.

— claude-vault складывает разговоры в SQLite и помогает найти старое решение. Может импортировать историю перед сжатием контекста и при завершении сессии, выгружает Markdown, JSON и текст. Но результаты инструментов и служебные сообщения он отфильтровывает и для полноценного восстановления сессии такой архив не годится.

Конечно, таких утилит гораздо больше, так что можете заняться их поиском и проверкой на досуге. В любом случае, чтобы продолжить работу с этими даными, доступ к Claude всё равно понадобится.

Поставлю себе напоминалку делать и проверять бэкап раз в квартал.

—
Пономарь

504 0 22 7 13

Еще один способ интересно провести вечер — отправить клоду команду claude-api prompt-audit на всех проектах.

Это аудит текстов, которые читает модель — системных промптов и кода, который их собирает, описаний инструментов, скиллов и файлов инструкций агентам (CLAUDE.md, AGENTS.md, правила, команды).

Он ищет устаревшие приёмы промптинга, например,
усиление капсом (CRITICAL, MUST), «думай пошагово», обвязки, которые давно есть в API («отвечай строго JSON») и обходные пути под старые модели.

Заодно поможет исправить несуществующие пути и команды, противоречащие друг другу файлы, огрехи в описаниях и промптах.

На выходе получите отчет, который может увлечь вас в «волшебный» мир фиксов и рефакторинга на полночи 🙂

—
Пономарь

372 0 7 14 11

Google в рамках очередного бесчеловечного эксперимента начал приплачивать паблишерам за вклад в ответы AI Overviews, AI Mode и Gemini. По данным The Information, в программе участвуют около сотни сайтов. Для нескольких небольших и средних участников выплаты составляют... менее 0,1% их общей рекламной выручки.

Деньги начисляют, только если материал существенно повлиял на генерацию ответа. Если Google просто дал на него ссылку или сверил по нему факт после генерации, это не считается. В Search Console паблишер видит месячную сумму, но не методику расчёта. Некоторые участники говорят, что выплаты меняются от месяца к месяцу без каких-то объяснений.

Разброс при этом большой. Один участник получил 50–60 тысяч долларов за несколько месяцев, другой получает больше миллиона в год. Небольшим сайтам за несколько месяцев и вовсе перепало меньше тысячи. Так что 0,1% — даже не фиксированный тариф, а результат части участников программы.

Если раньше паблишер хотя бы мог посчитать переходы из Google и прикинуть экономику исходя из этого, то теперь Google сам решает, когда и как материал повлиял на ответ и сколько за это заплатить. Разумеется, не очень щедро.

—
Пономарь


Самая дорогая ошибка в работе с AI-агентом — когда он долго и идеально решает не ту задачу.

Например, просите сделать сравнительную таблицу сервисов, агент рисует сравнение тарифов, а вам нужно было узнать, как реализована та или иная функция. Чем дольше нейронка работает самостоятельно, тем дороже подобная ошибка в целеполагании.

Простейший способ снизить риск перед большой задачей — дописать в конце промта:

Перескажи своими словами, чего я хочу добиться и какую проблему пытаюсь решить. Пока ничего не делай.


Так можно поправить задачу еще до первого прогона. Если агент понял верно — потратили минуту и отпустили работать.

—
Пономарь

414 0 14 10 22

OpenAI только что показала на DevDay кучу новинок. Мне интереснее всего не очередная модель (Sol 6.1 выглядит натужным ответом вчерашнему релизу Sonnet 5.5), а попытка превратить ChatGPT в место, где ты работаешь вместе с агентом, а не просто задаёшь ему вопросы.

Новый агент Dot живет в облаке и может работать, например, после того как вы закрыли крышку ноутбука. В комплекте стандартный openclaw-style набор коннекторов к почте, Slack, календарю и прочему.

Еще меня очень заинтересовал Space — общее место для файлов с редакторами документов, таблиц и презентаций. Я глянул на одном из аккаунтов — мне понравилось, очень похоже на Notion. Агента можно позвать прямо в комментарии к документу, чтобы он поправил его на месте, без прыжков из редактора в чат и обратно.

Сильно завидую чувакам из Every — им как всегда дали доступ на несколько дней раньше и они уже протестировали Dot. Пишут, что моментально привыкли обращаться к нему вместо нового чата, но рекомендовать пока не готовы — агент оказался местами туповат, терял сообщения, путался с разрешениями и не всегда подключался к браузеру.

Хороший сентябрь для ИИ-энтузиастов получился, много всего классного выдали.

—
Пономарь


Arena — платформа, где пользователи сравнивают ответы ИИ-моделей и голосуют за лучшие, — сопоставила ответы Claude Opus 5.5 с прошлой версией, Opus 5.

Новая модель пишет на 95% меньше длинных тире и на 73% меньше точек с запятой, реже хвалит пользователя и себя за вопрос, и предложения стали короче — в среднем 10 слов вместо 12. Зато длина ответа в целом выросла, а оговорок вроде perhaps и arguably стало почти вдвое больше.

Вообще по длине ответов и частоте знаков препинания не стоит судить, стал ли текст лучше, ведь дополнительные слова могут давать полезные детали. И тире само по себе ни в чём не виновато — я, например, его тоже очень люблю. Но тенденция хорошая.

—
Пономарь


У меня есть папка ai-hub, которую я использую как песочницу для очень разных экспериментов с текстами, кодом, инфрой и т.д. Там собралось много разного — планы проектов и постов, наборы инструкций и документация, плюс некая общая память и уроки из работы с агентом.

Постепенно я начал замечать несколько противоречивое поведение агентов в разных сессиях на одной задаче. Я полез в инструкции и обнаружил, что многое потеряло актуальность или вовсе местами противоречит само себе, при этом агент пытается совместить всё это.

Решил провести ревизию и дал такой промпт:
Проверь инструкции и примеры в ai-hub. Найди повторяющиеся, противоречащие друг другу и устаревшие правила. Для каждого случая укажи конкретные файлы и приведи короткие цитаты. Предложи, что оставить, что переписать, а что убрать в архив. Ничего не меняй в файлах, пока я не одобрю план.


Итоговый отчет от Клода выглядел так — «исправил 24 файла, удалил 8, плюс 147 строк, минус 384». Мелочь, а приятно 🙂 Короче, для проектов с knowledge work рекомендую такую уборку как регулярную практику.

—
Пономарь


Небольшая игра для тренировки насмотренности, которая предлагает вам в течение минуты отличить реальные фото от нейрослопа.

У меня после ряда попыток наилучший результат стал достигаться, когда я стал меньше доверять рациональным аргументам и доверился чутью.

Но стопроцентного попадания за минуту не случилось ни разу 😔

—
Пономарь


Лучшая новость дня, недели, месяца — новый вид кошек. Видели? Они офигенные.


Anthropic добавила в Claude Code поддержку AGENTS md — инструкции для Claude Code и Codex становятся едиными без лишних танцев.

Если в проекте нет файла CLAUDE md, агент будет искать и подхватывать AGENTS md (включая вложенные файлы по дереву каталогов). В /config можно включить и режим, где читаются оба формата. Небольшое изменение, но практическое — одни инструкции теперь можно использовать хотя бы в Codex и Claude Code, не разводя в репозитории два почти одинаковых файла.

И хотя Anthropic признала общий формат инструкций, CLAUDE md пока сохраняет приоритет. Но у меня, например, все содержимое инструкций для всех агентов сводится к ссылке на AGENTS md, так что как только до меня доедет версия 2.1.277 я снесу CLAUDE.md из всех репозиториев 🙂

—
Пономарь


Интересный индекс строит Ramp — американский финтех для управления корпоративными расходами (карты, оплата счетов и учёт трат).

Ramp видит реальные транзакции клиентов и на их основе ежемесячно собирает свой AI Index. Он показывает, какая доля компаний хотя бы раз за месяц заплатила за AI-сервис.

На графике общая доля платящих за ИИ компаний бодро лезет вверх. Anthropic в этом году совершила неожиданно могучий рывок и обошла OpenAI. Даже xAI с Grok показывает бодрую динамику, а после покупки Cursor наверняка полезет ещё выше.

С Google страннее. Возможно, так как Gemini давно входит в подписку Workspace, отдельного платежа за нейронку просто нет. Это объясняет часть картины, но кардиограмма пациента всё равно выглядит подозрительно ровной. В топ-10 платежей за API сплошь модели «большой двойки». Может быть, корпоративному миру Google AI и правда не особенно интересен.

Бесплатные инструменты и работа через личные аккаунты сюда не попадают, поэтому реальное внедрение, скорее всего, выше. Но даже с учетом этого — если на самом горячем рынке adoption едва перевалил за половину, какой же запас роста у остального мира.

—
Пономарь

Показано 20 последних публикаций.