Мысли HinkoKа


Гео и язык канала: Россия, Русский
Категория: Криптовалюты


Мой блог, AI, самосовершенствование и ещё много всего интересного!
Писать по сотрудничеству:
@h1nkok

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Криптовалюты
Статистика
Фильтр публикаций


Скиллы в Claude теперь нужно создавать по-другому

Если вы создавали ваши скиллы на прошлых моделя, старых опусах, fable 5 и тд, то с тех пор произошел большой прогресс моделей и они стали умнее.

Соответственно и скиллы теперь нужно создавать под новые модели чуть иначе. В новом видео я рассказываю про правила создания скиллов для новых моделей, и так же бесплатно даю скилл, который проаудирует ваши скиллы и предложит их улучшения, чтобы они лучше работали под последнего Opus 5.5 и Sonnet 5.5.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забывайте ставить лайк и писать комменты под видео, каждая ваша реакция толкает алгоритмы и даёт мне мотивацию


Видео недоступно для предпросмотра
Смотреть в Telegram


В Claude Code завезли моды

1 октября вышла новая версия Claude Code и теперь его можно моддить, как игру. Мод - это маленький JS/TS-файл внутри плагина, который видит всё, что происходит в сессии.

Он может перехватить команду, поменять поведение или нарисовать интерфейс прямо в терминале или в десктопном приложении. Код писать не обязательно, достаточно описать Claude, что хотите, разрешить hot reload, и мод появится в этом же чате.

В общем, они решили взять эту приколюху у Deepseek Harness.

Пример из официального гайда - Token Weather. Над полем ввода висит «прогноз погоды» для контекста и показывает насколько заполняется контекст в чате после каждого запроса. Мелочь, но зато наглядно.

А вот небольшая подборка готовых модов:

➡️ Blast Radius - ловит rm -rf, git reset --hard, force push и миграции баз данных. Показывает, что именно удалит команда, и ждёт, пока вы нажмёте Proceed или Cancel

➡️ Next steps - после каждого ответа предлагает до трёх следующих очевидных шагов. Этот мод сделал инженер из команды Claude Code, ставится в две строчки и он будет полезен новичкам, которые могут теряться, что попросить сделать Claude дальше. В команде установки вместо пишите next-steps

➡️ cctop - диспетчер задач для Claude Code. Пишете /cctop, и сбоку открывается панель, где видно всё сразу: насколько забит контекст, сколько токенов и денег ушло, сколько осталось до лимитов, какие инструменты тормозят и какие субагенты сейчас работают

➡️ quota-meter - мод для тех, кому не нужна целая панель из примера выше. Показывает 5-часовой и недельный лимиты подписки строкой в интерфейсе

➡️ aside - боковой чат, где можно спросить что-то про текущую сессию и не сбить основной диалог

➡️ secret-redactor - подменяет API-ключи, почты и IP на заглушки до того, как их увидит модель, и возвращает настоящие значения, когда дело доходит до запуска команды

➡️ Replay Theater - после ответа показывает все изменения в файлах по шагам, как слайды: что было и что стало. Удобно проверить, что Claude там наделал

И вот парочка забавных модов, которые не дадут вам скучать во время работы:

➡️ cc-arcade - девять игр над промптом, пока Claude думает. Игра встаёт на паузу, когда он закончил, а ещё там есть питомец, которого кормят тесты и коммиты

➡️ cc-pokedex - над промптом появляются дикие существа в зависимости от того, о чём вы пишете: вода, огонь, баги, и их можно ловить

Ну и кто-то уже запустил Doom в спиннере Claude Code, куда ж без этого 😁

А теперь про минусы: Мод работает с тем же доступом к компьютеру, что и сам Claude Code. Большинство комьюнити-модов - это свежие репы с парой десятков звёзд. Перед установкой закиньте репу Claude и попросите проверить, что мод читает и куда отправляет данные. Плюс API пока сырое и может меняться от версии к версии.

Больше модов: claude. dev/mods и mods. aidojo.si


Безопасность агентов и Super Intelligence

Летом агенты OpenAI на внутренних тестах вылезли из песочницы, нашли в сети утёкшие ключи Hugging Face и пошли по их серверам. Они запускали код на десятках машин, а на одной получили root. Потом выяснилось, что агенты ещё пытались залезть на сайты госагентств США. И это проблема не одной OpenAI: на тестах британского AISI 17 из 19 несанкционированных действий совершил агент Anthropic.

Как на это ответили в правительстве США? Сначала Трамп указом переименовал AI в "Super Intelligence". Потом создал Super Intelligence Force во главе с директором нацразведки Джеем Клейтоном. Их задача - реагировать на угрозы, но без чрезмерного зарегулирования. А главный риск, по словам Клейтона "не быть первыми в AI гонке с Китаем"

И как по мне он прав. Китай не остановится, это вопрос национальной безопасности, значит гонку никто тормозить не будет. Агенты будут становиться мощнее, доступов у них будет больше, а надежда, что кто-то это сможет контролировать и прикрыть, прям слабая.

Я каждый день работаю с агентами и всё чаще думаю, сколько информации им вообще стоит давать.

Интересный ответ показал Виталик Бутерин. Он хотел получить советы по питанию и спорту на основе своих данных о здоровье и поездках, но так, чтобы фронтир-модели ничего о нём не узнали. Он сделал схему в три слоя:

🟢 локальная Qwen 3.8 Flash Next сама пишет запросы к большим моделям, чтобы не утекли личные данные
🟢 оплата через zkAPI, чтобы не светиться платежом
🟢 трафик через Tor, чтобы не светить IP

Всё заработало, но не без минусов. Tor, по оценке Виталика сильно тормозит. Локальная моделька выдаёт 20-30 токенов в секунду, а комфортно станет только от 100+. А главное, чем меньше данных отдаёте модели, тем меньше она может помочь.

Для обычного пользователя это пока гемор. Но сам принцип минимального доступа можно применять уже сейчас. Заведите для агента отдельные аккаунты, держите его в песочнице. Это не гарантия безопасности конечно, но лучше чем ничего.

Я так и сделал и выделил целый Mac Mini на моих агентов, создал отдельные аккаунты для них: тг, почту. Но как Виталик я конечно запариваться пока не планирую)


Новое видео на канале: Hermes + Jev

Многие просили в комментах показать как их использовать вместе, и я заснял видео, в котором рассказал про 4 способа юзать связку Hermes и Jev и так же, сделал гайд, в котором сказал как их подключить друг к другу.

Создал роутинг моделей кстати, о чем рассказывал, вы можете его скачать и перестроить под себя и ваш стек.

Если пользуетесь Hermes или просто следите за расходами на агентов, это видео точно для вас. Так как с Jev можно заметно экономить свои токены на Hermes.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забывайте ставить лайк и писать комменты под видео, мне важна ваша реакция


Что такое Dots и зачем он нужен?

Dots - это по сути ответ OpenAI на Muse и Grok Bot. Агент находится не у вас на компе, а в облаке. У каждого Dot есть свой компьютер, свой браузер и доступ к приложениям, которые вы подключите (их больше 4000). Вы ставите ему задачу, закрываете чат, а он продолжает работать сам. Работает на новой GPT-6 Astra.

Когда вы ничего не просите, Dot сам ищет, чем помочь, то есть его старались сделать проактивным, и со временем подстраивается под то, как вы работаете. А если интересно, чем он занимался, можно открыть его компьютер и посмотреть.

Что он умеет, по примерам самих OpenAI:
🟢 Разработчикам: собирает фидбек пользователей, чинит мелкие баги и приносит готовые пулл-реквесты с видео изменений
🟢 Маркетологам: когда меняется продукт, сам переделывает материалы для запуска
🟢 Контентмейкерам: из транскрипта интервью находит моменты под клипы, пишет описание и черновики постов
🟢 Для всех: разбирает календарь и почту по утрам, ресёрчит темы и напоминает о делах

По безопасности всё прям продумано. В фоновом режиме агент только читает данные и ничего не делает. Удаление файлов, покупки, установка непонятного софта и новые доступы всегда идут через ваше подтверждение. Плюс можно задать свои правила, что он может делать сам, а где обязан спросить дсотуп. Но главная дыра всех агентов осталась - страница или письмо может подсунуть ему вредную инструкцию, так что доступы лучше давать с умом.

Запускается всё просто, ничего отдельно ставить не нужно. Открываете десктопный ChatGPT, создаёте Dot, подключаете нужные сервисы и пишете ему правила. С телефона создать агента пока нельзя, но потом с ним можно общаться в мобильном приложении.

А вот доступны Dots пока только для ChatGPT Pro и Business Premium, и Pro не работает в Евросоюзе, Швейцарии и Великобритании, поэтому я пока не протестил его.

Первый Dot входит в подписку, а общение с ним не тратит лимиты ChatGPT, а вот задачи, которые он запускает в Codex - тратят. Докупать дополнительных агентов можно будет позже, цены пока не назвали.

Уже успели поюзать? Как вам ощущения если сравнивать с гермесом?


Основные анонсы и релизы с OpenAI DevDay

OpenAI провели DevDay, на котором было более 20 различных анонсов, а весь ивент прошёл на фоне скандалов с безопасностью. По данным WSJ, релиз GPT-6.1 Astra отменили из-за обманного поведения модели, хотя сама OpenAI это официально не подтверждала.

Но давайте посмотрим что интересного нам представили.

Модели

GPT-6.1 Sol - апгрейд Sol под агентный кодинг, computer use и рабочие задачи. По словам OpenAI, почти дотягивает до Astra, но стоит в 5 раз дешевле по токенам. Уже есть в API и на Plus, Pro, Business, Enterprise и Edu

Ultrafast - платный режим скорости: до 8x быстрее в Codex (300 токенов в секунду) и до 6x в API. Пока работает только с GPT-6 Astra, для Sol обещают позже

Dots - главная фича DevDay

Dots - агенты, которые работают постоянно. Они запоминают, что вам важно, подключаются к 4000+ приложениям через плагины и с вашего разрешения могут юзать ваш ноутбук. Пока вы с ним не работаете, dot сам копается в подключённых сервисах и ищет задачи, которые может с вас снять. Доступно правда только на Pro и Business Premium, и не во всех странах

Codex и API

Codex в облаке - запуск с компа, с телефона или в облаке с любого девайса

Codex CLI - управление голосом и новый /agents, чтобы следить за несколькими задачами сразу. Доступен на всех планах

Code Review - ревью в десктопном приложении. Пока вас нет, Codex сам делает первый проход по PR в облаке

Codex Security Cloud - сканит GitHub-репо по расписанию и готовит фиксы, даже когда компьютер выключен

Agents API с computer use - агенты теперь умеют работать с софтом, плюс в API переехали мультиагентность и компакция контекста из Codex

Decisions API - быстрый выбор из заранее заданных вариантов ответа: классификация, роутинг, следующий шаг агента. Пока что в ограниченном превью

Плагины

Plugin extensions - у плагинов появится своё место в сайдбаре и свои панели рядом с чатом

MCP Events - плагины запускают автоматизации по событиям. Прилетела новая задача на доску - ChatGPT сам читает доки и пишет план

Командная работа

ChatGPT Space, Pages и совместные слайды - общее пространство для команды, ChatGPT и вашего dot. Слайды экспортируются в PowerPoint и Google Slides, но выйдут только в ближайшие недели

Meetings - пишет заметки встреч, аудио удаляется сразу после. Пока что бета на macOS

Подписки

Pro 500 - новый тариф с лимитами в 25 раз больше Plus и доступом к Ultrafast

Pro за $200 - про это я упоминал отдельно и более подробно

Sign in with ChatGPT - лимиты подписки теперь можно тратить у 16 партнёров, среди них Devin, Notion, Vercel и OpenClaw

Самое интересное из этого всего - конечно же Sol уровня Astra по цене в 5 раз ниже, ну и Dots


OpenAI на DevDay конечно показали ОЧЕНЬ много

Можете посмотреть трансляцию, я завтра с утра выложу всё основное, что заанонсили.

https://openai.com/live/


Вчера встретился в Лиссабоне с хорошим знакомым. Он прилетел сюда на несколько дней, мы долго говорили про AI и бизнес, и я поймал себя на мысли, что эти темы уже сложно обсуждать по отдельности.

Он фаундер проекта и хорошо видит, насколько AI стал полезен в работе. Раньше разговор обычно сводился к страху: "Вот скоро AI придёт и заменит программистов и других специалистов". Сейчас же я думаю, многие уже понимают, что ситуация другая.

AI сам по себе не делает человека хорошим специалистом. Но если ты понимаешь свою работу, с ним можешь делать её намного быстрее, брать на себя больше и иногда находить решения, до которых раньше просто не хватило бы времени добраться.

Поэтому я бы меньше переживал о том, что AI заменит всех, и больше думал о другом: что будет, если продолжать работать по-старому, пока другие уже осваивают эти инструменты.

Вторая тема нашего разговора была про бизнес. Есть компании, которые вовсю внедряют AI, но другие бизнесы пока даже не понимают, с чего начать и где он им действительно полезен. Для людей, которые умеют работать с этими инструментами, это огромное окно возможностей.

Тут, кстати, важен и социальный капитал. Иногда возможность появляется не через вакансию или холодное письмо, а через обычный разговор с человеком, который знает, как ты работаешь. У меня так началось сотрудничество с одним партнёром: сейчас я помогаю внедрять AI в его проекты. Про это, думаю, расскажу отдельно.

Мой вывод после вчерашнего разговора простой: сейчас мало просто следить за новостями в AI сфере. Гораздо полезнее научиться применять его в своей работе, а потом замечать возможности вокруг, где этот опыт может кому-то помочь.

Благо я заснял уже 40+ видео за эти пол года, и по ним даже с полного нуля можно дойти до продвинутого уровня


Всё что нужно знать о Jev простыми словами

После прошлого видео о Jev, понял, что многие всё равно не поняли что это за магическая модель такая. Да и я рассказал не полностью о его функционале, о том, как правильно его "промптить".

Поэтому в новом видео, я исправился и после его просмотра, вы поймете на 99% что это за модель, как ее настраивать и как ею пользоваться на реальных задачах.

В нём я разбираю 6 главных вещей, которые нужно знать при работе с Jev.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забывайте ставить лайк и писать комменты под видео, каждая ваша реакция толкает алгоритмы и даёт мне мотивацию


Перезапуск подписки GPT Pro за $200

Тибо, человек который руководит Codex в OpenAI, ночью перед DevDay выложил пост. Завтра Pro за $200 снова открывают для новых подписчиков, но лимиты теперь считают по-новому. Если перевести в API-доллары, подписка даёт ровно в два раза меньше, чем старый Pro за $200.

Тибо сам это посчитал и прямо написал, почему это якобы всё равно выгодно:

🟢5-часовой лимит возвращать не будут. Всю недельную квоту можно сжечь хоть за один день
🟢Модели дешевеют, и подписка дешевеет вместе с ними. GPT-6 Sol и GPT-6 Luna недавно вышли в API на 50% дешевле своих версий 5.6
🟢Раздувать цены API ради красивых цифр в подписке они не хотят. В идеале разница между подпиской и оплатой по факту вообще должна исчезнуть. (К сожалению к этому всё и идёт)
🟢Завтра в подписку добавят что-то, что не будет жрать лимиты. Что именно, пока не говорят

На практике выходит так, что если вы используете Sol или Luna, то урезание примерно компенсируется их удешевлением (но на деле думаю всё равно будет меньше лимитов использования чем было), и по объёму работы вы почти ничего не теряете. А вот с Astra хуже т.к. её цену не снижали, она в 5 раз дороже Sol, значит и работы на ней вы получите в два раза меньше. А многие берут Pro как раз ради Astra.

В хелпе OpenAI до сих пор написано, что Pro $200 даёт 20x от Plus. После этого изменения там скорее 10x и пока неясно, касается ли это тех, у кого подписка уже есть.

В общем, новости для нас плохие, так как гайки постепенно начинают закручивать. Что думаете?

1.7k 0 25 15 16

Вышел новый Sonnet 5.5

Для всех обладателям подписки за 20$ это хорошие новости, так как теперь можно будет получать качественней результаты.

По бенчмаркам бьет даже GPT 6 Sol, хотя стоит так же. И тратит меньше токенов на задачи, чем Sonnet 5.

https://www.anthropic.com/claude-sonnet-5-5

P.S
С головой щас в одном проекте, поэтому может будет чуть меньше контента. Но обещаю исправится! На эту неделю готовится два крутых видео по Jev, одно из которых уже завтра выйдет






Спрашивал Kimi, а отвечал Claude

С февраля китайские ИИ-лаборатории стали постоянными героями отчётов Anthropic. Поначалу схема была прямолинейной: тысячи фейковых аккаунтов засыпали Claude запросами, а ответы шли в датасеты для обучения своих моделей.

Теперь пошли дальше. Пользователь пишет в Kimi или DeepSeek, а его запрос уходит в Claude. Ответ возвращается клиенту и заодно сохраняется для обучения. Пользователям, конечно же, никто не сказал, что их промпты читает американский конкурент.

Вот для сравнения:

DeepSeek - в феврале около 150 тыс. обменов, сейчас 12,1 млн. Рост в 80 раз.

Moonshot (Kimi) - было 3,4 млн., стало 23 млн. Только за 10 дней через Claude прогнали около 300 тыс. запросов клиентов с 5380 фейковых аккаунтов в Сингапуре и Японии.

Alibaba - в июне ловили на 28,8 млн. запросов, теперь 151 млн. для обучения Qwen, в пике почти 3 млн. в день.

Всего в сентябрьском отчёте семь китайских компаний, кроме этих трёх ещё Zhipu, MiniMax, Xiaomi и SenseTime.

Вместе с запросами утекало всё подряд, вплоть до записей с сотен камер наблюдения в Чэнду и рабочий код с живыми паролями от инженера госкомпании.

Реакция не заставила себя ждать. Anthropic перестала отдавать по API полный ход рассуждений Claude, только краткое резюме. АНБ, ФБР и CISA выпустили предупреждение о дистилляции китайскими ИИ-компаниями. Пекин назвал его необоснованным, но собственный регулятор всё равно взялся проверять DeepSeek и Moonshot. Правда, не за копирование Claude, а за то, что данные своих же пользователей уходили в США.

Удобно конечно получилось для юзеров китайских моделей, получать ответы от Claude платя в разы дешевле))


Кстати, вижу что ролик про Jev получил много фидбека, так что планирую сделать минимум ещё несколько видео про него.

Если у вас есть запрос, что хотите чтобы я разобрал связанное с Jev, его интеграцию в workflow, то пишите в комментах 👇


Облачные сессии Claude Code вышли из тестового режима

Anthropic вывели облачные сессии из тестового режима. Суть простая: задача работает не на вашем компе, а на серверах Anthropic. Дали агенту задачу, выключили компьютер, ушли по делам, а вечером пришли смотреть, что он там навайбкодил.

Запускать можно откуда удобно: с claude .ai/code, из вкладки Code в мобильном приложении, из десктопного приложения или командой claude --cloud в терминале.

Чтобы народ затестил фичу, Anthropic раздают кредиты: $100 на Pro и $250 на Max. Эти деньги идут отдельно от обычных лимитов и тратятся только на облачные сессии.

Забрать бонус можно кнопкой Claim credit на сайте или командой /claim-credit в CLI.

Что важно знать:
➡️ Нужен подключённый GitHub, без него сессию не запустить
➡️ Забрать кредит нужно до 7 октября
➡️ Потратить до 4 ноября по тихоокеанскому времени, потом всё сгорает
➡️ Один кредит на аккаунт

Не советую откладывать, дедлайн близко


Видео недоступно для предпросмотра
Смотреть в Telegram
Решил заодно протестить Opus 5.5 на своем тесте с 3D островом

Результат меня поразил...

Вот сайт:
https://procedural-island-fawn.vercel.app/?quality=high

Буквально недавно я тестил на fable 5.1 и astra и результаты были неплохие, то сейчас это NEXT LEVEL

Текстурки, тени, шейдверы и свет, звёздное небо

Всё стало намного лучше

Похоже RSI уже здесь...

Чтобы сравнить вот сайты от:
Fable 5.1 - ТЫК
Astra - ТЫК


Opus 5.5 против GPT-6 Sol: дал им один реальный заказ

Вчера Anthropic выпустила Claude Opus 5.5, а через 1.5 часа OpenAI выпустила GPT-6 Sol. Каждая компания показала бенчмарки, где её модель лучше. Но верить мы им не будем.

Поэтому я проверил по-другому. Я захотел реализовать реальный бизнес, прокат сапов на пляже под Лиссабоном, и дал обеим моделям одинаковое задание: собрать ему сайт с онлайн-бронью, базой, админкой, уведомлениями в Telegram и ботом-помощником, который знает прайс и реальную погоду на пляже.

Opus работал в Claude Code, Sol в Codex. Промты были одни и те же.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Постарался сделать как можно быстрее видео, но при этом качественно протестить модели, это заслуживает вашего лайка и коммента на ютубе!



Показано 20 последних публикаций.