TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
сбежавшая нейросеть

28 Sep, 22:39

Открыть в Telegram Поделиться Пожаловаться

01:13
Claude Sonnet 5.5 – OpenAI, держи подарок на DevDay!

Anthropic выпустила Claude Sonnet 5.5 – модель, которая в офисной и агентной работе почти догнала флагманский Opus 5.5, а стоит вдвое дешевле. По цене она ровно такая же, как свежая GPT-6 Sol, вот только новинка возит “Сол” мордой по полу: в отчетах, таблицах, презентациях и автоматизации рабочих процессов отрыв такой, что даже стыдно говорить. В коде они примерно на равных. Для повседневной работы получилась отличная рабочая лошадка – и это очень неприятная новость для OpenAI, у которой в итоге конкурентоспособна только GPT-6 Astra по цене в крыло самолета.

В английском есть словосочетание party pooper – человек, который подгаживает на вечеринках (это я вежливо перевел). Anthropic носит этот титул с гордостью и портит праздник раз за разом одним и тем же людям. В прошлый вторник OpenAI представила GPT-6 Sol и Luna, а за полтора часа до этого Anthropic выкатила Opus 5.5. В этот вторник у OpenAI DevDay – одно из главных событий года, к которому компания несколько дней разогревала публику. Anthropic ответила за день: выкатив модель, которая станет любимой рабочей лошадкой миллионов.

“Почти Opus 5.5” – вовсе не реклама. В документах и таблицах, управлении компьютером, задачах в терминале, автоматизации и медицинских вопросах Sonnet 5.5 идет вровень с флагманом, а местами даже обходит.

Отстает Sonnet в предсказуемых ситуациях. В Humanity’s Last Exam разрыв с Opus – 7,5 пункта, а с инструментами он сжимается до трех – это бенчмарк на размер модели, тут все логично. На задачах с по-настоящему длинным контекстом Sonnet 5.5 едва ушел от прошлой версии и уступает Opus больше 11 пунктов. Anthropic и сама признает: на сложной открытой работе, где нужно долго держать суждение, Opus заметно сильнее.

“Размер” модели бенчмарки вообще ловят плохо, а на практике он чувствуется. Иерархия у Anthropic простая: Fable 5.1 > Opus 5.5 > Sonnet 5.5. Я пишу посты с Opus 5.5 как со вторым пилотом: собрать контекст, покритиковать идеи, сложить факты и мысли в план – тут он хорош. 

Но бывают случаи, когда кусок поста не складывается – и я отдаю черновик в чат с задачей накидать неожиданные углы или поискать логические связки, которые я не замечаю. Opus обычно отвечает банальщиной, а Fable нередко подкидывает идеи, с которыми можно работать. Sonnet 5.5, полагаю, вообще будет не про это.

Из хорошего – с “творческим вкусом” у Sonnet 5.5 все хорошо, модель унаследовала это качество у Opus 5.5. 

Например, вот HTML-артефакт с описанием “еретической” научной идеи, которая скоро может стать мейнстримом. Модель работала чуть больше трех минут.

Видео в начале поста – это я попросил Sonnet 5.5 сделать с помощью кода озвученный ролик о самом себе. Как раз такие видео в последние дни стали визитной карточкой Claude Opus 5.5 – здесь видно, что работала модель классом пониже, но справилась.

Кому подойдет Sonnet 5.5? Пока вижу так. Если вы на 20-долларовой подписке Pro, то пробуйте как основную модель, пока по бенчмаркам и первым работам она вполне тянет большинство повседневных задач. Opus 5.5 используйте для планирования, проверки результатов, ну или если видите, что Sonnet 5.5 не вывозит – иначе не хватит лимитов.

На Max–планах сейчас с лимитами все хорошо – Opus 5.5 у меня работает днями даже на 100-долларовом варианте. Так что Sonnet 5.5 здесь скорее для скорости: повседневные вопросы, быстрый поиск в сети, субагенты в Claude Code для небольших задач.

Ну и ждем, чем ответит завтра OpenAI. Ходят слухи, что новая модель на DevDay все-таки появится – если да, то скорее всего это будет или GPT-6.1 или GPT-6 Aeon, дообученная для долгих автономных задач (на DevDay компания покажет нового ИИ-агента “o”, способного работать очень долго).

А вот бюджетный рынок OpenAI пока уступает: я и раньше мало кого видел, кто пользовался новыми GPT-6 Sol & Luna, теперь же в этом вообще нет смысла при наличии куда лучшего Sonnet 5.5.
—
Несколько часов назад я собрал из своих текстов мини-курс, как эффективно использовать последние модели Anthropic и OpenAI. Для Sonnet 5.5 он тоже подойдет, не пропустите.

7.1k 4 65 73
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot