Sonnet 5.5: обогнал Opus в одном тесте, стоит вдвое дешевле
28 сентября Anthropic выпустила Claude Sonnet 5.5 — модель для кода, документов, таблиц и повседневных задач.
Что изменилось относительно Sonnet 5:
• Ответы генерируются на 30%+ быстрее.
• Задачи обходятся до 30% дешевле в тестах Anthropic. Цена токена прежняя, но модель тратит меньше токенов: чаще объединяет вызовы инструментов и выполняет работу за меньшее число шагов.
• В Terminal-Bench 4.0 — 70,6% против 66,4% у Opus 5.5. Здесь агент решает многошаговые задачи через терминал. Это победа в конкретном тесте: в сложной работе с неоднозначными требованиями Anthropic по-прежнему выделяет Opus.
Цена API — $2 за миллион входных и $10 за миллион выходных токенов, вдвое ниже Opus 5.5.
А ещё это первый Sonnet, прошедший Pokémon Red только по скриншотам. Модель получает изображение игры, выбирает действие и смотрит изменения.
[Анонс Anthropic](https://www.anthropic.com/claude-sonnet-5-5)
28 сентября Anthropic выпустила Claude Sonnet 5.5 — модель для кода, документов, таблиц и повседневных задач.
Что изменилось относительно Sonnet 5:
• Ответы генерируются на 30%+ быстрее.
• Задачи обходятся до 30% дешевле в тестах Anthropic. Цена токена прежняя, но модель тратит меньше токенов: чаще объединяет вызовы инструментов и выполняет работу за меньшее число шагов.
• В Terminal-Bench 4.0 — 70,6% против 66,4% у Opus 5.5. Здесь агент решает многошаговые задачи через терминал. Это победа в конкретном тесте: в сложной работе с неоднозначными требованиями Anthropic по-прежнему выделяет Opus.
Цена API — $2 за миллион входных и $10 за миллион выходных токенов, вдвое ниже Opus 5.5.
А ещё это первый Sonnet, прошедший Pokémon Red только по скриншотам. Модель получает изображение игры, выбирает действие и смотрит изменения.
[Анонс Anthropic](https://www.anthropic.com/claude-sonnet-5-5)