Раскатили новую модель, которая теперь в два раза лучше умеет в логику, получив 77% в бенчмарке ARC-AGI-2
Две недели назад лидером этого бенчмарка стала Opus 4.6 с 68%
В комментариях пример задачек из бенчмарка
@unread_ed
Две недели назад лидером этого бенчмарка стала Opus 4.6 с 68%
В комментариях пример задачек из бенчмарка
@unread_ed