Фильтр публикаций



994 0 13 36 24




1.7k 1 31 29 29


1.7k 1 34 22 31

Вышла Gemini 3.7 Flash

Из нового:
- цена снижена в 2 раза
- заметный прогресс в бенчах (не шутка)
- дата релиза 13 августа (у 3.6 было 21 июля)
- новая цифра после 3. (7 вместо 6)
- новый пост про новую модель у новых сотрудников Google

Катофф стал чуточку лучше: вместо января 2025 модель теперь в курсе событий где-то до февраля-марта 2025 (прогресс, целых два месяца!!!). То есть теперь знает про GPT 4.5 и Claude Code, вышедшие в феврале

В целом не скажу, что релиз провальный. Она как минимум не хуже 3.6 Flash, но при этом вдвое дешевле, катофф хоть чуть-чуть, но свежее, да и по бенчам её много где прокачали (даже если это бенчмакс — тестеры говорят, что модель и правда неплоха). Я сам с ней пообщался — отвечает приятно, приятнее чем 3.6 (прошлая меня прям бесила). Может даже и 3.1 Pro заменит.. Надо попробовать

Вроде бы даже годная модель в своей нише — она очень быстрая, вполне умная, и круто общается. Конкурентов особо не вижу, кроме Muse Spark, но она медленнее, да и база знаний по наполнению заметно скуднее




Сегодня Gemini 3.7 Flash выходит.. ха-ха.. ахаха 😅😅

Прайс-лист уже появился. Хорошее: цены понизили до $0.75/3.75. Плохое: это не 3.5 Pro

Повысили цены в 3.5 Flash в три раза, чтоб потом понизить обратно в 3.7 Flash. Браво, маркетинг уровня бог!

1.9k 0 28 49 39

R.I.P Manus

В декабре 2025 Meta купила Manus у китайцев за $2 млрд. Китай сделку заблокировал, и теперь её расторгли по закону — агент снова уходит в прежние руки, крупнейшим акционером становится Tencent (ну каторые пабг зделали)

Имхо, смысла в Manus в последнее время уже и не было. Когда он выходил, это было фантастически: агент с полным доступом к браузеру, к файловой системе, можно подрубить любые коннекторы, может выполнять любые команды. Но с того момента почти ничего не поменялось, а конкуренты понемногу догоняли

И в итоге сейчас у нас есть ChatGPT Work Cloud ровно с тем же функционалом и Claude Cowork Cloud почти с тем же — только лимиты там в разы щедрее, а модели умнее и быстрее. Главная фишка Manus перестала быть фишкой. Meta за полгода с ним тоже ничего нового не придумала и агента не оживила, к сожалению

Ну а если вы всё ещё им пользуетесь: всё, что вы создали в Manus с 29 декабря, удалят 23–24 августа. Забэкапить можно на manus.im/backup.

А ещё до 25 августа Manus 1.6 бесплатен и безлимитен. Так что можно напоследок поюзать его 🫡

1.5k 1 18 25 19

А ещё Grok 4.6 вышел... но кому нужен Grok?

При релизе Grok 4.5 у меня было ощущение, что, может, ну наконец-то xAI взялись за голову, но чёт нифига. Отпишитесь, если реально используете Grok 4.5 в повседневе, но мне кажется, такого человека не найти

Grok 4.5 — очень ненадёжная модель, её страшно впускать в YOLO-мод, от неё вайбы опасной сырой модели 2024 года, которую недообучили. Она может резко начать творить какую-то херню и вписывать странные команды, зацикливаться в ризонинге или в ответе. При этом в бенчах она забралась довольно высоко, что меня всё ещё удивляет (как?)

Grok 4.6 не исправил проблемы предшественников, и понял я это ещё по первому запросу в него 🙂‍↔️


Уже вышла! (OpenRouter)

Прайс пока что остался такой же, как и был ($0.4/0.87), но DeepSeek обещали сделать все модели заметно дороже, так что это ненадолго

У новой V4 Flash была заметная проблема со спамом ризонинг-токенов: модель маленькая, ей приходится думать очень долго, и иногда она сходила с ума и зацикливалась. У V4 Pro по первым запросам такой проблемы нет, или она проявляется заметно слабее


Репост из: PERCEPTRON.
⚡️ Новая модель Deepseek V4 Pro должна выйти завтра либо же сегодня, на фото бенчмарки.

💠 PERCEPTRON.




Инсайдер leo: OpenAI готовятся запустить модель Astra — она может выйти уже на следующей неделе

Astra — это новый претрейн, самая крупная модель OpenAI со времён GPT-4.5. По информации, внутренний чекпоинт под кодовым именем «mewfour» уже стал релиз-кандидатом. Подозреваю, ценник тоже окажется выше, чем у текущей Sol.

По сути это их ответ на Fable. Кстати, Fable 5.1 ждём в августе, так что Antropic вполне может выкатить что-то в ответ 👀

Спасибо за конкуренцию. Может, и лимиты к релизу сбросят 👍



2.3k 0 35 96 28

На OpenRouter, кстати, ещё и дополнительная акция действует — там Luna и Terra в 2 раза дешевле: по $0.1/0.6 и $1/6 соотвественно. Luna дешевле чем DeepSeek V4 Pro! 🫣

3.2k 2 41 19 38

OpenAI обвалили цену на 5.6 Luna на 80% — теперь всего $0.2/1.2!

Вот это очень мощно, тут не поспоришь. Для сравнения: Haiku от Anthropic стоит $1/5, не обновлялся почти год и уже сильно проигрывает. У Google 3.5 Flash Lite стоит $0.5/2.5.

Теперь Luna стоит даже меньше, чем 5.4 nano, а умнее в разы. Это лучший выбор под простые задачи (классификаторы, разметка и т.п) где важна цена, скорость и точность


Opus 5 спустя 5 дней

Новым опусом я пользовался очень много начиная с релиза. Модель шикарная, и она войдёт в топ моих любимых моделей за всё время. У меня накопилось несколько советов, которые могут вам помочь. Часть работала и на прошлых клодах, часть очевидная, но проговорить считаю нужным

1) Размышления
Лучший режим ризонинга у Opus 5 — high. На нем модель быстрая, экономная и очень умная, я использую его на 90% задач. Для простых перехожу на low, и это кстати тоже чудесный режим, Opus на low сильно умнее, чем GPT на low. xhigh и max даже не трогал и вам не советую, они в 1.5-2 раза дороже, а судя по бенчам по уму прироста особо и нет

2) Режим планирования
Модели Anthropic всегда работали поверхностно, не сильно углублялись в задачу и могли забить на то, что вы прямо не попросили — обновить документацию, например. Со временем проблема сходит на нет, но Opus все равно иногда что-то забывает. Лучше всего это фиксится план модом — в нём модель тратит больше времени на изучение кода, продумывает, что и где придется редактировать, и может задать вам уточняющие вопросы

3) Проактивность
Claude любит делать что-то без вашего подтверждения. Он может спросить «Стоит ли сделать миграцию?» и тут же запустить команду миграции, не дождавшись ответа :D В 99% случаев это лечится режимом разрешений auto. В нем на выполнении команд сидит отдельная модель-классификатор, она видит ваш промпт и решает, пропускать команду или нет. Разрешения вы не давали, значит не пропустит. Ну и план мод из прошлого пункта тоже спасает, к слову

4) Агентность
В этом Opus просто гениален. Он шикарно понимает, как работают модели, системные промпты, тулы и субагенты, и лучше всех пользуется этим. Я постоянно юзаю режим workflow (ultracode), обычных субагентов или прошу запустить Codex CLI на его стороне. Со всем этим он справляется идеально, очень советую попробовать

5) Лимиты

Подписки Claude в последнее время давали больше юседжа по долларам, чем подписки OpenAI. Правда, это компенсировалось тем, что модели OpenAI были очень экономными, и по факту выходил примерный паритет. Теперь Opus догнал их по экономности или подобрался очень близко, так что Opus 5 на подписке Claude даёт в 2-3 раза больше лимитов, чем 5.6 Sol у OpenAI. Частично ещё и за счёт того, что до 19 августа лимиты умножены на 1.5х

Anthropic родили чудо. Умное, универсальное, очень сильное в бэке, фронте, компьютер юзе, агентных задачах и просто общении. И при этом ещё быстрое и экономное.

А как вам Opus 5? Делитесь! 👇


Спустя долгое использование GPT 5.6 моё мнение о ней поменялось

Первые впечатления у меня были отличные, но чем дольше я с ней работаю, тем больше она меня бесит.

Промптить 5.6 безумно тяжело. Пользуясь ей, я ощущаю, будто вернулся на два года назад, где надо было писать огромные промпты. Без очень чётких рамок в задаче модель делает гораздо больше, чем ты просил, и это почти никогда не плюс. GPT 5.5 понимала почти с полуслова, а 5.6 каждую мелочь надо разжёвывать и ограничивать

Каждый мой второй запрос к 5.6 заканчивается тем, что она уходит в луп бесконечных проверок > фиксов > проверок > фиксов. А реальных проблем нет, она себе их выдумывает (такой у модели характер). В итоге половина ума модели уходит на борьбу с несуществующими багами, а лимиты на её паранойю.

Сегодня была последняя капля. Я оставил её отревьюить коммиты от Opus 5 на баги и проблемы. Итог: она насрала 159 субагентов (я не просил об этом! и это не Ultra режим, а max), потратила 48% недельника, и так как Codex app очень неоптимизированная штука — сожрал 70гб ОЗУ и макбук завис нахер :)

В общем, для меня это неудачная модель, и пользоваться ей я не буду. Сидеть на 5.5 уже неактуально, так что... подписку на ChatGPT продлевать не буду. Anthropic забрали это лето (как минимум пока что). Надежда на GPT 6 есть, но когда она выйдет — непонятно, а там и Fable 5.1 не за горами

OpenAI по-хорошему пора снова объявлять код красный, как в декабре 2025. Но вместо этого они купаются в незаслуженной поддержке сообщества и делают вид, что всё ок. А сотрудники тем временем троллят Claude в Твиттере. Ау, ребят, ваша модель сосёт у нового Opus, какой в пизду троллинг?! 🤬

Всё это моё личное мнение и мой опыт. Многим 5.6 нравится, и это прекрасно — пробуйте сами и решайте сами, а не по постам из телеграма


Opus 5 добавили на DeepSWE, и там он оказался даже выше, чем показывали сами Anthropic 😳

Версия с max-reasoning набирает 74%, тратит $11.84, и обгоняет 5.6 Sol Max и Fable Max. High отстаёт всего на процент, зато обходится почти вдвое дешевле, $6.08. Удивительно, но это дешевле чем GPT 5.6 Sol Max, а по процентам также

Отдельно хочу отметить и Opus 5 Low. Он набирает 58% и кушает всего $1.66, при том что 4.8 max за те же 58% брал $13.22, в восемь раз дороже, и был заметно медленнее

В общем, советую high для большинства задач, а low для простых. Opus 5 вышел очень удачной моделькой, пользуюсь ей с большим удовольствием! Скоро возможно напишу пост с более подробным ревью от себя.

2.3k 1 46 59 53

На Artificial Analysis Intelligence и Coding Index новый Opus 5 занял первые места, обогнав Fable 5 и 5.6 Sol

... 😳😳😳 это как

2.3k 1 31 29 53
Показано 20 последних публикаций.