AI for Devs


Channel's geo and language: Russia, Russian
Category: Technologies


По сотрудничеству пишите в личные сообщения канала.
Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.

Зарегистрирован в РКН
Related channels

Channel's geo and language
Russia, Russian
Statistics
Posts filter


⚡️ DeepSeek выпустили десктопный клиент: Deepseek Harness

Вслед за ZCode и Kimi Code свой десктоп появился и у DeepSeek. На сайте доступны сборки для Windows и macOS.

https://deepseek.com/en/harness/

Основной акцент DeepSeek делают на расширяемость: в Harness на плагинах построены инструменты, интерфейс и даже сам цикл работы агента.

✨ Everything is a Plugin ✨

В маркетплейсе плагинов их уже почти 9 тысяч: память между сессиями, управление браузером, доступ с телефона, интерактивные графики в чате и даже pomodoro (целых 3 версии!).


Исходники Harness доступны на GitHub.

@ai_for_devs


⚡️ Google представили Gemini 4 Argon

По заявлениям компании, новая модель обошла флагманы OpenAI и Anthropic в большинстве опубликованных бенчмарков.

Только посмотрите на картинку: кажется, гонку ИИ можно сворачивать.

Однако мы уже рассказывали про попытки Google и Meta забенчмаксить всё, что можно забенчмаксить.

На свежем Terminal-Bench 4.0 Argon уступает всем трём конкурентам из таблицы, а на FrontierSWE v2 проигрывает и Astra, и Opus 5.5.

Это относительно свежие бенчмарки, и мы бы ориентировались именно на них.


К сожалению, проверить всю мощь модели самим пока не получится: общего доступа нет, выдают только отдельным специалистам по кибербезопасности и ранним тестировщикам.

Стартовая цена API составит $2/$10. Далее её увеличат до $4/$20, ровно как у Opus 5.5.

@ai_for_devs


⚡️ Anthropic опубликовали лучшую рекламу GLM

Помните пост про abliterated-модели, у которых можно ослабить привычку отвечать «извините, я не могу вам с этим помочь»?

Anthropic проделали это с GLM-5.3. В среднем по трём тестам доля отказов упала примерно с 95% до 6%. На остальных бенчмарках способности модели при этом практически не изменились.

На ExploitBench модель получила 12% успешных попыток разработки полноценного эксплойта против 14% у Mythos Preview.


При этом веса GLM доступны всем, а Mythos Preview дают попробовать только избранным компаниям из США.

В общем, неплохой отзыв от конкурента для лаборатории из Китая)

@ai_for_devs


⚡️ DevDay 2026 подошел к концу

Помимо главных новинок, также показали:

• Тариф Pro Max за $500/мес — новый x25. И эксклюзивный Ultrafast для Astra в Codex: ускорение в 8 раз (~300 токенов/с)

• Codex — добавили голосовое управление и команду /agents в CLI, облачные задачи с доступом с телефона и отдельный интерфейс для код-ревью.

• Decisions API — Luna выбирает ответ из заданных вариантов: классифицирует контент, маршрутизирует запросы и определяет следующий шаг агента. Пока в ограниченном превью. Jev оказал влияние)


P.S. Без подарков тоже не обошлось: всем пользователям выдали сброс лимитов, а участникам DevDay вручили по тамагочи от OpenAI 👍

Все подробности по анонсам в обзоре OpenAI.

@ai_for_devs


⚡️ OpenAI обновили GPT-6.1 Sol

Параллельно с трансляцией всем стала доступна новая версия Sol.

Модель приблизилась к Astra на бенчмарках, а цены на токены в API в пять раз ниже.

В DeepSWE 1.1 новая Sol достигла уровня Astra и уверенно обошла предыдущую Sol.


Цена — $2 за миллион входных токенов, $10 за выходные и $0,10 за кэшированный вход.

@ai_for_devs


⚡️ OpenAI представили dots [DevDay 2026]

Персональный агент на базе Astra, по сути OpenClaw в удобном интерфейсе.

С ним можно общаться в ChatGPT, голосом и в мессенджерах, а для доступа к сервисам доступно 4 тысячи коннекторов.


У агента есть свой браузер и виртуальный компьютер, а по мере использования он подстраивается под вас и ваши задачи.

Трансляция тут: https://openai.com/live/

@ai_for_devs


⚡️ OpenAI DevDay [2026]: 20+ анонсов, новый агент и подписка за $500

Сегодня OpenAI проведут свою ежегодную конференцию для разработчиков. Обычно к DevDay готовят крупные релизы, а в этом году обещают показать больше 20 новинок.

Что ждём по тизерам и утечкам:

• Новый постоянно работающий агент — «o», или Aeon. Что-то в духе Grok Bot: помощник, которому можно делегировать долгие задачи. Цветные сферы в тизерах выглядят как жирный намёк, а упоминание «o, your always-on assistant» уже заметили в интерфейсе подписки.

• ChatGPT Pro Max за $500 в месяц. Про этот тариф мы уже рассказывали. Вероятно, представят именно сегодня: в утечке обещают более быстрые Work и Codex, но конкретные лимиты пока неизвестны.

• Объединение ChatGPT и Work, обновления агентных инструментов и, возможно, первая демонстрация собственного физического устройства. Эти пункты пока на уровне слухов, особенно железка.

• Новую флагманскую модель мы сегодня вряд ли увидим. По сообщению WSJ, запланированный на октябрь выпуск GPT-6.1 Astra отменили из-за проблем с безопасностью: модель чаще скрывала свои действия и выходила за рамки разрешённого.


Начало трансляции сегодня в 20:00 МСК: https://openai.com/live/

@ai_for_devs


⚡️ OpenAI возвращают подписку за $200, но с новыми условиями

Представитель компании рассказал, как изменится текущий самый дорогой тариф. Коротко по пунктам:

– Pro за $200 снова откроют для новых подписчиков, но поменяют подсчёт использования. В пересчёте на стоимость API включённый объём станет вдвое меньше, чем раньше.

– Лимит на 5 часов возвращать не будут. Недельный запас можно тратить тогда, когда удобно.

– Сделать обещают больше, чем месяц назад на том же Pro. Объясняют это ростом эффективности моделей. Дальше обещают больше работы и выше качество за те же деньги.

– Цены API продолжат снижать. По словам представителя, GPT-6 Sol и Luna уже подешевели вдвое. Искусственно завышать прайс ради «выгодности» подписки не хотят.

– В перспективе разница между подпиской и API за тот же доллар должна сократиться, чтобы большинству было разумно покупать использование по мере необходимости.

– На DevDay представят фичи, которые не расходуют лимиты. Какие именно — пока секрет.


Пока такие вводные. Вечером нас ждёт DevDay, посмотрим, что ещё положат в подписку за $200)

@ai_for_devs


⚡️ Anthropic выпустили Claude Sonnet 5.5: на 30% быстрее и до 30% дешевле

На Terminal-Bench 4.0 новинка набрала 70,6% против 10,3% у Sonnet 5 и даже обошла Opus 5.5 с 66,4%.

Стоиомость в API осталась прежней — $2/$10 за миллион входных и выходных токенов, но благодаря меньшему расходу токенов одна задача обходится дешевле.


Впрочем, Opus 5.5 и так оказался неожиданно эффективным: даже на подписке за $20 он очень медленно съедает лимиты.

Остаётся надеяться, что после релиза Sonnet 5.5 Anthropic не понерфят Opus.

@ai_for_devs


⚡️ OpenClaw удалили 400 тысяч строк тестов, которые ничего не проверяли

Мы уже разбирали Caveman, rtk и Ponytail скиллы из серии статей от JetBrains. Первые два не дали обещанной экономии, а Ponytail действительно сократил и код, и расходы.

Нашёлся ещё один полезный скилл: test-audit от создателя OpenClaw Питера Штайнбергера.

Питер рассказал, что из проекта удалили около 400 тысяч строк тестов, а покрытие почти не изменилось. По его словам, модели любят писать тест на каждое мелкое изменение, даже когда пользы от него нет.


test-audit просит агента перед каждым новым тестом объяснить, какое поведение тот защищает, какую ошибку поймает и почему существующих проверок недостаточно.

@ai_for_devs


⚡️ Low, medium, high или max: выбираем effort для модели

Инженер Anthropic разобрал на примерах, что меняется при переключении effort в Claude Code. Если вы до сих пор не уверены, какой уровень ставить, вот короткая шпаргалка.

TL;DR: Чем выше effort, тем больше Claude сам принимает решений, проверяет результат и ищет крайние случаи.

• Low — наброски, обсуждение идей и простые правки, когда хочется быстро получить ответ и продолжить диалог
• Medium — обычная разработка, в том числе реализация новых фич
• High — баги в существующем коде и задачи, где важно тщательно проверить результат
• Max — сложная автономная работа от начала до конца, например сборка приложения или поиск уязвимостей в критичном ПО

На расплывчатых задачах высокий effort означает ещё и больше предположений, которые Claude сделает за вас. Поэтому Тарик предлагает сначала уточнить требования, собрать первую версию на low или medium, посмотреть, правильно ли Claude понял задачу, а затем переключиться на high для тестов и проверки.


На самом деле выбор effort руками сейчас выглядят странновато) В Projects Claude уже сам понимает, к какой сессии отнести задачу, а effort по промпту мы по-прежнему должны настраивать самостоятельно.

Ждём для effort что-то вроде Auto mode для аппрувов, ну или настраиваем Jev.

@ai_for_devs


⚡️ OpenAI готовят ChatGPT Pro Max за $500 в месяц

По утечке, упоминания тарифа нашли в коде: обещают максимальную скорость обработки запросов и повышенными лимиты.

Возможно, за максимальной скоростью стоит Cerebras, но связь с новым тарифом пока не подтверждена.


За $500 в месяц хочется, чтобы Codex ещё и на дейлики ходил.

@ai_for_devs


⚡️ Облачные сессии Claude Code стали доступны всем

Anthropic вывели облачные сессии из превью: задачу можно запустить в браузере, приложении или через claude --cloud, и она продолжит выполняться на серверах Anthropic.

Действующим подписчикам Pro дают разовый кредит $100, Max — $250: сначала расходуется он, затем обычный лимит плана.

Забрать кредит можно до 7 октября по ссылке или командой /claim-credit.


Бесплатными $ Anthropic подталкивают пользователей попробовать обновлённые Projects: каждый тред там работает в облаке, а доступ к бете постепенно расширяют.

@ai_for_devs


⚡️ OpenAI выпустили GPT-6 Sol и Luna — более быстрые и дешёвые версии Astra

Обе модели стоят в API вдвое дешевле предшественников: Sol — $2/$10, Luna — $0,10/$0,50 за миллион входных/выходных токенов.

По тестам OpenAI, Sol почти догоняет Claude Fable 5 в сложных задачах разработки при примерно на 80% меньшей стоимости, а улучшенное кэширование даёт скидку 90% на повторно используемый контекст.


Модели уже появились в Codex, ChatGPT Work и API.

@ai_for_devs


⚡️ Anthropic выпустили Claude Opus 5.5

По бенчмаркам новинка обошла всех основных конкурентов:

• Terminal-Bench 4.0: 66,4% против 57,9% у GPT-6 Astra, 55,8% у Fable 5.1 и 52,3% у Opus 5

• FrontierCode 1.1: 54,4% против 53,3% у Astra и 48% у Opus 5

• CursorBench 4.0: 57,8% против 51,8% у Fable 5.1 и 46,6% у Opus 5


Цены API снизили с $5/$25 до $4 за миллион входных и $20 за миллион выходных токенов.

Чтение из кэша подешевело сразу на 60% — с $0,50 до $0,20.

P.S. На тарифах Pro и Max увеличили пятичасовые лимиты. Плюс, всем пользователям с подпиской дали один сброс, которым можно воспользоваться в любое время.

@ai_for_devs


⚡️ Xiaomi выпустили MiMo-V2.6 Pro и Flash

В Pro больше триллиона параметров, во Flash 309 млрд. Обе модели работают с текстом, изображениями, видео и аудио, а контекст составляет миллион токенов.

На DeepSWE флагман Xiaomi получил 71,9% против 74% у Opus 5 и 73% у GPT-5.6 Sol. Но на новом Terminal-Bench 4.0 пока заметно отстаёт от Opus 5: 34,9% против 49%.

Миллион выходных токенов Pro-версии стоит $0,87 — в четыре раза дешевле DeepSeek V4 Pro, в 17 раз дешевле Kimi K3 и примерно в 20–30 раз дешевле GPT-5.6 Sol и Opus 5.

Flash обойдётся в $0,14/$0,28 за миллион входных/выходных токенов. Что примерно на ровне с DeepSeek V4 Flash и немного дешевле Qwen3.8 Flash и GLM-5.3 Flash.


Веса обеих моделей уже выложены на Hugging Face. А MiMo-V2.6 Flash прямо сейчас можно бесплатно попробовать в OpenCode (доступ обещают оставить на неделю).

@ai_for_devs


⚡️ Z.ai опубликовали исходный код ZCode после скандала со сливом репозиториев

Компания фактически подтвердила существование механизма, который создавал снапшоты локальных репозиториев и загружал их в Alibaba Cloud. Теперь эту "фичу" удалили, а генерацию и отправку снапшотов отключили.

https://github.com/zai-org/ZCode

Z.ai утверждает, что пользовательский код не сохранился и никогда не применялся для обучения моделей. Верим!

P.S. Плюс до 7 октября продлили акцию с безлимитной GLM-5.3-Flash для всех пользователей с подпиской.

@ai_for_devs


⚡️ SpaceXAI выпустили Grok 4.7

На CursorBench 4.0 модель набрала 46,3% против 41,7% у GPT-5.6 Sol, а на DeepSWE получила 71% против 72,7% у Sol и 70% у Fable 5.1.

Ранее Илон Маск обещал выпустить Grok 4.7 в конце августа, затем перенёс релиз на 11 сентября. В обозначенную дату попросил дать модели ещё немного «довариться».

В итоге сроки сдвинулись примерно на месяц, и вот сегодня модель зарелизили.


Флагман SpaceX уже доступен в Cursor, Grok Build и API за $2/$6 за миллион токенов.

@ai_for_devs


⚡️ Модель Jev от TypeSafe AI стала доступна всем

На старте дают $5 на API-счет (~120млн.токенов). Стоимость: $0,042 за млн входных и бесплатные выходные токены.

Дока по использованию: https://docs.typesafe.ai

Также на Vercel можно потестить бесплатно до 25 сентября.

@ai_for_devs


⚡️ Claude Code, Cursor и Codex — с единым балансом в рублях

Ребята из Veai добавили единый API-ключ, который можно использовать в самых популярных AI-агентах.

Пополнение в рублях, доступ к провайдерам без VPN, тарификация по минутным планам Veai. Самому заводить и оплачивать отдельные аккаунты OpenAI и Anthropic не требуется.

По тарифам: 2 800 ₽/мес. за 200 минут работы моделей или 10 000 ₽/мес. за 1 000 минут. Неиспользованные минуты переносятся на следующий месяц.


А ещё у Veai есть собственный агент для JetBrains IDE и OpenIDE. Новым пользователям дают 30-дневный триал с 200 минутами, можно бесплатно юзать флагманские модели Anthropic, OpenAI и китайских лабораторий.

Инструкции по настройке Claude Code, Cursor, Codex, OpenCode и так далее: https://veai.ru/docs/veai/connect

20 last posts shown.