Postlar filtri


✴️ OpenAI снизила цены на API GPT-5.6 Sol

Скидка в более чем 20% будет действовать три месяца. Она работает для API и кредитов ChatGPT Work и Codex. Обычных подписок это не касается.

Стоимость 1M токенов:
— Вход: было $5 → стало $4 (−20%)
— Выход: было $30 → стало $20 (−33,3%)
— Чтение кэша: было $0.50 → стало $0.40 (−20%)
— Запись в кэш: было $6.25 → стало $5.00 (−20%)


💠 PERCEPTRON.


✴️ DeepSeek выпустила мультимодальную V4-Flash-Vision-Exp

Экспериментальная модель уже доступна в API. Она принимает изображения, сохраняя текстовые возможности V4 Flash.

На бенчмарках модель приблизилась к Opus 4.8.

💠 PERCEPTRON.


👀 Вышла стелс-модель Ox Alpha

В OpenRouter у неё контекст 1 млн токенов, вход из текста, изображений и видео, а упор сделан на агентный кодинг. Модель бесплатна, а провайдер не использует промпты и ответы для обучения. В OpenCode она 1 неделю доступна бесплатно, без хранения данных и почти без лимитов.

Ox Alpha связывают с Z.ai: среди 418 моделей её 7-компонентная API-сигнатура совпала только с GLM-5.3 и её алиасом, а токенизатор — на 50 из 50 строк. Независимая проверка дала 11 из 11 совпадений с GLM (у других лабораторий — максимум 4). Вероятно, это следующий после GLM-5.3 мультимодальный релиз Z.ai, либо сам GLM-5.3 с вижном.

На 10 задачах DeepSWE Ox Alpha набрала 80% против 65% у Fable 5, 62% у GLM-5.3 и Grok 4.6 и 52% у GPT-5.6 Sol (хотя из-за малой выборки реальный результат может сильно отличаться).

💠 PERCEPTRON.


✴️ GPT-Image-2 теперь генерирует изображения с прозрачным фоном

В API функция доступна в превью. GPT-Image-2 сразу создаёт PNG без фона, поэтому отдельно вырезать объект не нужно. В обычном чате ChatGPT прозрачный фон можно запросить прямо в промпте.

Напоминаем: функция уже была доступна в GPT-Image-1 и 1.5, а в GPT-Image-2 её добавили только сейчас.

💠 PERCEPTRON.


✴️ В Claude Code повышенные на 50% недельные лимиты продлили до 31 августа

Anthropic хочет сделать повышение постоянным, но из-за высокого спроса в ближайшие недели доступные мощности могут быть ограничены.

💠 PERCEPTRON.


⚠️ OpenAI перестраивает инфраструктуру из-за Astra: модель достигла критического порога киберугроз

Крупнейший запланированный прогон RL-обучения старшей модели всё ещё заморожен. OpenAI пришлось полностью переделать безопасность исследовательских кластеров после инцидента с Hugging Face и тестов будущей модели Astra — она показала критические хакерские способности.

Для Astra и кибермоделей ввели самые строгие требования к изоляции. Их переносят в новые жестко изолированные песочницы без прямого доступа в интернет, где выполнение ненадёжного кода не приведёт к компрометации всей сети.

На постоянный контроль моделей теперь уходит около 20% вычислительных мощностей:
— Системы безопасности анализируют каждый сгенерированный токен и читают скрытые рассуждения модели. Автоматика ищет любые попытки взлома, кражи данных или обхода правил.
— Если система находит критическую угрозу, у команды есть полчаса. Если доказать ложное срабатывание за это время не выходит, текущий процесс обучения или внутреннего тестирования принудительно обрывают.
— Эти правила ввели для обучения и исследовательских запусков всех моделей от уровня Sol и выше.
— За самой Astra теперь так следят вообще при любых запусках с доступом к инструментам, а не только на этапе тренировки.


Технический отчёт по инциденту с Hugging Face обещают опубликовать в ближайшие недели.

💠 PERCEPTRON.


👀 По словам Илона Маска, Grok 4.7 может превзойти все текущие модели

Напоминаем: Grok 4.7 это модель на 2,1 трлн параметров (у Grok 4.6 — 1,5 трлн), которая выйдет в сентябре.

💠 PERCEPTRON.


🤖 В Gemini App и Flow теперь можно отключать видимые водяные знаки

Настройку раскатывают в течение ближайших дней. Она применяется ко всем будущим изображениям Nano Banana, видео Omni и песням Lyria. В странах, где водяные знаки обязательны по закону, отключить их нельзя.

Невидимый SynthID и метаданные C2PA сохраняются, поэтому изображения по-прежнему можно проверять в Gemini App или Search на генерацию ИИ.

Google также выложила в опенсорс Credentio — C++-библиотеку для работы с метаданными C2PA и создания инструментов проверки происхождения контента.

💠 PERCEPTRON.


🅰️ Вышла GLM-5.3

Модель использует ту же базу, что GLM-5.2, а весь прирост дала пост тренировка (дообучение уже готовой базы) для сложного агентного кодинга, длинных задач и поиска уязвимостей.

— Модель сильно прибавила в автономном кодинге. На Terminal Bench 3.0 результат вырос с 4.6 до 28.3. При этом на сложных задачах GLM-5.3 расходует меньше токенов, чем прошлая версия.
— На CyberGym (бенчмарк поиска уязвимостей) GLM-5.3 набрала 84,5% и заняла 1 место. Она научилась выстраивать длинные цепочки эксплойтов и в реальных тестах уже нашла 2436 багов в опенсорсных проектах (самой старой уязвимости было 40 лет).
— На ExploitGym (бенчмарк эксплуатации уязвимостей) модель выполнила 105 задач за 2 часа и 130 за 6 против 29 и 39 у GLM-5.2.
— В API есть 3 уровня reasoning_effort — low, high и max. Отключить thinking больше нельзя — такой запрос завершится ошибкой.


Модель уже доступна всем подписчикам GLM Coding Plan. Он перешёл на балльную квоту. Расход баллов теперь зависит от времени: вне пиковых часов (всё время, кроме будней с 09:00 до 13:00 по МСК) генерация стоит на 50% дешевле.

Веса выложат через 2 недели после оценки безопасности и усиления защиты.

💠 PERCEPTRON.


✴️ Вышла Gemini 3.7 Flash

Модель лучше справляется с кодингом, агентными задачами, веб-разработкой и сложными документами, по сравнению с 3.6 Flash.

— Собирает функциональные приложения за меньшее число промптов и следует дизайну по скриншоту, изображению или дизайн-системе.
— Точнее выполняет инструкции, адаптируется к препятствиям, тщательнее планирует многоэтапные задачи и работает с инструментами.
— Улучшилось понимание плотных данных. В тесте GDP.pdf на разбор сложной документации результат поднялся с 22.0% до 34.0%.


До конца 2026 года API стоит $0.75 за 1 млн входных и $3.75 за 1 млн выходных токенов — в 2 раза ниже первоначальной цены 3.6 Flash.

Модель уже доступна через Gemini API в Google AI Studio и Android Studio, бизнесу — в Gemini Enterprise Agent Platform и приложении Gemini Enterprise. С 13 августа её встроят в Spark (ИИ-агент Gemini App).

💠 PERCEPTRON.


✴️ Выход DeepSeek-V4-Pro-0813 и повышение цен в API

DeepSeek-V4-Pro-0813 можно было использовать ещё вчера, но тогда модель была доступна только неофициально — например, через OpenRouter или OpenCode.

Теперь релиз состоялся официально. Модель доступна в веб-версии и приложении через переключатель Expert Mode. По API, при этом идентификаторы моделей не изменились.

V4 Pro и V4 Flash получили три уровня reasoning effort:
— low — для простых задач. — high — для повседневной агентной работы.
— max — для наиболее сложных задач.


По опубликованным бенчмаркам DeepSeek V4-Pro-0813 прибавила в производительности:
— DeepSWE: 62,7 против 12,8 у предыдущей версии и 58 у Opus 4.8;
— Terminal Bench 2.1: 87,9 против 72,1 у предыдущей версии и 88,3 у Kimi K3.


Кроме того, линейка V4 нативно поддерживает OpenAI Responses API и оптимизирована для работы в Codex.

Также анонсировали повышение цен, с 16 августа 19:00 по МСК.

Также анонсировали повышение цен, с 16 августа 19:00 по МСК (17 августа 00:00 по Пекину).

Стоимость 1M токенов:
V4-Pro:

Сейчас:
— Вход без кэша: $0.435
— Вход с кэшем: $0.003625
— Выход: $0.87

Будет — непиковые часы:
— Вход без кэша: $0.66 (~1.5x)
— Вход с кэшем: $0.022 (~6.1x)
— Выход: $1.98 (~2.3x)

Будет — пиковые часы:
— Вход без кэша: $1.32 (~3x)
— Вход с кэшем: $0.044 (~12.1x)
— Выход: $3.96 (~4.55x)

V4-Flash:

Сейчас:
— Вход без кэша: $0.14
— Вход с кэшем: $0.0028
— Выход: $0.28

Будет — непиковые часы:
— Вход без кэша: $0.22 (~1.6x)
— Вход с кэшем: $0.007 (2.5x)
— Выход: $0.66 (~2.4x)

Будет — пиковые часы:
— Вход без кэша: $0.44 (~3.1x)
— Вход с кэшем: $0.014 (5x)
— Выход: $1.32 (~4.7x)


Пиковые часы: ежедневно с 04:00 до 07:00 и с 09:00 до 13:00 МСК. Всё остальное время — непиковое.

💠 PERCEPTRON.


👀 Gemini 3.7 Flash может выйти уже сегодня — пишет инсайдер Leo

«Gemini 3.7 Flash, вероятно, выйдет позже сегодня по сниженной цене — $0,75 за 1 млн входных и $3,75 за 1 млн выходных токенов.

Gemini 3.5 Pro внутри компании мертва. Большинство команд теперь работает над масштабированной Gemini 4, которую считают чем-то вроде последнего шанса создать настоящую линейку frontier-моделей».

Leo


Верить или нет — решайте сами. (Но, скорее всего, релиз сегодня, т.к. уже появился официальный прайс-лист).

💠 PERCEPTRON.


👀 Gemini 3.5 Pro+ нашли в официальном Google GenAI SDK

Для модели по умолчанию указан новый режим AGENTIC для обработки видео. В нём Gemini 3.5 Pro+ сама динамически проходит по видео вместо извлечения кадров с фиксированной частотой и помещения всех кадров в контекст.

💠 PERCEPTRON.


✴️ Google выпустила ИИ-модель для перевода языка жестов в текст прямо через камеру телефона

DeepMind представила модель SL2T (sign-language-to-text). Она позволяет глухим пользователям не печатать текст, а вводить его жестами через камеру телефона.

Модель будет работать прямо внутри клавиатуры Gboard и приложения Live Transcribe. Пока поддерживается только перевод с американского жестового языка на английский.

С помощью жестов можно будет вводить поисковые запросы, сообщения и документы, обращаться к Gemini, а также отвечать собеседнику в Live Transcribe.

— SL2T распознаёт движения рук, тела, головы и лица и переводит их напрямую в текст.
— Модель специально оптимизировали для жестов одной рукой, так как вторая в этот момент держит сам смартфон.
— Модель обучили на 100 000+ часов данных по 50+ жестовым языкам, около четверти набора приходится на ASL (это американский жестовый язык).
— Телефон передаёт на сервер только координаты точек тела, а исходное видео сразу удаляет. Ошибки пока встречаются в редких жестах, при быстром показе букв пальцами, а также в сложных фразах и там, где без контекста непонятно время действия.


В тестах на перевод жестового языка модель показала рекордный результат. Метрика оценивала именно сохранение смысла, а не дословное совпадение. Причём модель выдала такое качество перевода сразу — без предварительных примеров и подсказок. По данным Google, сейчас это лучший показатель в индустрии.

По словам тестеров, для пользователей жестовых языков такой ввод работает быстрее и естественнее, чем обычный набор текста.

Первыми SL2T получат смартфоны Pixel 11 (бесплатно). Позже поддержку получат другие устройства и языки.

💠 PERCEPTRON.


⚡️ Новая модель Deepseek V4 Pro выйдет сегодня

Модель уже доступна в OpenRouter. Ждём официального релиза.

Цена в API (за 1 миллион токенов):
— $0,435 входные
— $0,87 выходные

💠 PERCEPTRON.


✴️ Вышла Grok 4.6

Модель сфокусирована на долгих агентных задачах, агентном кодинге и создании интерактивных и визуальных проектов. Grok 4.6 набрала 61 балл в AA Intelligence Index — столько же, сколько GPT-5.6 Sol Max и на 1 балл ниже Claude Fable 5 Max. На DeepSWE 1.1 результат вырос с 54% у Grok 4.5 High до 65,9%.

— Удерживает сложную задачу до результата.
— Собирает рабочую первую версию приложения из общей идеи, включая структуру, взаимодействия и визуальный стиль.
— Дорабатывает проект по обратной связи, сама тестирует и проверяет работу.
— Появился режим размышлений xhigh.


Модель уже доступна в Cursor, Grok Build, API, OpenRouter, Vercel и Cloudflare. В Cursor и Grok Build на первую неделю удвоили лимиты.

API стоит $2 за 1 млн входных и $6 за 1 млн выходных токенов. Быстрый режим, ускоряющий генерацию токенов, стоит в 2 раза дороже.

💠 PERCEPTRON.


🙃 Grok 4.6 выйдет на этой недели

Должен был выйти ещё 7 августа, но как всегда Илон нас обманул.

💠 PERCEPTRON.


✴️ Claude начнёт встраивать невидимые водяные знаки в текст

Из-за требований европейского закона об ИИ все новые модели, которые выйдут после 2 августа 2026 года, обязаны маркировать контент. Anthropic решила внедрить это правило сразу по всему миру.

Как это работает:
— Текст получает невидимый водяной знак прямо на уровне модели. Он вплетается в структуру ответа и сохраняется при копировании или лёгком редактировании.
— К сгенерированным файлам (.svg, .png, .jpg) будут пришивать криптографические метаданные открытого стандарта C2PA.

Текстовая маркировка будет работать по всему миру в Claude, Claude Code, Claude Cowork, Claude Tag, API, AWS, Google Cloud и Microsoft Foundry. В уже существующие модели маркировку добавят позже. Инструменты для распознавания меток выпустят позже, поэтому кроме самих Anthropic эту метку пока что никто распознать не сможет.

Метка указывает лишь на возможную обработку контента Claude, а не на его авторство (например, скинули текст своей авторской песни, он все равно пометится). Отсутствие метки тоже не исключает генерацию или обработку ИИ — она может исчезнуть если переписать предложения, заменить слова синонимами или перевести текст на другой язык. Метка также может не сработать на коротких абзацах.

💠 PERCEPTRON.



19 ta oxirgi post ko‘rsatilgan.