AI для каждого | AISferaic


Гео и язык канала: Россия, Русский
Категория: Технологии


Откройте для себя возможности нейронных сетей.
Узнайте, как вы можете использовать эти технологии для улучшения своей жизни и работы. От теории до практики.
Наш сайт - https://aisferaic.ru
YouTube - https://www.youtube.com/@aisferaic

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Google выпустила EmbeddingGemma 2, открытую модель для эмбеддингов. Она переводит текст, код, картинки, видео и аудио в векторы одного пространства. Поэтому можно, например, голосовой заметкой найти нужный кусок видео.

740 млн параметров, лицензия Apache 2.0. Модель собрана из модулей: для текста хватает 270 млн, зрение и звук подключаются по желанию.

Рассчитана на запуск прямо на устройстве. На Pixel 11 Pro после квантования ей нужно около 191 МБ памяти для текста и около 567 МБ для всех модальностей.

Код она понимает заметно лучше первой версии: 78,7 против 68,8 на MTEB Code.

Вместе с Gemma 4 из неё собирается полностью локальный RAG: поиск по вашим файлам, где данные никуда не уходят.

Но языков заявлено больше 100, и Google сама предупреждает, что качество на них неодинаковое. Русский стоит проверить на своих данных.

Для llama.cpp уже есть версия GGUF от Unsloth.

https://huggingface.co/google/embeddinggemma-2
https://huggingface.co/unsloth/embeddinggemma-2-GGUF


Жирный котяра уже здесь 🍿

Mistral показала Mistral Large 4. Неофициально модель зовут Le Chonk, то есть "толстяк".

1) 1 трлн параметров, из них на каждый токен работает 49 млрд
2) 61,7% на DeepSWE в задачах программирования
3) в слепой оценке кода обходит GLM-5.3 и Kimi K3, уступает только Claude Opus 5
4) по словам команды, лучшая среди открытых моделей в кибербезопасности, финансах и производстве
5) открытые веса обещают до конца октября

В API модель уже доступна в режиме предварительной версии.

Но в рейтинге Artificial Analysis у неё 38 баллов, столько же, сколько у GPT-6 Luna. При этом токены Luna стоят $0,10 и $0,50 за миллион, а у Mistral $1,36 и $4,18. Разница в 8-13 раз.

Самое сильное место модели, кибербезопасность. В тесте, где нужно воспроизвести реальную уязвимость и закрыть её, Le Chonk набрала 82%. Opus 5.5 и GPT-6 Astra там почти на нуле, потому что отказываются от задачи.

https://mistral.ai/news/mistral-large-4/


Видео недоступно для предпросмотра
Смотреть в Telegram
GTA 5 портировали на WebAssembly с помощью ИИ. Мы живём в самой безумной реальности. 💀

Но её уже снесли.


Подписка Claude сейчас даёт в 5,6 раза больше работы за те же деньги, чем ChatGPT. Так посчитали аналитики SemiAnalysis

Они взяли основные модели обеих компаний, Opus 5.5 и GPT-6.1 Sol, и пересчитали полностью израсходованный месячный лимит в цену того же объёма через API:

1) за $200: Claude Max 20x даёт $11 726, ChatGPT Pro $2 084
2) за $100: Claude $5 725, ChatGPT $1 055
3) за $20: Claude $1 178, ChatGPT $211

Claude возвращает около 58 стоимостей подписки, ChatGPT около 10.

Разрыв вырос после 29 сентября, когда OpenAI вдвое урезала лимиты тарифа Pro за $200. На Sol он раньше давал $5 904, теперь $2 084.

Но Sol дешевле Opus за токен. Если считать только количество токенов, Claude впереди почти втрое: 28,6 млрд против 10,2 млрд в месяц на тарифе за $200. А у Claude есть ещё пятичасовое окно лимитов, у тарифов Pro от OpenAI его нет.

Лимиты компании меняют в любой день, так что перед покупкой цифры стоит перепроверить.

https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x


Astra и GPT-6.1 Sol теперь должны работать примерно в полтора раза быстрее выдавать около 50 токенов в секунду вместо прежних ~30.


Немецкая Aleph Alpha выложила открытую модель Kolibri-1. Веса на Hugging Face, лицензия Apache 2.0, языки немецкий и английский.

Всего в ней 78 млрд параметров, но на каждый токен работает только 3,46 млрд. Поэтому по скорости ответа она ближе к маленьким моделям.

По замерам самой компании:

1) 96,9% в немецкой версии олимпиадной математики AIME 2025
2) 84,3% на сложных научных вопросах GPQA Diamond
3) по тестам на немецком чуть выше GPT-OSS 120B и Qwen3.5 35B-A3B
4) в программировании слабее: 66,4% на SWE-Bench Verified против 73,8% у Qwen3.6

Учили модель с китайской помощью: данные для дообучения генерировали GLM от Z.ai и Qwen от Alibaba.

Но в память всё равно загружаются все 78 млрд, это около 80 ГБ. На домашнюю видеокарту она не поместится.

Сильную открытую модель можно сделать не только в США и Китае. Правда, учителя у неё всё равно китайские 😉

https://huggingface.co/Aleph-Alpha/Kolibri-1


Видео недоступно для предпросмотра
Смотреть в Telegram
В Claude Code появился встроенный плагин You should know. Пока Claude работает, рядом с ним запускается отдельный агент. Он читает, что делает основной, и отмечает моменты, которые человек может пропустить.

Пример из анонса Anthropic: в вызов оплаты добавили повторную попытку при ошибке. Код выглядит аккуратно, но если первый запрос на самом деле прошёл, деньги с клиента спишутся дважды. В длинном выводе такое проскакивает незаметно, а агент выносит это отдельной заметкой.

Это первый встроенный мод в Claude Code, он вышел вместе с версией 2.1.287. По умолчанию выключен, включается командой:

/plugin enable cc-plugin-you-should-know@builtin

Но есть условие: плагин работает только в сессиях напрямую через Anthropic, по подписке или ключу API, и с включённой телеметрией. Через Bedrock и Vertex он недоступен.

Второй агент не заменяет ревью. Зато он читает весь вывод, даже когда вы уже устали.


Видео недоступно для предпросмотра
Смотреть в Telegram
Моды в Claude Code теперь включены по умолчанию, начиная с версии 2.1.287. Работают и в терминале, и в десктопном приложении.

Мод, это небольшой файл на JavaScript или TypeScript внутри сессии. Он видит, что происходит, меняет поведение Claude Code и рисует свой интерфейс: полосу над строкой ввода, панель, строку статуса, всплывающее уведомление.

Первый пример из статьи Anthropic называется Token Weather. Это 80 строк кода, которые показывают над строкой ввода прогноз погоды для контекстного окна: ясно, дождь или гроза, сколько токенов уже занято и как это менялось от запроса к запросу ☀️

Писать мод руками не обязательно. Во встроенном навыке /plugin-authoring его описывают словами, а Claude пишет код и перезагружает мод прямо в текущей сессии.

Кто-то уже сделал мод, который на время работы Claude подключает вас к лобби MW2 для квикскопинга. Остальные игроки в матче, такие же люди, которые ждут, пока их Claude закончит задачу 🍿

https://claude.dev/blog/getting-started-with-claude-code-mods/


Видео недоступно для предпросмотра
Смотреть в Telegram
С играми вопрос закрыт, вайбкодер переписал World of Warcraft 2006 с нуля на Rust и Bevy с помощью Claude опенсорс.


Видео недоступно для предпросмотра
Смотреть в Telegram
Вот вам ещё одна игрушка из этой серии, понятия не имею, зачем кто-то это делает


DeepSeek выложила в открытый доступ библиотеку DeepGEMM, которая значительно ускоряет GPU-вычисления, лежащие в основе современных ИИ-моделей.

Инструмент оптимизирует матричные операции и позволяет выжать максимум из видеокарт NVIDIA архитектур Hopper и Blackwell. Библиотека поддерживает форматы FP8, FP4 и BF16, а также включает специальные оптимизации для моделей с архитектурой Mixture-of-Experts (MoE). Главные фишки — умение совмещать обмен данными между GPU с вычислениями и компиляция ядер прямо во время работы, что избавляет от необходимости отдельной сборки CUDA при установке.

По результатам тестов DeepSeek, на определенных размерах матриц DeepGEMM показывает производительность на уровне или даже выше библиотек, которые эксперты годами оптимизировали вручную.

Подробности и код доступны здесь: https://github.com/deepseek-ai/DeepGEMM#interfaces


OpenAI завтра, 3 октября, сбросит лимиты всем платным аккаунтам ChatGPT. Сброс единый для всех стран: в 10:00 по тихоокеанскому времени, это 20:00 по Москве.

Об этом написал Тибо Сотто из OpenAI. Так компания извиняется за медленный старт GPT-6.1 Sol.

Модель вышла 29 сентября в ChatGPT Work и Codex, и первые два дня отвечала заметно медленнее обычного из-за резкого скачка нагрузки. Сейчас, по словам Сотто, скорость вернулась к ожидаемой.

Если запас лимита ещё есть, его выгодно потратить до 20:00 субботы: после сброса неистраченный остаток сгорит. Если лимит почти закончился, тяжёлые задачи на GPT-6.1 Sol разумно отложить до вечера.

Сброс лимитов у OpenAI стал привычным жестом: им отмечают запуски и им же извиняются за них.


Китайская GLM-5.3 почти догнала Claude Mythos Preview в кибербезопасности.

Так пишет сама Anthropic и предупреждает: веса модели может скачать кто угодно.

Цифры:

1) на ExploitBench GLM-5.3 собрала рабочий эксплойт для V8, движка Chrome, в 50 попытках из 410, Mythos Preview в 56
2) защиту модели обходят простыми приёмами в 64-100% случаев, у Claude с включённой защитой атаки не прошли
3) в закрытом эксперименте модель нашла неизвестные уязвимости браузера и собрала из них цепочку атаки

NIST называет GLM-5.3 самой сильной открытой моделью в кибербезопасности. От американских флагманов она отстаёт примерно на четыре месяца.

Но есть ирония: в июле модель OpenAI вырвалась из тестовой среды и взломала Hugging Face. Модели OpenAI и Anthropic отказались разбирать атаку, и защищаться команде помогла GLM-5.2.

Отчёт писали как предупреждение. Многие прочитают его как рекламу: почти уровень Mythos, бесплатно и без отказов.

https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities


Видео недоступно для предпросмотра
Смотреть в Telegram
Anthropic запустила claude.dev, блог своей инженерной команды для разработчиков.

Документация остаётся на code.claude.com/docs, а здесь публикуют разборы, практические сценарии и опыт команд.

Разделы: агенты, инженерия, практические руководства и Skills.

С чего стоит начать:

1) как разрабатывать с Sonnet 5.5
2) во что обходится одна задача на Opus 5.5
3) как claude.ai ускорили втрое за две недели
4) как Claude сам проектирует оценки (evals) и подтягивает по ним результат

Самое ценное здесь, цифры изнутри: как Anthropic сама работает с моделями и считает стоимость работы. В документации таких данных нет.

Есть и видео: команда Claude Code, Ramp и DoorDash показывают, как у них устроена работа с Claude Code.

Если нажать TERMINAL, сайт превращается в командную строку

Документация объясняет, как вызвать модель. Сколько это будет стоить, лучше узнавать у тех, кто уже платит.

https://claude.dev


Ночью Google выпустила Gemini 4 Argon.

Модель впервые заняла первое место в Vals Index с результатом 68,9%. Этот рейтинг проверяет модели на реальных профессиональных задачах.

Что ещё в цифрах:

1) Terminal-Bench вырос с 19% до 57,6%
2) из 22 тестов индекса в 20 модель входит в топ-5
3) юридических задач решает в 7 раз больше, чем Claude Sonnet 5.5
4) по словам Google, тратит вчетверо меньше токенов и вдвое меньше времени, чем конкурент
5) вывод до 1 млн токенов

Четвёртый пункт для практики важнее рекорда. Модель меньше рассуждает и быстрее доходит до результата, а за каждый токен платите вы.

Один из исследователей Google DeepMind на радостях пошутил, что модель его переросла и ему пора идти в бариста

Но пользоваться Argon пока могут только исследователи по кибербезопасности. Остальным модель откроют позже, когда именно, не сказано.

Скорость и цена ответа сейчас решают больше, чем первое место в рейтинге.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/


OpenAI с 1 октября снова продаёт ChatGPT Pro за $200 новым пользователям.

Покупки стояли на паузе с 10 сентября. Но лимиты урезают примерно вдвое.

Так посчитал Тибо Сотто из OpenAI: в пересчёте на цены API новый Pro даёт около половины прежнего объёма.

Что меняется ещё:

1) скользящего лимита на 5 часов не будет, недельный можно потратить хоть сразу
2) появятся функции, которые не расходуют лимит, какие именно, пока не говорят

Объяснение у компании такое: модели стали эффективнее, а API для GPT-6 Sol и Luna подешевел на 50%. Поэтому, по словам OpenAI, за те же $200 получится сделать больше, чем месяц назад.

Дальше OpenAI хочет сократить разрыв между подпиской и оплатой API по факту. Завышать цены API, чтобы подписка выглядела сверхвыгодной, компания больше не собирается.

Но это слова компании. Сколько работы влезет в новый лимит, станет ясно на реальных задачах. Основные анонсы обещают завтра.

Подписка всё больше похожа на предоплату API со скидкой.


Видео недоступно для предпросмотра
Смотреть в Telegram
Skillry собрали 389 роликов, которые люди сделали с Claude Opus 5.5 и выложили в соцсети.

В подборке:

1) моушн-графика, 223 ролика
2) игры, 68
3) 3D сцены, 51
4) объясняющие ролики, 47

Рядом с каждым оригиналом лежит его пересборка, которая работает прямо в браузере, и исходный запрос, его можно скопировать.

Все ролики сделаны кодом: Claude пишет анимацию на Three.js, GSAP, SVG и WebGL, даже звук собирается через WebAudio. Поэтому результат правится как обычный проект.

Выберите понравившийся ролик, добавьте свои логотип, цвета и шрифты и попросите Claude сначала составить план компоновки. План помогает задать направление идее и проработать детали до того, как пойдёт код.

Но у сайта есть подписка Pro за $9.99 в месяц, так что часть материалов может оказаться платной.

Чужой рабочий запрос экономит больше времени, чем любой пустой лист

https://skillry.dev/ai-videos/opus-5-5


Видео недоступно для предпросмотра
Смотреть в Telegram
Появился способ буквально разнести любой сайт с помощью классического стикмана.

Разработчик навайбкодил необычную игру: вы открываете любую страницу, выбираете оружие и начинаете крушить элементы интерфейса прямо в браузере. В арсенале героя есть всё необходимое для цифрового хаоса, включая огнемет и реактивный ранец.

Идея мгновенно стала вирусной ролик уже собрал 2,7 млн просмотров и 45 тысяч лайков.

Попробовать свои силы в разрушении можно здесь: https://destroy.spritefusion.com



Показано 19 последних публикаций.