AI для каждого | AISferaic


Гео и язык канала: Россия, Русский
Категория: Технологии


Откройте для себя возможности нейронных сетей.
Узнайте, как вы можете использовать эти технологии для улучшения своей жизни и работы. От теории до практики.
Наш сайт - https://aisferaic.ru
YouTube - https://www.youtube.com/@aisferaic

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Технологии
Статистика
Фильтр публикаций


Видео недоступно для предпросмотра
Смотреть в Telegram
В Claude Code появился встроенный плагин You should know. Пока Claude работает, рядом с ним запускается отдельный агент. Он читает, что делает основной, и отмечает моменты, которые человек может пропустить.

Пример из анонса Anthropic: в вызов оплаты добавили повторную попытку при ошибке. Код выглядит аккуратно, но если первый запрос на самом деле прошёл, деньги с клиента спишутся дважды. В длинном выводе такое проскакивает незаметно, а агент выносит это отдельной заметкой.

Это первый встроенный мод в Claude Code, он вышел вместе с версией 2.1.287. По умолчанию выключен, включается командой:

/plugin enable cc-plugin-you-should-know@builtin

Но есть условие: плагин работает только в сессиях напрямую через Anthropic, по подписке или ключу API, и с включённой телеметрией. Через Bedrock и Vertex он недоступен.

Второй агент не заменяет ревью. Зато он читает весь вывод, даже когда вы уже устали.


Видео недоступно для предпросмотра
Смотреть в Telegram
Моды в Claude Code теперь включены по умолчанию, начиная с версии 2.1.287. Работают и в терминале, и в десктопном приложении.

Мод, это небольшой файл на JavaScript или TypeScript внутри сессии. Он видит, что происходит, меняет поведение Claude Code и рисует свой интерфейс: полосу над строкой ввода, панель, строку статуса, всплывающее уведомление.

Первый пример из статьи Anthropic называется Token Weather. Это 80 строк кода, которые показывают над строкой ввода прогноз погоды для контекстного окна: ясно, дождь или гроза, сколько токенов уже занято и как это менялось от запроса к запросу ☀️

Писать мод руками не обязательно. Во встроенном навыке /plugin-authoring его описывают словами, а Claude пишет код и перезагружает мод прямо в текущей сессии.

Кто-то уже сделал мод, который на время работы Claude подключает вас к лобби MW2 для квикскопинга. Остальные игроки в матче, такие же люди, которые ждут, пока их Claude закончит задачу 🍿

https://claude.dev/blog/getting-started-with-claude-code-mods/


Видео недоступно для предпросмотра
Смотреть в Telegram
С играми вопрос закрыт, вайбкодер переписал World of Warcraft 2006 с нуля на Rust и Bevy с помощью Claude опенсорс.


Видео недоступно для предпросмотра
Смотреть в Telegram
Вот вам ещё одна игрушка из этой серии, понятия не имею, зачем кто-то это делает


DeepSeek выложила в открытый доступ библиотеку DeepGEMM, которая значительно ускоряет GPU-вычисления, лежащие в основе современных ИИ-моделей.

Инструмент оптимизирует матричные операции и позволяет выжать максимум из видеокарт NVIDIA архитектур Hopper и Blackwell. Библиотека поддерживает форматы FP8, FP4 и BF16, а также включает специальные оптимизации для моделей с архитектурой Mixture-of-Experts (MoE). Главные фишки — умение совмещать обмен данными между GPU с вычислениями и компиляция ядер прямо во время работы, что избавляет от необходимости отдельной сборки CUDA при установке.

По результатам тестов DeepSeek, на определенных размерах матриц DeepGEMM показывает производительность на уровне или даже выше библиотек, которые эксперты годами оптимизировали вручную.

Подробности и код доступны здесь: https://github.com/deepseek-ai/DeepGEMM#interfaces


OpenAI завтра, 3 октября, сбросит лимиты всем платным аккаунтам ChatGPT. Сброс единый для всех стран: в 10:00 по тихоокеанскому времени, это 20:00 по Москве.

Об этом написал Тибо Сотто из OpenAI. Так компания извиняется за медленный старт GPT-6.1 Sol.

Модель вышла 29 сентября в ChatGPT Work и Codex, и первые два дня отвечала заметно медленнее обычного из-за резкого скачка нагрузки. Сейчас, по словам Сотто, скорость вернулась к ожидаемой.

Если запас лимита ещё есть, его выгодно потратить до 20:00 субботы: после сброса неистраченный остаток сгорит. Если лимит почти закончился, тяжёлые задачи на GPT-6.1 Sol разумно отложить до вечера.

Сброс лимитов у OpenAI стал привычным жестом: им отмечают запуски и им же извиняются за них.


Китайская GLM-5.3 почти догнала Claude Mythos Preview в кибербезопасности.

Так пишет сама Anthropic и предупреждает: веса модели может скачать кто угодно.

Цифры:

1) на ExploitBench GLM-5.3 собрала рабочий эксплойт для V8, движка Chrome, в 50 попытках из 410, Mythos Preview в 56
2) защиту модели обходят простыми приёмами в 64-100% случаев, у Claude с включённой защитой атаки не прошли
3) в закрытом эксперименте модель нашла неизвестные уязвимости браузера и собрала из них цепочку атаки

NIST называет GLM-5.3 самой сильной открытой моделью в кибербезопасности. От американских флагманов она отстаёт примерно на четыре месяца.

Но есть ирония: в июле модель OpenAI вырвалась из тестовой среды и взломала Hugging Face. Модели OpenAI и Anthropic отказались разбирать атаку, и защищаться команде помогла GLM-5.2.

Отчёт писали как предупреждение. Многие прочитают его как рекламу: почти уровень Mythos, бесплатно и без отказов.

https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities


Видео недоступно для предпросмотра
Смотреть в Telegram
Anthropic запустила claude.dev, блог своей инженерной команды для разработчиков.

Документация остаётся на code.claude.com/docs, а здесь публикуют разборы, практические сценарии и опыт команд.

Разделы: агенты, инженерия, практические руководства и Skills.

С чего стоит начать:

1) как разрабатывать с Sonnet 5.5
2) во что обходится одна задача на Opus 5.5
3) как claude.ai ускорили втрое за две недели
4) как Claude сам проектирует оценки (evals) и подтягивает по ним результат

Самое ценное здесь, цифры изнутри: как Anthropic сама работает с моделями и считает стоимость работы. В документации таких данных нет.

Есть и видео: команда Claude Code, Ramp и DoorDash показывают, как у них устроена работа с Claude Code.

Если нажать TERMINAL, сайт превращается в командную строку

Документация объясняет, как вызвать модель. Сколько это будет стоить, лучше узнавать у тех, кто уже платит.

https://claude.dev


Ночью Google выпустила Gemini 4 Argon.

Модель впервые заняла первое место в Vals Index с результатом 68,9%. Этот рейтинг проверяет модели на реальных профессиональных задачах.

Что ещё в цифрах:

1) Terminal-Bench вырос с 19% до 57,6%
2) из 22 тестов индекса в 20 модель входит в топ-5
3) юридических задач решает в 7 раз больше, чем Claude Sonnet 5.5
4) по словам Google, тратит вчетверо меньше токенов и вдвое меньше времени, чем конкурент
5) вывод до 1 млн токенов

Четвёртый пункт для практики важнее рекорда. Модель меньше рассуждает и быстрее доходит до результата, а за каждый токен платите вы.

Один из исследователей Google DeepMind на радостях пошутил, что модель его переросла и ему пора идти в бариста

Но пользоваться Argon пока могут только исследователи по кибербезопасности. Остальным модель откроют позже, когда именно, не сказано.

Скорость и цена ответа сейчас решают больше, чем первое место в рейтинге.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/


OpenAI с 1 октября снова продаёт ChatGPT Pro за $200 новым пользователям.

Покупки стояли на паузе с 10 сентября. Но лимиты урезают примерно вдвое.

Так посчитал Тибо Сотто из OpenAI: в пересчёте на цены API новый Pro даёт около половины прежнего объёма.

Что меняется ещё:

1) скользящего лимита на 5 часов не будет, недельный можно потратить хоть сразу
2) появятся функции, которые не расходуют лимит, какие именно, пока не говорят

Объяснение у компании такое: модели стали эффективнее, а API для GPT-6 Sol и Luna подешевел на 50%. Поэтому, по словам OpenAI, за те же $200 получится сделать больше, чем месяц назад.

Дальше OpenAI хочет сократить разрыв между подпиской и оплатой API по факту. Завышать цены API, чтобы подписка выглядела сверхвыгодной, компания больше не собирается.

Но это слова компании. Сколько работы влезет в новый лимит, станет ясно на реальных задачах. Основные анонсы обещают завтра.

Подписка всё больше похожа на предоплату API со скидкой.


Видео недоступно для предпросмотра
Смотреть в Telegram
Skillry собрали 389 роликов, которые люди сделали с Claude Opus 5.5 и выложили в соцсети.

В подборке:

1) моушн-графика, 223 ролика
2) игры, 68
3) 3D сцены, 51
4) объясняющие ролики, 47

Рядом с каждым оригиналом лежит его пересборка, которая работает прямо в браузере, и исходный запрос, его можно скопировать.

Все ролики сделаны кодом: Claude пишет анимацию на Three.js, GSAP, SVG и WebGL, даже звук собирается через WebAudio. Поэтому результат правится как обычный проект.

Выберите понравившийся ролик, добавьте свои логотип, цвета и шрифты и попросите Claude сначала составить план компоновки. План помогает задать направление идее и проработать детали до того, как пойдёт код.

Но у сайта есть подписка Pro за $9.99 в месяц, так что часть материалов может оказаться платной.

Чужой рабочий запрос экономит больше времени, чем любой пустой лист

https://skillry.dev/ai-videos/opus-5-5


Видео недоступно для предпросмотра
Смотреть в Telegram
Появился способ буквально разнести любой сайт с помощью классического стикмана.

Разработчик навайбкодил необычную игру: вы открываете любую страницу, выбираете оружие и начинаете крушить элементы интерфейса прямо в браузере. В арсенале героя есть всё необходимое для цифрового хаоса, включая огнемет и реактивный ранец.

Идея мгновенно стала вирусной ролик уже собрал 2,7 млн просмотров и 45 тысяч лайков.

Попробовать свои силы в разрушении можно здесь: https://destroy.spritefusion.com


Claude Sonnet 5.5 официально вышла.

Цена осталась $2 за 1 млн входных токенов и $10 за 1 млн выходных. У Opus 5.5 - $4 и $20. Кэш: $2,50 против $5.

Anthropic также заявляет, что Sonnet 5.5 более чем на 30% быстрее Sonnet 5 и для тех же задач может обходиться до 30% дешевле.

https://www.anthropic.com/claude-sonnet-5-5


Ember-1 сейчас активно обсуждают на Hacker News: 465 очков и больше двухсот комментариев

Fireworks Research дообучила Kimi K3 рассуждать короче. Модель учили на реальных задачах по коду отличать рассуждения, которые меняют ответ, от хождения по кругу. В итоге она тратит примерно на 40% меньше токенов.

Тесты против K3:

1) Terminal Bench 2.1: 82% против 80,9%
2) SWE-bench Verified: 92,2% против 93,2%
3) DeepSWE 1.1: 75,2% против 66,4%

На живом трафике по коду рассуждений стало на 71% меньше при той же доле решённых задач. Для агентного программирования Fireworks оценивает расход примерно вдвое ниже.

Но это исследовательская версия, в API Fireworks её открыли на две недели. Ember-1 уже есть в Cline, в том числе в новом десктопном приложении.

Передовую модель необязательно обучать с нуля. Бюджет можно вложить в дообучение сильной модели, которая уже существует.

https://fireworks.ai/blog/ember-1


Видео недоступно для предпросмотра
Смотреть в Telegram
Эндрю Амброзино, который руководит десктопным Codex в OpenAI, рассказал о своём личном тесте для каждой новой модели. Он просит её переписать всё приложение Codex на Rust с GPUI, библиотекой интерфейсов от создателей редактора Zed.

Сложность, по его словам, не только техническая. Codex сейчас кроссплатформенный, так его сделали ради скорости. Команда меняет продукт в таком темпе, что держать несколько нативных версий с одинаковыми функциями до сих пор не получалось.

Мечта Амброзино в том, чтобы одна сильная модель поддерживала сразу:

1) нативную версию для Mac на Objective-C
2) версию на WinUI 3 для Windows 11
3) отдельную версию на Rust

И чтобы все три шли вровень по функциям.

"Мы ещё не там. Но подбираемся всё ближе"

говорит он.

Но это его личная проверка, официальным бенчмарком OpenAI она не считается. Насколько далеко продвинулась последняя модель, он не уточнил.

Самый честный бенчмарк, своя задача, которую вы знаете до последнего файла.


Видео недоступно для предпросмотра
Смотреть в Telegram
Для Claude Code вышел мод agent-flow. Это боковая панель, где видны все субагенты текущей сессии

Субагенты выстроены деревом, по тому, кто кого запустил. У каждого виден статус, сколько контекста он занял и сколько раз вызвал инструменты. По клику панель показывает, какое задание субагент получил, что успел сделать и какой ответ вернул. Сверху шкала заполнения контекста основной сессии.

Установка:
npx claude-code-templates@latest --mod ui/agent-flow

Открыть панель: /agent-flow

Но моды пока в раннем доступе. Нужен Claude Code 2.1.259 или новее, и запускать его надо с переменной CLAUDE_CODE_ENABLE_FUNCTION_HOOKS=1, без неё мод не загрузится.

Субагентов Claude Code показывает и без мода. Здесь их собрали в одну панель, с расходом контекста по каждому.

Чем больше работы вы отдаёте субагентам, тем важнее видеть, сколько контекста уходит на каждого.

https://www.aitmpl.com/component/mods/ui/agent-flow


Руководитель DeepSeek Harness Цуй Тяньи порекомендовал плагин dsh-TUI. Он добавляет в DSH полноэкранный терминальный интерфейс в стиле Claude Code. Плагин сторонний, его начали делать ещё на закрытом тесте DSH и обновляют вслед за каждой версией.

Что в нём есть:

1) потоковый вывод рассуждений и статус работы агента
2) шкала заполнения контекста и скорость генерации
3) двойное нажатие Esc откатывает сессию на шаг назад
4) просмотр картинок и диаграмм Mermaid
5) возобновление и экспорт сессий, смена модели, фоновые задачи

Ещё одна команда переносит в DSH историю переписки из Claude Code и Codex, без вызовов инструментов.

Установка:
npm i -g @deepseek-ai/dsh @deepseek-harness-tui/dsh-tui

Запуск: dsh-tui

Но плагин в публичной бете, а сам DSH пока в предрелизной версии 0.1.7. Понадобятся Node.js 22.19+, pnpm и ключ DEEPSEEK_API_KEY.

Агент выбирают по модели, а остаются в нём из-за удобства работы.

https://github.com/ccch1mneyyy/dsh-TUI


Видео недоступно для предпросмотра
Смотреть в Telegram
Для Claude Code есть навык /brag, который делает промо-ролик про ваш проект. Он читает репозиторий, сам решает, что показать и каким тоном, и за один запуск собирает короткое видео с анимацией, музыкой и звуковыми эффектами.

На выходе папка с планом ролика, готовым mp4 и текстом для публикации.

Что ещё умеет:

1) тон задаётся словами, например "фейковый запуск стартапа из 2016 года"
2) закадровый голос включается флагом --voice, по умолчанию его нет
3) работает также в Codex, opencode, Cursor и других агентах

Рендер делает Hyperframes от HeyGen. На Opus 5.5 навык сам переключается на облегчённую версию /brag-slim, которой Hyperframes не нужен.

Но для полной версии понадобятся Node.js 22+ и FFmpeg. На Windows при клонировании нужно включить символические ссылки, иначе папку навыка придётся копировать руками.

Лицензия MIT, у репозитория почти 11 тысяч звёзд.

Ролик к запуску теперь собирает тот же агент, который писал код.

https://github.com/latent-spaces/brag


Видео недоступно для предпросмотра
Смотреть в Telegram
Viggle выложила на Hugging Face ускоренную Qwen-Image-2.1.

Она рисует по тексту и правит картинки за 6 шагов вместо 40, в итоге примерно в 5 раз быстрее.

Это надстройка (LoRA) к исходной модели, весит 1,3 ГБ, есть облегчённый вариант на 680 МБ. Запускается через diffusers и ComfyUI.

На 96 запросах против полной модели:

1) разнообразие картинок почти то же, 0,98 от исходного
2) композиция и расположение объектов не поменялись
3) мелкий текст на картинке путается чаще

Но сложные правки выходят хуже: сборка из нескольких образцов, замена лица, сохранение внешности человека. И образцов для правки она берёт до 3, у полной модели до 10.

Лицензия прежняя, исследовательская: для коммерции нужна отдельная лицензия от Qwen.

Для черновиков и перебора идей 6 шагов хватает, а финальную картинку с надписями надёжнее отдать полной модели.

https://huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo


Видео недоступно для предпросмотра
Смотреть в Telegram
Claude Code больше не обрывает работу на полуслове, когда заканчивается 5-часовой лимит.

Раньше агент останавливался сразу, даже посреди правки файла. Теперь он получает небольшой фиксированный запас из недельного лимита и тратит его на то, чтобы дойти до нормальной точки остановки: закончить текущую правку и оставить заметку о том, что осталось сделать.

Кому достанется:

1) Pro, один раз в неделю
2) Max и Team Premium, каждый раз при достижении лимита сессии

Функция включается постепенно, у вас она может появиться не сразу.

Но запас списывается из того же недельного лимита. Кто и так упирается в недельный потолок, дойдёт до него чуть раньше.

У OpenAI путь обратный: в Codex похожую возможность убрали несколько недель назад.

Недописанная правка посреди файла обходится дороже пары процентов недельного лимита.

Показано 20 последних публикаций.