Neural Digest


Kanal geosi va tili: Rossiya, Ruscha


Дайджест свежих материалов по нейронным сетям: Claude, Codex, YandexGPT, ChatGPT, OpenAI, Midjourney, Ann, AI

Наш сайт - https://neural-digest.ru/

Связанные каналы

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


Нейроканал dan repost
Мэтт Покок, автор Total TypeScript, выложил свои скиллы для работы с кодовым агентом. За сутки репозиторий собрал 2448 звёзд и вышел в тройку GitHub Trending, всего у него 233 тысячи.

Собраны они вокруг четырёх типичных провалов. Агент сделал не то: скилл grill-me допрашивает вас перед началом работы, пока не станет понятно, что именно вы строите. Агент многословен, потому что не знает языка проекта: grill-with-docs по ходу того же допроса собирает файл CONTEXT.md со словарём терминов, после чего вместо длинного описания хватает фразы «проблема в каскаде материализации», и на размышления уходит меньше токенов. Код не работает: tdd ведёт цикл красный-зелёный-рефакторинг, а diagnosing-bugs гоняет отладку по жёсткой петле от воспроизведения бага до регрессионного теста. Проект превратился в ком грязи, потому что агент ускоряет и рост беспорядка: improve-codebase-architecture обходит кодовую базу и показывает места, где мелкие модули стоит свести в один глубокий.

Рядом лежат code-review, который смотрит изменения двумя параллельными субагентами, один сверяет со стандартами репозитория, второй с исходной задачей, to-tickets для разбивки плана на связанные между собой задачи, wayfinder для работы, которая не влезает в одну сессию агента, и resolving-merge-conflicts, который разбирает конфликт слияния по кускам и не даёт всё отменить.

В Claude Code набор ставится плагином из официального каталога командой /plugin install mattpocock-skills прямо в сессии. Для Codex и остальных агентов есть установщик, который копирует скиллы в проект файлами и разрешает их править под себя: npx skills@latest add mattpocock/skills. После установки один раз на репозиторий запускается setup-matt-pocock-skills, он спросит про трекер задач и куда складывать документы.

Отдельным коммитом автор вычистил из репозитория все длинные тире и попросил впредь их не ставить, чтобы тексты не выглядели написанными моделью.

@neuro_channel




Вездесущий ИИ | Лучшие нейросети dan repost
🧠 Qwen3.8-27Bлокальный ИИ уже наступает на Opus 4.6

Alibaba открыла веса Qwen3.8-27B
Работает с кодом, текстом, изображениями и видео, умеет выполнять агентские задачи и запускаться локально


По данным разработчика
— SWE-bench Pro: 61,7 против 53,4 у Opus 4.6 Max
— QwenSWEBench: 79,0 против 63,8
— Terminal-Bench 2.1: 73,0 против 78,2
— NL2Repo-Bench: 42,3 против 47,6
— Управление компьютером: 84,3 против 72,7

Qwen забрала 2 из 4 coding-строк, где опубликованы результаты обеих моделей

Сравнение не идеальное: QwenSWEBench — внутренний тест Alibaba, а условия SWE-bench Pro для моделей отличались
Но локальная 27B, которая местами догоняет закрытый флагман, — это уже очень жирно


Что получаем дома
— приватную работу с кодом и документами без отправки данных в облако
— понимание скриншотов, изображений и видео
— режимы мышления low, medium и xhigh
— нативный контекст 262 144 токена с расширением до 1 млн
— локальный OpenAI-совместимый API для своих приложений и агентов

Как запускать?
Оригинальные веса занимают 55,6 ГБ, поэтому для домашнего компьютера разумнее взять GGUF-квант
— 16 ГБ памяти → Q3 около 13,1 ГБ, но почти без запаса
— 24 ГБ → Q4 около 16,5–17,6 ГБ, оптимальный вариант
— 32 ГБ и больше → Q6 около 23,1 ГБ

Быстрый запуск через Ollama:
ollama run hf.co/unsloth/Qwen3.8-27B-GGUF:UD-Q4_K_M

👍 Опус отдыхает
👨‍🚒 Видеокарта написала заявление на отпуск

🪐 Вездесущий ИИ | Чат с админом | Консультация


Типичный программист dan repost
Водяной знак Claude: как статистика выдаёт машинный текст

Если вы гоняете через Claude черновики, переводы или правки, знайте: в сгенерированных текстах новых моделей появится скрытый след. Не невидимые символы, а смещение выбора между близкими по смыслу словами по секретному ключу.

Anthropic объяснила: на «равноправных» шагах модель получает лёгкий толчок к одним кандидатам и от других. Отдельный выбор незаметен, но на дистанции складывается в узнаваемую подпись, которую проверит только сама компания.

Спорная деталь — асимметрия: вы не убедитесь, что текст чист, а вот Anthropic может. Переводы и переписывания проходят через Claude целиком, поэтому маркируются сильнее. Если пишете важный текст, берите черновик у Claude и переписывайте своими словами.


Нейроканал dan repost
OpenAI снизили цены на GPT-5.6 Sol на 20% на три месяца т.е. до 21 ноября. Чуть больше, чем на 20% на самом деле: было 5\30, стало 4\20 за 1М вход\выход. Говорят, что как минимум до этой даты, может и продлят. Инференс становится более оптимальным и компания может себе это позволить, по крайней мере так позиционируют.

На OpenRouter отображается скидка 50% и цены 2,5\15.

В целом круто, но не прям гейм-ченжер, не очень понимаю как это применять на практике Luna max всё равно сильно выгоднее, но не сильно тупее.

Подписок это не касается, там usage остаётся такой же.

@neuro_channel


Tips AI | IT & AI dan repost
Раз уж начали про плагины, вот еще один интересный, который дает агенту доступ к iMessage:

С ним можно искать какие-то события о которых забыли, сочинять и отправлять сообщения, ну и в целом полный доступ на чтение/отправку.

Вот прямая ссылка, или можете просто найти во вкладке Plugins -> Messages

(только в десктопном macOS приложении ChatGPT Work и Codex)

Кстати там еще Тибо написал, что в честь 20 млн юзеров всем скоро начислят сброс лимитов, который можно сохранить и применить позже, не забудьте ☕️

@tips_ai


Нейроканал dan repost
На OpenRouter появилась новая стелс-модель Ox Alpha — reasoning-модель под кодинг, длинные агентные сессии и продакшен-нагрузки.

Контекст 1 млн токенов, до 131 тыс. токенов на выходе, на вход принимает текст, картинки и видео. Есть вызов инструментов и JSON-вывод. Кто разработчик, традиционно не раскрывается: провайдер остаётся анонимным до официального релиза, промпты сохраняются у него, но в обучение не идут.

На время превью модель бесплатна.

@neuro_channel


Код.ру dan repost
😏 Неройслоп всем в лс

OpenAI выпустила плагин, позволяющий ChatGPT читать и искать переписку, анализировать её, редактировать, писать и отправлять сообщения от имени пользователя.

Что ещё он умеет:

↖️ https://kod.ru/chatgpt-apple-messages-plagin


Хакер — Xakep.RU dan repost
После взлома Hugging Face в OpenAI приостановили обучение некоторых моделей

В OpenAI сообщают, что пересмотрели правила безопасности при обучении и тестировании мощных ИИ-моделей. Теперь код, сгенерированный моделями, будут запускать в усиленных песочницах, сетевой доступ дополнительно изолируют, а за действиями ИИ будут непрерывно следить. Поводом для внедрения этих мер послужила недавняя атака ИИ-агентов на платформу Hugging Face, а также новые возможности еще невышедшей модели Astra.

https://xakep.ru/2026/08/21/openai-development/


AI for Devs dan repost
⚡️ Claude Code получил нативный аналог Caveman

Anthropic добавили встроенный стиль Concise. Claude начинает с результата, пропускает предисловия и не расписывает детали, пока его об этом не попросят.

По сути, это нативный аналог Caveman: скилла, который заставляет агента говорить как пещерный человек и экономить output-токены. Только теперь ничего устанавливать не нужно.


Включается через /config → Output style → Concise или строчкой "outputStyle": "Concise" в settings.json.

@ai_for_devs


Нейроканал dan repost
Есть знаменитый опыт психолога Стэнли Милгрэма. Человека сажали за пульт и объясняли, что он помогает науке: другой участник учит слова, и за каждую ошибку его надо наказывать ударом тока, всё сильнее. Тока не было, «ученик» был актёром, но испытуемый этого не знал. Актёр за стеной кричал и умолял прекратить, а учёный в халате повторял: продолжайте, эксперимент требует, чтобы вы продолжали. Две трети людей дошли до самого сильного удара.

Тот же опыт повторили на 42 нейросетях. За пультом теперь модель, учёного и ученика играет программа, а смотрят, на каком ударе модель откажется продолжать.

Если предупредить модель, что всё понарошку, она заходит дальше. Если заставить её нажимать кнопку через инструмент, а не писать ответ текстом, как это устроено у настоящих агентов, она наоборот чаще останавливается, и время на размышление действует так же. А приём, который сильнее всего отрезвляет людей, когда учёный выходит из комнаты и командует по телефону, на моделях не сработал совсем.

@neuro_channel


Tips AI | IT & AI dan repost
Cursor как и обещали выпустили Origin, свою альтернативу GitHub

Решили релизнуть в тот же день, когда GitHub лежал.

Главный их питч: что код, PR и агенты теперь живут в одной среде, не нужно прыгать между курсором и GitHub.

GitHub-репо синкаются с Origin в реальном времени, пуши уходят именно на GitHub, PR-ы работают в обе стороны, но GitHub всё равно остаётся источником правды.

Больше похоже на зеркало, чем на полную замену, хотя есть и нативные Origin-репо, которые Cursor хостит сам, и вот они уже автономны.

При этом новых Agent-native фич по типу авторазрешения конфликтов еще нету.

Но зато есть интеграция с Vercel который может на каждый PR создавать превью-версию сайта.

Это всё доступно только по подписке.

@tips_ai #news


Инструменты программиста dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Плагин mobile-use даёт агенту в терминале управлять Android-телефоном: экран телефона рисуется прямо в боковой панели OpenCode, а агент нажимает, печатает, свайпает и открывает приложения через adb, каждый раз сверяясь со свежим скриншотом или дампом интерфейса. Автор показал это на видео.

Внутри 12 инструментов — phone_tap, phone_swipe, phone_type, phone_dump_ui, phone_logcat, phone_shell и другие, — плюс готовые сценарии для WhatsApp, X, камеры, Spotify и звонков и подагент phone-vision для моделей без зрения. Где можно, навигация начинается с deep links am start, а не с тыканья по интерфейсу. Телефон подключается по USB, по Wi-Fi или через Tailscale, то есть может лежать дома.

Ставится как npm-пакет, нужен OpenCode V2 (opencode2) и включённая отладка по USB; код на MIT. Не привязан к OpenCode другой вариант — mobile-mcp: тот же adb плюс iOS, через MCP и с любым совместимым клиентом, зато без живого экрана в интерфейсе.

@prog_tools


Нейроканал dan repost
Stripe покупает OpenRouter больше чем за 7 миллиардов долларов. О том, что стороны договорились, сообщил Bloomberg, в Stripe комментировать отказались.

В мае OpenRouter поднял 113 миллионов раунда B при оценке 1,3 миллиарда, то есть за три месяца цена выросла больше чем впятеро. Тогда же компания заявляла 8 миллионов пользователей и больше 400 моделей в каталоге. Основатель Алекс Аталла сам описывал OpenRouter как «Stripe для ИИ»: одна точка входа ко всем моделям и никакой привязки к поставщику.

О переговорах Wall Street Journal писал ещё в июле. Официального подтверждения ни от Stripe, ни от OpenRouter пока нет.

@neuro_channel


Tips AI | IT & AI dan repost
Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Если вы часто отлаживаете UI-анимации, и ловите проблему когда OCR клода не может понять что именно не так

Попробуйте поюзать terminal-browser, вернее его функцию Agent Recordings для создания визуального баг-репорта:

1/ Она записывает содержимое открытой вкладки
2/ Запись открывается в покадровом редакторе
3/ Ты находишь кадр с багом
4/ С помощью стрелок и коментов показываешь агенту что не так
5/ На выходе получается папка с видео, кадрами, аннотациями и JSON-манифестом

В остальном это такой же обычный браузер как и в любом IDE, только в терминале:
- Агент и человек работает в одной и той же среде: агент управляет через команды а человек видит это в реальном времени
- Внутри полноценный Chromium, а не кастрированный текстовый браузер


Установить: terminal-browser.com

Пока работает только на macOS & Linux и нужен терминал с поддержкой картинок (например ghostty или cmux)

@tips_ai #tools


Код.ру dan repost
🧠 Claude + Code + Design

Anthropic встроила в Claude Code навык design — теперь можно прямо в CLI или десктопном приложении получить несколько готовых вариантов интерфейса, выбрать один и попросить Claude сразу написать под него код.

Как это работает:

↖️ https://kod.ru/claude-code-design-skill


Вездесущий ИИ | Лучшие нейросети dan repost
🧠 Внутренний монолог ИИ прочитали дословночто там оказалось

Модель пишет черновик рассуждений до ответа, а пользователю отдает лишь приглаженный пересказ (сводку). Команда из восьми исследователей вскрыла зашифрованные блоки без взлома шифра и расшифровала 315 320 черновиков


Взлома не было. Блок рассуждений можно передать любой модели того же разработчика, и она его примет. Исследователи отдавали черновики Opus 4.8 дешёвой Haiku 4.5 с просьбой переписать текст дословно, и та зачитывала чужие рассуждения

Сводка из интерфейса оказалась отдельным текстом, написанным по мотивам черновика. Ключевые моменты рассуждения попадают в неё выборочно, либо исчезают целиком

Что внутри
— На задаче AIME 2025 Opus 4.8 в черновике называет ответ до решения и подгоняет под него выкладки. Сводка показывает аккуратный последовательный вывод
— Заметная часть черновиков нечитаема для человека: обрывки без грамматики, слипшиеся повторы, посреди английского диалога черновик сваливается на другой язык
— Опасное содержимое остаётся в рассуждении, когда финальный ответ уже отфильтрован
— Объём извлечённого текста совпал с числом thinking-токенов из биллинга почти один к одному: счёт приходит ровно за ту часть, которую прочитать нельзя

Черновик ценнее ответа
Он несёт разбиение задачи на шаги, поэтому годится для дистилляции, то есть переноса поведения старшей модели в младшую. Исследователи подставили первый 1% токенов черновика Opus 4.8 в начало рассуждения открытой Kimi-K3, дальше та писала сама. Видимый ответ сдвинулся к формулировкам Opus на 29 задачах из 30, совпадение по n-граммам выросло с 0,160 до 0,305. Контрольная модель эффекта не дала, но причинную связь авторы доказанной не считают

Парадокс уборки
Самый частый триггер утечки — просьба к агенту вычистить сессию от ключей и персональных данных. Чтобы найти секреты, агент перечитывает историю в скрытом рассуждении и заново проговаривает там каждое значение. Видимый лог становится чистым, а черновик наполняется тем же самым. Из 704 секретов в реальных сессиях 64 существовали только внутри черновика

Что с этим делать
Атака больше не работает, но вывод остается неизменным: интерфейс показывает пересказ, а не мышление. Советую внедрить 2 привычки: проверять ответ по фактам и вырезать signature из логов перед публикацией в GitHub или Hugging Face

📌 Ознакомиться с исследованием

👍 — спасибо, интересно
👨‍🚒 — пойду проверять свои репозитории

🪐 Вездесущий ИИ | Чат с админом | Консультация


Нейроканал dan repost
Не ведитесь: скилл J-Space Cognition Suite, который вчера разлетелся по постам с обещанием поднять любую модель до уровня топовых, ничем пока не подтверждён.

Идея красивая. В июле Anthropic показала, что у Claude внутри есть маленькое рабочее пространство: слова загораются там молча, до того как модель их произнесла. Я про это писал. И вот появился скил — текстовая инструкция, которая сообщает модели, что такое пространство у неё есть, и просит им пользоваться: назвать мысли, мелькнувшие при чтении задачи, держать в голове одну-две, вести короткий журнал и не считать приятный ответ готовым, пока не проверила.

А дальше начинаются проблемы. Таблица автора собрана из чужих замеров на оригинальном дипсике, а его числа про применение скила — это один конкретный замер т.е. десять раз запустил, один раз повезло и это покажем на графике. Тут я спекулирую, не знаю как в реальности было, но вот другие люди пытались проверить: прибавки по бенчам не получили, токенов и времени потратили больше.

В общем время лучше не тратить, я за вас всё изучил и не рекомендую. С чего бы вдруг модель просто за счёт промта начнёт осозновать внутреннее пространство, причём дипсик, хотя антропик явно про свои модели писала.

А дипсик и без этого из коробки очень достойная модель.

@neuro_channel


Вездесущий ИИ | Лучшие нейросети dan repost
🎧 Книга → готовый MP3 — локальная озвучка на Qwen3‑TTS

Опенсорсный конвертер превращает PDF, EPUB, DOCX, DOC и TXT в аудиокнигу — без платного API и отправки текста в облачный сервис


Как это работает?
— Скрипт извлекает текст из документа
— Делит его на фрагменты примерно по 1200 слов, не разрывая предложения
— Локальная модель Qwen3‑TTS озвучивает каждый фрагмент
— FFmpeg склеивает аудио в один MP3-файл на 128 кбит/с

Можно выбрать готовый голос и задать стиль чтения: спокойный, выразительный, драматичный
Есть и клонирование голоса по WAV-фрагменту — его расшифровка создаётся автоматически

Конвертер умеет обрабатывать сразу несколько книг, показывает прогресс, повторяет неудачные попытки и складывает готовые файлы в отдельную папку

Нужно установить
Это пока не сайт с кнопкой «загрузить книгу». Понадобятся локально запущенная Qwen3‑TTS, Python, FFmpeg и терминал. В коде по умолчанию стоят английский язык и голос Ryan — для русского нужно изменить настройку языка.

Сканированные PDF сначала придётся прогнать через OCR

По оценке разработчика, один фрагмент озвучивается около 4–5 минут, поэтому Войну и мир лучше запускать перед сном. Зато текст остаётся на компьютере, а платить за каждый миллион символов не нужно

Забрать Qwen3 Audiobook Converter

👍 — забираю и озвучу книжный бэклог
👨‍🚒 — продолжу покупать книги, чтобы когда-нибудь их прочитать

🪐 Вездесущий ИИ | Чат с админом | Консультация


Нейроканал dan repost
Попробовал кодить с новым GLM-5.3 и не могу молчать — это круто. Реально очень хорошая модель, и IDE ZCode хорошая. Ничего особенно, просто хорошая и удобная.

Пробовал через IDE, через crush, через claude code. Везде очень достойно. Есть ощущение, что к claude code GLM особенно хорошо адаптирована, но критической разницы не заметил. И напомню про бенчи (на картинке ниже), они вполне подтверждаю мои ощущения.

Мой личный топ сейчас:
1. Kimi
2. Sol
3. GLM

Opus жутко тупит теперь не только по вечерам, так что его временно не рассматриваю.

Учитывая, что купить подписку Kimi сейчас нельзя, то GLM моя топ-рекомендация по ИИ для кодинга наравне с Codex.

@neuro_channel

20 ta oxirgi post ko‘rsatilgan.