🌅 AI-сводка, четверг 10 сентября
Исследователь ушёл из Anthropic со словами «играют нашими жизнями», а лид по безопасности ответил «он прав». Пять историй и Apple.
Anthropic: лид по алайменту даёт больше 10 %, что ИИ убьёт всех
Джейкоб Коксон, 27 лет, три года претрейна в OpenAI и Anthropic, уволился 8 сентября. Обе компании, по его словам, несутся к самоулучшающемуся сверхинтеллекту, внутри это считают всерьёз, а публично смягчают. Эван Хубингер, лид по алаймент-науке Anthropic, ответил открыто. «Джейкоб прав, мы правда верим, что ИИ может убить всех людей. Лично я даю больше 10 % в ближайшие десять лет. Плана по алайменту сверхинтеллекта у нас пока нет». Следом уточнил, что нынешние модели опасности не несут, страх про систему, которая улучшает себя сама.
Я строю бизнес на их моделях и читаю это без паники. Плана нет у них, значит план нужен мне. У каждого агента свой ключ и лимит, а обязательное правило живёт в хуке, который блокирует отправку, а не в просьбе в промпте.
Тред Коксона · Ответ Хубингера · Разбор
DeepSeek: V4.1 Flash выходит сегодня, Pro отправляют на пенсию
С 09:00 по Ташкенту новые цены Flash-серии. Ввод при попадании в кэш $0,003 за миллион вместо $0,0075, минус 60 %. Промах кэша $0,15 вместо $0,23, вывод $0,60 вместо $0,68, в пиковые часы вдвое дороже. Главное в другом. Все запросы к V4 Pro DeepSeek перенаправляет на V4.1 Flash по цене Flash, отдельной Pro пока не будет.
У меня flash пишет черновики для директоров, и главный расход там как раз перечитанный контекст. Минус 60 % на кэш - это моя строка в счёте. Проверю 4.1 на стенде.
Цены · Маршрутизация Pro · HN
Anthropic: почистил промпт - минус 14,6 % к счёту
Anthropic выпустила разбор, как резать расходы на Claude. Старые костыли в промптах мешают новым моделям. «Отвечай максимально подробно» давало десятки лишних поисков по базе, принудительный черновик рассуждений ронял вызовы инструментов. После команды /claude-api prompt-audit в тесте на задачах поддержки стоимость упала на 14,6 %, точность выросла на 5,3 %. Fable 5.1 на низком effort даёт на CursorBench 3.2 то же, что Fable 5 на высоком, втрое дешевле. Временная метка в системном промпте сбрасывает весь кэш.
Вчера я разбирал расход одного директора. 230 тысяч входных токенов на ход, рекорд 1,84 млн, кэш ноль, потому что контекст перечитывается на каждом из 12 вызовов инструментов. $51 за сутки на весь флот. Первое дело утра - prompt-audit по своему CLAUDE.md.
Статья · Разбор
Meta Muse: агент с собственным компьютером
8 сентября Meta выпустила персонального агента Muse. Живёт в постоянно включённой изолированной Linux-машине со своим браузером, файлами и терминалом. Пишет код, заполняет формы, бронирует, покупает, ведёт переговоры от имени владельца. Рядом всегда второй агент Sentinel, который одобряет каждый выход в интернет. Модель Muse Spark, бесплатный тариф и подписки, пока только США, внутри WhatsApp тоже.
Это архитектура моих директоров один в один. Контейнер, терминал, браузер и сторож рядом. Разница в том, что у Meta агент на человека, у меня на компанию. Дойдёт до WhatsApp в Ташкенте - прямой конкурент моей «Миле Ташкент».
Meta · Пост
Microsoft tgrep: поиск по коду для агентов в 50 раз быстрее
Rust, открытый код. Индексируешь проект один раз, дальше поиск почти мгновенный. Copilot CLI уже использует его внутри. Самый пересылаемый пост дня, 1 150 репостов.
GitHub · Пост
📱 Apple: 14 сентября iOS 27 и Siri AI - бета, только английский, дневные лимиты, расширенный доступ за деньги, в ЕС на айфонах нет. Складной iPhone Duo от $1 999, продажи 23 октября. Разбор · Лимиты · Duo
🇺🇿 Местное: UEnter набирает в инкубатор Green Youth Cup по зелёным технологиям, победители едут на Web Summit Qatar, заявки до 22 сентября - подать. Сегодня бесплатный эфир Виталика Урбана (Moonly) про ИИ-нейтив маркетинг - регистрация.
Кто гонял prompt-audit на своём CLAUDE.md - сколько срезало?
#AIновости #2026_09_10
Исследователь ушёл из Anthropic со словами «играют нашими жизнями», а лид по безопасности ответил «он прав». Пять историй и Apple.
Anthropic: лид по алайменту даёт больше 10 %, что ИИ убьёт всех
Джейкоб Коксон, 27 лет, три года претрейна в OpenAI и Anthropic, уволился 8 сентября. Обе компании, по его словам, несутся к самоулучшающемуся сверхинтеллекту, внутри это считают всерьёз, а публично смягчают. Эван Хубингер, лид по алаймент-науке Anthropic, ответил открыто. «Джейкоб прав, мы правда верим, что ИИ может убить всех людей. Лично я даю больше 10 % в ближайшие десять лет. Плана по алайменту сверхинтеллекта у нас пока нет». Следом уточнил, что нынешние модели опасности не несут, страх про систему, которая улучшает себя сама.
Я строю бизнес на их моделях и читаю это без паники. Плана нет у них, значит план нужен мне. У каждого агента свой ключ и лимит, а обязательное правило живёт в хуке, который блокирует отправку, а не в просьбе в промпте.
Тред Коксона · Ответ Хубингера · Разбор
DeepSeek: V4.1 Flash выходит сегодня, Pro отправляют на пенсию
С 09:00 по Ташкенту новые цены Flash-серии. Ввод при попадании в кэш $0,003 за миллион вместо $0,0075, минус 60 %. Промах кэша $0,15 вместо $0,23, вывод $0,60 вместо $0,68, в пиковые часы вдвое дороже. Главное в другом. Все запросы к V4 Pro DeepSeek перенаправляет на V4.1 Flash по цене Flash, отдельной Pro пока не будет.
У меня flash пишет черновики для директоров, и главный расход там как раз перечитанный контекст. Минус 60 % на кэш - это моя строка в счёте. Проверю 4.1 на стенде.
Цены · Маршрутизация Pro · HN
Anthropic: почистил промпт - минус 14,6 % к счёту
Anthropic выпустила разбор, как резать расходы на Claude. Старые костыли в промптах мешают новым моделям. «Отвечай максимально подробно» давало десятки лишних поисков по базе, принудительный черновик рассуждений ронял вызовы инструментов. После команды /claude-api prompt-audit в тесте на задачах поддержки стоимость упала на 14,6 %, точность выросла на 5,3 %. Fable 5.1 на низком effort даёт на CursorBench 3.2 то же, что Fable 5 на высоком, втрое дешевле. Временная метка в системном промпте сбрасывает весь кэш.
Вчера я разбирал расход одного директора. 230 тысяч входных токенов на ход, рекорд 1,84 млн, кэш ноль, потому что контекст перечитывается на каждом из 12 вызовов инструментов. $51 за сутки на весь флот. Первое дело утра - prompt-audit по своему CLAUDE.md.
Статья · Разбор
Meta Muse: агент с собственным компьютером
8 сентября Meta выпустила персонального агента Muse. Живёт в постоянно включённой изолированной Linux-машине со своим браузером, файлами и терминалом. Пишет код, заполняет формы, бронирует, покупает, ведёт переговоры от имени владельца. Рядом всегда второй агент Sentinel, который одобряет каждый выход в интернет. Модель Muse Spark, бесплатный тариф и подписки, пока только США, внутри WhatsApp тоже.
Это архитектура моих директоров один в один. Контейнер, терминал, браузер и сторож рядом. Разница в том, что у Meta агент на человека, у меня на компанию. Дойдёт до WhatsApp в Ташкенте - прямой конкурент моей «Миле Ташкент».
Meta · Пост
Microsoft tgrep: поиск по коду для агентов в 50 раз быстрее
Rust, открытый код. Индексируешь проект один раз, дальше поиск почти мгновенный. Copilot CLI уже использует его внутри. Самый пересылаемый пост дня, 1 150 репостов.
GitHub · Пост
📱 Apple: 14 сентября iOS 27 и Siri AI - бета, только английский, дневные лимиты, расширенный доступ за деньги, в ЕС на айфонах нет. Складной iPhone Duo от $1 999, продажи 23 октября. Разбор · Лимиты · Duo
🇺🇿 Местное: UEnter набирает в инкубатор Green Youth Cup по зелёным технологиям, победители едут на Web Summit Qatar, заявки до 22 сентября - подать. Сегодня бесплатный эфир Виталика Урбана (Moonly) про ИИ-нейтив маркетинг - регистрация.
Кто гонял prompt-audit на своём CLAUDE.md - сколько срезало?
#AIновости #2026_09_10