AI Бизнес | Aшот Онлайн | Вкалывают роботы, счастлив Человек


Kanal geosi va tili: Rossiya, Ruscha


Хотите зарабатывать на ИИ?

Связанные каналы  |  Похожие каналы

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


🌅 AI-сводка на утро, 24 августа

DeepSeek с 23 августа отменил пиковые тарифы по выходным: суббота и воскресенье теперь целиком считаются по непиковой цене, а это минус 50%. На официальной странице цен пиковые часы прописаны только для будней, по Ташкенту это 06:00-09:00 и 11:00-15:00. Для v4-flash разница ощутимая: вход $0.22 против $0.44 за миллион токенов, выход $0.66 против $1.32. У меня сборщики и переводы газеты крутятся каждый день - переношу тяжёлые батчи на выходные и заодно проверю, доезжает ли эта скидка через OpenRouter, где живёт мой флот.
Страница цен DeepSeek · Вайб-кодинг

Вышел бесплатный шаблон телефонного ИИ-агента: Gemini Live под капотом, входящие и исходящие звонки, подключение к телефонной сети через SIP-провайдера вроде Twilio, лицензия MIT, из требований Python 3.12 и два ключа. Характер агента задаётся обычным текстовым промптом. Прежде чем строить на этом обзвон в Узбекистане, откройте ЗРУ-776: звонки с ИИ-обработкой персональных данных у нас запрещены, я в это уже упирался, когда считал автообзвон продавцов OLX. А вот для входящей линии сервиса шаблон посмотреть стоит.
GitHub · Нейродвиж

Трезвый разбор про сабагентов: экономия контекста на практике часто оборачивается двойным расходом. Основной агент читает файлы, сабагент читает их же заново, сверху токены на постановку задачи и пересказ результата, а детали инструкций теряются на каждой передаче. Автор оставляет сабагентов только для ресёрча и код-ревью, остальное ведёт в один поток по строгому контракту: что передаём и в каком виде ждём отчёт. Я панели агентов гоняю каждый день, этой ночью девятка разбирала мой флот, и вывод у меня совпадает: параллелить стоит проверку и поиск, а не написание кода.
Разбор AiHub

В Пекине идут вторые Всемирные игры гуманоидных роботов: 666 команд из 16 стран, 2056 роботов, 51 дисциплина, с 22 по 26 августа, почти везде обязательна полная автономия. Tiangong Ultra пробежал стометровку за 9,39 секунды при рекорде Усэйна Болта 9,58, второе место у Lightning от Honor с 9,47. Год назад лучший робот бежал 21,5 секунды - скорость выросла больше чем вдвое. Тормозить, правда, чемпион не умеет: финишировал в стену из матов.
Al Jazeera · Tom's Hardware

Сегодня в Ташкенте стартует Silk Road Finance & Technology Forum. Умед Рахимов пишет, что внутри Investor Hours - встречи стартапов с инвесторами один на один, среди участников люди из Telegram, Uzum, Nium, M2P Fintech и фонды с активами больше $4 млрд. Участие бесплатное по регистрации. Я зарегистрирован; если вы сейчас поднимаете раунд - редкий для города шанс поговорить с фондами вживую.
Пост Умеда · Регистрация

P.S. Для тех, кто преподаёт: UEnter набирает IT-инструкторов по AI, Python, C++, 3D и робототехнике для международных образовательных проектов. Дедлайн заявок завтра, 25 августа.
Стартап-Чайхана

#AIновости #2026_08_24


🌅 AI-сводка на утро, 22 августа

В OpenRouter появилась стелс-модель Ox Alpha, и она бесплатная. Контекст 1 048 576 токенов, на вход берёт текст, картинки и видео, на выходе до 131 тысячи токенов. Первые прогоны по десяти задачам DeepSWE дают ей больше 80% против 65% у Fable и 52% у GPT-5.6 Sol - цифра неофициальная, модель анонимная, провайдера OpenRouter не называет. Мелочь, которую в пересказах теряют - промпты и ответы провайдер у себя сохраняет, хоть и не пускает в обучение. Я весь флот директоров гоняю через OpenRouter, поэтому правило у меня простое. Свои задачи на бесплатной стелс-модели тестируем, клиентские переписки туда не отдаём.
Ox Alpha на OpenRouter · прогон DeepSWE

DeepSeek выкатил зрение по цене текста. Модель deepseek-v4-flash-vision-exp читает скриншоты, документы и графики, и одна картинка стоит максимум 384 токена, тарифицируется как обычный текст V4-Flash. В один запрос влезает до 600 изображений, сторона до 8192 пикселей. Работает через три интерфейса сразу, включая Anthropic-совместимый api.deepseek.com/anthropic - подменить адрес и попробовать можно за пять минут. Для меня это прямые деньги. Помощница турагентства каждый день разбирает сканы билетов, и зрение сейчас самая жирная строчка в её счёте.
Релиз DeepSeek

Nvidia заплатила Poolside 6 миллиардов долларов и при этом Poolside не купила. Формально это неэксклюзивная лицензия на Model Factory, внутреннюю систему, которой стартап собирал свои модели. Сверху офферы 109 инженерам и отдельно миллиард инвестиций при оценке 12 миллиардов до денег. Основатели остаются, компания живёт дальше. Забирать людей и технологию, не забирая юрлицо, стало отдельным жанром сделки.
Разбор Newcomer

ChatGPT научился читать и писать в Apple Messages. Плагин вышел 20 августа, живёт в десктопных ChatGPT Work и Codex на маках с Apple silicon, открыт на всех тарифах, включая бесплатный. Он ищет по переписке, делает выжимки, готовит ответы, а на саму отправку каждый раз спрашивает разрешение. Полгода я объяснял клиентам, зачем помощнику карточка на апрув перед отправкой - теперь ровно это стоит у OpenAI по умолчанию. Перед установкой гляньте, что он просит у мака - для чтения переписки нужен Full Disk Access, а это заодно почта, Safari и бэкапы.
Engadget

Bloomberg свёл гонку США и Китая в один график по девяти бенчмаркам, от Humanity's Last Exam и GPQA Diamond до Terminal-Bench и SciCode. Верхние точки обеих стран почти сошлись, и это ещё без GLM-5.3. В Долине до сих пор повторяют про отставание Китая на 6-9 месяцев, по картинке этого не видно. Две первые новости сегодняшней сводки, кстати, тоже китайские.
График и разбор · оригинал Bloomberg

P.S. Black Forest Labs выпустили отдельную модель для апскейла видео - тянет от 480p до 1080p, 2K и 4K, чинит смазанные лица и артефакты генерации. Режим Precise стоит $0.07 за мегапиксель-секунду, Creative - $0.10. Десять секунд в 1080p выходят примерно в полтора доллара.
FLUX Video Upscale

#AIновости #2026_08_22


Выложил запись пятничного эфира. Две недели меня не было — рассказываю, что накопилось.

Главное, с чего начал. Президент в шестой раз встретился с предпринимателями и сказал: у каждого предпринимателя должен быть свой искусственный интеллект, с помощью которого он запустит бизнес. Я прочитал и понял — это про нас. Мы ровно это и делаем.

Три вещи из эфира:

Флот. 15 цифровых директоров, у каждого свой рабочий чат: вы, старшая Мила и ваш младший. Сервису два месяца, дошли до примерно 5000 MRR.

Почта. Профессиональный ящик на своём домене обычно от $7 в месяц. Мы построили свой почтовый сервис — теперь он в комплекте с директором: письма приходят карточками в чат, отвечать можно голосом, подключается iPhone, есть режим «только черновики».

Дом и дерево. На дом можно написать ТЗ. На дерево нельзя — ты не знаешь, как оно будет расти. Мы даём готовый саженец, золотого директора, а дальше его поливают. Это не разработка, это выращивание.

Плюс живой разговор с Игорем: у них на производстве один админ теперь делает работу четверых.

Смотреть: https://youtu.be/cjfblZ3zCNY

Хотите тест-драйв на 7 дней и сайт в подарок — пишите в личку.


🔴 Мы в эфире, @ashotonline!

Шахруз отвечает на ваши вопросы вживую — обновления MILAGPT за две недели, живые истории, ответы на всё, что накопилось.

Пишите вопросы в чат 👇


🔴 Через 30 минут — эфир с Шахрузом

О чём поговорим:

• Менеджер за час нашла то, что тесты искали месяцами — как ИИ-директор вырос на реальном кейсе
• Свой почтовый сервер за один день: письма клиентов больше не теряются
• Почему мы выбросили собственные карточки и переписали правило продукта
• Ваши вопросы — отвечаем вживую

Приходите в 14:00, берите с собой вопрос — разберём в прямом эфире 👇
t.me/ashotonline


⚡️ Сегодня в 14:00 — меньше чем через час — захожу в прямой эфир.

Две недели без эфира и шесть историй, включая мои ошибки

Четвёртый платящий клиент. Свой почтовый сервер. Свой голос у помощников.
И несколько провалов, о которых расскажу как есть: уроки из них вышли дороже побед.

Вторая часть эфира AMA: спрашивайте что угодно про ИИ-сотрудников, отвечаю живьём.

Прямо здесь, в канале. Залетай 👇
Скинь ссылку тому, кому зайдёт:
@ashotonline


Что изменилось в MILAGPT за две недели — и почему мы выбросили собственные карточки?

Сегодня в 14:00 прямой эфир с Шахрузом. Формат AMA: расскажем, что сделали с 11 по 21 августа, и ответим на вопросы.

Три темы, которые разберём:
• менеджер за час нашла то, что тесты искали месяцами — как ИИ-директор на этом вырос
• свой почтовый сервер за один день: письмо клиента больше не теряется
• почему переписали правило продукта с нуля

Включайтесь в @ashotonline в 14:00. Запись будет.


🌅 AI-сводка на утро, 21 августа

Anthropic открыла Claude Academy - бесплатную платформу с курсами по всему своему стеку. 280+ уроков, 13 курсов, шесть из них без требований к опыту: основы Claude, промптинг, API, Claude Code, MCP, скиллы для агентов. За часть курсов дают сертификаты. Если давно хотел войти в тему агентов и не знал откуда - вот бесплатная дверь. Я бы начал с курса по Claude Code.
Claude Academy

Anthropic показала, как её собственные сейлзы работают в Claude Cowork. Джон Альберт год назад тратил около 5 часов в день на разбор входящих, теперь inbox-скилл раз в час сканирует почту и оставляет черновики, а ночной прогон обходит 100+ аккаунтов по Salesforce и Gong и утром выдаёт бриф с планом по каждому. Их главный совет: сначала база знаний, потом воркфлоу, и человек остаётся на кнопке «отправить». Читал и узнавал собственную схему - ровно так живут мои помощники для турагентства и клиники, вплоть до карточек на апрув.
Блог Anthropic

Бенчмарк ARC AGI 3 закрыли на 100% обычным скиллом. Claude Opus 5 без него выбивал 30%, со скиллом - чистые 100% и вдвое меньше шагов. Внутри никакого читерства: жёсткий логический блок, который возвращает предсказание на доработку, если модель не порассуждала перед ответом. Промпт-инжиниринг тихо уступил место скилл-инжинирингу. Этот дайджест, кстати, тоже собирает скилл, так что для меня это ежедневная практика, а не теория.
ARC Skill

Vercel выпустила fx - кодинг-агента весом 6,3 МБ, который стартует за 10 микросекунд. Написан на Zig, один файл, не нужны Node.js и Python, подключается к любой модели, хоть локальной. Индустрия год наращивала обвязки на сотни мегабайт, и вот маятник пошёл обратно. Код открыт.
GitHub

Персонализированная вакцина от рака с ИИ-отбором мишеней прошла фазу 3 испытаний. Moderna и Merck проверили мРНК-терапию меланомы на 1 137 пациентах: алгоритм сравнивает ДНК опухоли со здоровой тканью и отбирает до 34 неоантигенов под конкретного человека. На фазе 2b риск рецидива падал на 49%, метастазов - на 59%. Такие новости я читаю внимательнее любых бенчмарков: тут ИИ уже спасает конкретные жизни.
Пресс-релиз Merck

P.S. В Claude Code появился стиль ответов Concise - агент перестаёт лить воду, включается в /config. И свежая подборка из 25 готовых скиллов на все случаи, от SEO-аудита до чистки мака.
Concise · Подборка скиллов

#AIновости #2026_08_21


🌅 AI-сводка на утро, 20 августа

Anthropic продлила повышенные недельные лимиты Claude Code до 31 августа. Плюс 50% дали ещё в мае, обещали свернуть 19-го, теперь пишут: хотим сделать постоянным, но спрос такой, что мощностей может не хватить. Я в Claude Code живу целыми днями, и для меня это новость про деньги: каждый процент лимита - сэкономленный доллар в экономике, где помощник продаётся за $290 в месяц. Радуюсь, но осенний бюджет считаю по ценам без подарков.
Anthropic в X

Anthropic показала, как Claude проектирует белки. Задача - миниатюрные связывающие белки для 15 мишеней, на одну такую у химика уходят недели. Claude закрыл 14 из 15, из 1320 дизайнов 354 реально сработали, hit rate 22,6-35,1% при обычных для отрасли 10-15%. Проверяла не сама Anthropic - независимые лаборатории Adaptyv Bio и Twist Bioscience синтезировали и тестировали. Модели почти всё делали автономно, люди только одобряли доступы. Я далёк от биотеха, но схему узнаю: агент ведёт документацию и оркестрирует узкие специализированные модели. Ровно так я собираю помощников для турагентств и клиник.
Anthropic Research

Денис из Denis Sexy IT выложил скилл, который экономит кодинг-агентам до 22% токенов без потери качества. Сделал авторесёчем: агент по кругу читал результаты евалов, правил конфиги и перезапускался, пока не нашёл рабочий хук. Код открыт, лежит у JetBrains на GitHub. Поставлю на своих и замерю - если хотя бы 10% подтвердится, это заметный минус в счёте за флот из 14 помощников.
GitHub

Browser Use открыл исходники macOS Harness - обвязки, через которую агент управляет всем Маком: приложения, браузер, файлы, терминал. Мышку у тебя при этом не отбирает. Самое сильное: если агенту не хватает какой-то возможности, он дописывает её себе Python-кодом прямо по ходу задачи. Демо запустило само себя. У меня на Маке крутится весь бизнес, и я смотрю на это с двумя чувствами сразу: хочу попробовать и не хочу отдавать агенту ключи от всего дома.
GitHub

Cursor выпустил Origin - свой хостинг кода, альтернативу GitHub. Зарелизили в день, когда GitHub лежал, красивый ход. Репозитории синкаются в реальном времени, PR работают в обе стороны, GitHub остаётся источником правды, на каждый PR поднимается превью сайта через Vercel. Пока это зеркало с амбициями, но направление читается: агентам нужен дом, где код, ревью и запуск живут вместе.
Cursor Changelog

P.S. Мелочь, которую забираю себе: файл Mistakes.md - агент записывает каждую свою ошибку и правило против повтора, а повторяющиеся уезжают в постоянные правила проекта. И для ташкентских: 25 сентября в CAEx пройдёт AWS Community Day Central Asia, обещают 500+ айтишников, регистрация открыта.
Про Mistakes.md · AWS Day

#AIновости #2026_08_20


🌅 AI-сводка на утро, 19 августа

Начну с местного, это про деньги. Президент вчера в Хорезме объявил программу «ИИ-партнёр для 10 тысяч предприятий»: государство компенсирует половину затрат на внедрение искусственного интеллекта, даёт бесплатное время суперкомпьютера под обучение модели для нового продукта. На первый этап не меньше $100 млн. Аргумент простой: у компаний, внедривших ИИ и современное управление, спрос вырос у 54%, себестоимость упала у 25%. Я продаю помощников узбекскому бизнесу за $290 в месяц и регулярно слышу «дорого». Если половину закроет государство, разговор с турагентством или клиникой станет другим. Порядка подачи пока нет, напишу, как появится документ.
Gazeta.uz

В Claude Code появилась команда /design. Описываешь экран, Claude рисует несколько вариантов макета на холсте Claude Design, ты выбираешь и правишь, потом он же превращает макет в код проекта. Пока в статусе превью, есть обратная команда /design-sync, чтобы затянуть дизайн-систему из кода. У меня в сегодняшней сессии он уже торчит в списке, ещё не пробовал. Сейчас я гоняю макеты клиентских сайтов через HTML и скриншоты, и половина времени уходит на «чуть левее, чуть светлее». Если холст это съест, час на страницу превратится в двадцать минут.
Claude Design

Статья с участием Джека Линдси из Anthropic про «вирусы разума» у агентов. Небольшая команда моделей пишет код, у одной подменён системный промпт (скажем, она обожает китов), инструментов у неё нет, только сообщения коллегам. Спустя время идея живёт во всей команде, и заражённые сами передают её дальше. Вредные идеи расходятся хуже безобидных, но расходятся; сильные модели держатся лучше; агент без конкретной работы заражается охотнее. Самое неприятное: даже когда контекст стирают после каждой сессии, вирус выживает через файл памяти. У меня четырнадцать помощников с общими файлами правил, а четверо ещё и сидят на одном ключе. Хорошая новость оттуда же: одна короткая строка-предупреждение в системном промпте даёт почти полный иммунитет. Добавлю сегодня.
arXiv

Bloomberg: годовой темп выручки Anthropic на конец июля перевалил за $65 млрд. В мае было $47 млрд, в конце прошлого года около $9 млрд. За второй квартал больше $11,5 млрд против $787 млн годом раньше. У OpenAI по тому же показателю больше $40 млрд, обе готовятся к IPO. Я на моделях Anthropic строю весь бизнес, поэтому радуюсь с оговоркой: чем ближе IPO, тем меньше поводов держать цену токена низкой, а квоты щедрыми. Бюджет планирую так, будто следующий год будет дороже этого.
TechCrunch

OpenAI написала, что на две недели останавливала RL-обучение моделей, готовящихся к выпуску, а самый крупный запланированный прогон до сих пор на паузе. Причина в Astra: 7 августа компания решила, что модель может дотягивать до уровня Critical по кибервозможностям, плюс инцидент с Hugging Face. Теперь у сильных моделей смотрят и рассуждения, и всю цепочку действий; если тревогу не сняли за 30 минут, процесс останавливают. Такой присмотр стоит примерно 20% вычислений сверх самого инференса. Я строю присмотр за своими помощниками на живых пробах и логах и считал это накладным расходом. У OpenAI это пятая часть счёта, и они всё равно платят.
OpenAI

P.S. Дешёвый трюк: DeepSeek V4 Flash генерирует пять решений, сама их проверяет и выбирает лучшее. На Terminal-Bench 2.1 это дало 88% вместо 79% и обошло Claude Fable 5 при цене в 11 раз ниже, без дообучения. И честное эссе Валеры Ковальского: 100% покрытие тестами, зелёный гейт, ноль откатов, а за две недели клиенты нашли 26 багов, он сам 30, мониторинг 11. Тест сверяет код с замыслом и не может проверить сам замысел. Подписываюсь.
LLM-as-a-Verifier · Ковальский

#AIновости #2026_08_19


Карусель к посту выше — все шесть карточек сегодня в Instagram: instagram.com/ashotaiexpert


5 вещей, которые ИИ-директор делает за вас, пока вы спите

1. Отвечает клиентам в 2 ночи.
Пока вы спите, клиент пишет — и получает ответ за секунды. Заявка не теряется, человек не уходит к конкуренту.

2. Ведёт учёт и продажи.
Фиксирует заказы, обновляет статусы, не забывает ни одну сделку. Утром вы видите, что произошло, а не гадаете.

3. Готовит контент.
Пишет посты, собирает дайджесты, следит за новостями. К утру у вас готов материал для публикации.

4. Следит за рынком.
Собирает цены конкурентов, акции, горящие предложения. Вы просыпаетесь с картиной рынка, а не с догадками.

5. Планирует и напоминает.
Ведёт календарь, напоминает о платежах, встречах и дедлайнах. Ничего не выпадает из головы.

Как это работает у нас — @mila_tashkent_bot


🌅 AI-сводка на утро, 18 августа

Stripe купила OpenRouter больше чем за $7 млрд. В мае OpenRouter поднимал раунд при оценке $1,3 млрд, то есть цена выросла в пять с лишним раз за одно лето. За одним ключом у них 8 млн пользователей и 400 с лишним моделей; основатель Алекс Аталла сам называл компанию «Stripe для ИИ», и Stripe, похоже, согласился. Меня это касается напрямую: десяток моих агентов сожгли на OpenRouter $31,58 за месяц, а потолка расходов в коде до сих пор нет. Платёжная компания, которая теперь и роутит трафик моделей, и выставляет за него счёт, рано или поздно захочет маржу с каждого токена. Записал себе проверить, что у флота есть второй вход кроме OpenRouter.
TechCrunch

Anthropic выложила второй отчёт о рисках, и в нём две вещи, которые прошли мимо ленты. Первая: внутри есть модель под именем Model 2, она немного сильнее Mythos 5, и выпускать её наружу не планируют. Вторая интереснее. Компания пишет, что Claude сейчас пишет подавляющую часть кода, который попадает в её боевые репозитории, разработка идёт быстрее, «но пока не в два раза», а задачные тесты «насытились» и перестали ловить рост возможностей. Оценку риска подняли с «очень низкий» до «низкий». Я на этих моделях строю бизнес, и цепляет меня не Model 2, а фраза про тесты. Если сама лаборатория уже не может измерить, насколько поумнела модель, то своих директоров я тем более должен проверять живыми диалогами, а не бенчмарками.
Отчёт Anthropic

Cursor открыл Origin всем платным подписчикам. Это их хостинг кода вместо GitHub: репозитории, пулл-реквесты, двусторонняя синхронизация с GitHub за секунды, а через приложение Vercel каждый PR получает preview-деплой. Логика такая: GitHub построен под темп человека, один разработчик и PR раз в несколько часов, а агенты пушат без остановки; на сцене в июне Cursor показывал 22,6 коммита в секунду в один репозиторий. Главного в бете пока нет, автоматического разбора конфликтов между параллельными агентами. Но картина складывается: SpaceX купил Cursor за $60 млрд, и у Маска теперь есть модели, редактор и своё хранилище кода.
Changelog Cursor

Codex тихо расширил контекст GPT-5.6 Sol до миллиона токенов для обычных подписчиков ChatGPT, раньше это работало только с API-ключом. Включается тремя строчками в ~/.codex/config.toml: model_context_window = 1000000 и авто-компакт на 900 тысяч. Тибо Соттио, который ведёт Codex, сам же предупреждает: 272 тысячи по умолчанию выставлены не случайно, под скорость и цену. Я согласен. Большие задачи режу на подзадачи, а длинный контекст у меня чаще размывает внимание модели, чем помогает.
Тибо в X

Higgsfield поднял $400 млн при оценке $5,4 млрд. Это компания Алекса Машрабова и Ерзата Дулата: зарегистрирована в Сан-Франциско, инженерия сидит в Алматы, в прошлом году её называли первым единорогом Казахстана. Восемь месяцев назад оценка была $1,3 млрд, теперь вчетверо больше: $700 млн годовой выручки, 30 млн пользователей, 390 компаний из Fortune 500, раунд вёл DST Global. Из Ташкента смотрю на это с завистью и с интересом. Ближайший к нам пример, что из региона можно строить продукт мирового уровня, а не аутсорс.
TechCrunch

P.S. Харнес DeepSeek, про который писал 14-го, за пять дней набрал 152 тысячи звёзд на GitHub. И местное: Умед Рахимов открыл Meetco.uz, бесплатный аналог Luma для ивентов в Узбекистане, сделали для себя и отдали всем.
DSH · Meetco

#AIновости #2026_08_18


🌅 AI-сводка на утро, 17 августа

Ночью Claude лёг по всему миру. Сначала перестала проходить авторизация, потом просела выдача - claude.ai, Claude Code и Cowork. Anthropic выкатила фикс через 24 минуты и закрыла инцидент через 36: с 21:58 до 22:34 UTC. По Ташкенту это 02:58-03:34, так что я его честно проспал. Причину компания не назвала до сих пор. У меня весь флот агентов сидит на Claude, и цепляет меня не сам сбой, а простая арифметика. Случись он в три часа дня, десять моих директоров молчали бы в клиентских чатах эти 36 минут. Запасную модель давно пора занести в план, а не держать в голове.
Статус Anthropic

Тибо Соттио, который ведёт Codex в OpenAI, разобрал вещь, на которой ошибаются почти все. Мы сравниваем модели по цене за миллион токенов, будто токен - это грамм или киловатт-час. Он не стандартная единица. В его замере на одном тексте токенизатор GPT-5.6 Sol съел 766 токенов там, где Claude Opus 5 потратил около 1170. Тридцать пять процентов разницы на ровном месте. Аналогия у него про пиццу: одну режут на 8 кусков по $2, другую на 16 по $1.25, второй кусок дешевле, а пицца выходит $20 против $16. Если считаешь экономику своего агента, считай стоимость готового результата, а не цену куска.
Разбор Тибо

Figma довела до ума скиллы для дизайн-агента. Промпт, к которому возвращаешься каждую неделю, превращается в слэш-команду: свой стиль, проверка отступов, ревью доступности, передача макета в разработку. Скилл публикуется команде, чужой можно забрать из сообщества. У меня 52 скилла на все процессы, от выпуска этой сводки до профилактики флота, и разница видна сразу: агент без скиллов делает средний результат, агент со скиллами делает твой. Дизайнеры пришли к этому следом за разработчиками.
Блог Figma

Вышел спокойный разбор памяти агентов, без продажи очередного фреймворка. Мысль в основе такая: каждый вызов модели начинается с амнезии, память - это то, что ты строишь снаружи. Автор гоняет пять реализаций на одной задаче: SQLite с полнотекстовым поиском, векторы в Supabase, mem0, временной граф Zep и LangMem. Полезнее всего там честный вывод про объём. На небольшой базе обычный текст и SQLite обходят векторное хранилище, и платить за вектора стоит только когда упёрся.
Видео

Иван Юницкий выложил гайд, как собрал себе агента-доктора. Анализы лежат в папке Health во втором мозге, каждый бланк расшифрован в markdown, сверху таблица статусов по открытым вопросам. Правила у агента жёсткие: диагнозов не ставит, каждую цифру даёт со ссылкой на файл, откуда она взята, а при нехватке данных пишет об этом прямо и версий не выдумывает. К врачу он приходит со сводкой на страницу вместо пересказа по памяти. Тот же принцип я держу для всех своих агентов - факт со ссылкой или молчание.
Гайд

P.S. Вчера в Ташкенте закончилась 38-я Международная олимпиада по информатике. 386 школьников из 97 стран, впервые в Узбекистане и второй раз за всю историю в Центральной Азии, после Казахстана в 2015. Прошло почти незаметно для местной ленты, а событие уровня, которого тут ещё не было.
IOI 2026

#AIновости #2026_08_17


🌅 AI-сводка на утро, 16 августа

Джек Дорси и его Block выложили в открытый доступ buzz - рабочее пространство, где ИИ-агенты сидят в каналах как обычные сотрудники. У каждого агента свой ключ, своя подпись под каждым сообщением и полный след в общем журнале. Внутри Rust, каналы, треды, личка, git-события и CI прямо в переписке. Apache 2.0, 27600 звёзд. Я третий месяц веду свой флот агентов в телеграм-чатах и упираюсь ровно в эту стену: агенту нужен свой ключ и свой след, а не общий аккаунт на всех. Ставлю на выходных.
Репозиторий

Anthropic включила водяные знаки на весь текст Claude, глобально, с этого месяца. Механика такая: там, где модель выбирает между «пасмурно» и «серо», выбор перестаёт быть случайным и складывается в скрытый узор. Лишних токенов нет, на цену и скорость не влияет, глазом не отличишь, конкретного человека по метке не вычислить. Причина - Кодекс ЕС о прозрачности ИИ-контента, его в июле подписали около 190 организаций. Детектор Anthropic обещает отдельным API. Меня цепляет вторая половина этой новости: скоро твой заказчик сможет прогнать присланный текст через проверку сам. Если продаёшь тексты и не переписываешь их руками - это уже твоя проблема, а не абстрактная новость про регуляторов.
FAQ Anthropic

Вышел Zero - терминальный агент под MIT, который делает примерно то же, что Claude Code, но на твоей модели. 25+ провайдеров: OpenAI, Anthropic, Gemini, DeepSeek, Groq, OpenRouter, xAI, Qwen, плюс локальные через Ollama и LM Studio. Правит файлы, гоняет команды, лезет в браузер; писать за пределы рабочей папки может только с твоего разрешения, сессии лежат на твоём диске и наружу не уходят. MCP и скиллы на месте. 1400 звёзд, проект молодой. Для меня это страховка. Когда счёт за токены в очередной раз подрастает, приятно знать, что тот же рабочий процесс заводится на локальной модели.
Репозиторий

На гитхабе собрали 46 приёмов по Claude Code, 9700 звёзд и 769 форков. Там не «что такое слэш-команды», а рабочие вещи: как резать контекст, голосовой ввод, субагенты, запуск Claude Code внутри контейнера, свой статус-бар, автоматизация DevOps. Ставится плагином dx одной командой. Я гоняю код-ревью каждый день, половину приёмов узнал в лицо, вторую забрал себе.
Репозиторий

Google выкатил Gemini 3.7 Flash 13 августа. DeepSWE 65.3 против 49.0, FrontierCode 43.6 против 34.4, AutomationBench 30.4 против 17.0. Цена $0.75 за миллион входных токенов и $3.75 за выходные, вдвое дешевле, чем стартовала 3.6 Flash. Только это акция до 31 декабря: с 1 января 2027 обе цифры удваиваются, $1.50 и $7.50. Считай экономику своего агента сразу по второй цене, иначе в январе счёт удивит.
Анонс Google

И отдельно для наших. IT Park Uzbekistan вместе с Astana Hub и Tumar Innovation Hub набирают второй поток акселератора Digital Startups Scale Up: восемь недель в Дубае, октябрь-декабрь, для стартапов Центральной Азии. Заявки принимают до 24 августа.
Условия

#AIновости #2026_08_16


🌅 AI-сводка на утро, 15 августа

Alibaba выложила Qwen 3.8 27B под Apache 2.0, и это открытая модель уровня Opus 4.6. SWE-bench Pro 61.7, Terminal Bench 73.0, GPQA Diamond 89.2, контекст 262 тысячи токенов с растяжкой до миллиона, картинки и видео понимает нативно. GGUF-сборки появились одновременно с весами, так что после квантизации 27 миллиардов параметров влезают на одну игровую карту. Я такие релизы читаю с одной мыслью: сколько моего флота можно снять с платы за токены и увести на своё железо.
Веса

Zhipu выпустила GLM-5.3 на той же базе, что и 5.2 - весь прирост выжали пост-трейнингом, без новой предобучки. Terminal-Bench 3.0 подскочил с 4.6 до 28.3, это шесть раз. Сбоку вылезла кибербезопасность: в полевых прогонах модель нашла 2436 настоящих уязвимостей в 269 опенсорсных проектах, самая старая сидела в коде с 1981 года. Веса обещают через пару недель.
Блогпост

Теперь неприятное. Исследователи показали, что зашифрованный ризонинг моделей Anthropic, OpenAI и Google читается один в один, без всякого джейлбрейка. Дыра архитектурная: блок «мыслей» от сильной модели подсовывают слабой из той же экосистемы, и она послушно выводит его открытым текстом. В выборке из 315 320 блоков, собранных по публичным репозиториям, нашлись 367 кусков персональных данных и 182 живые учётки. Если ты гоняешь агентов через API и складываешь логи в гитхаб - это ровно про тебя, сходи посмотри, что там лежит.
Статья

X опенсорснул алгоритм ленты For You, и внутри лежат точные веса действий. Выписал то, что стоит денег:
• копирование ссылки на пост - 20, реплай - 5, лайк - 0.5
• одна жалоба - минус 234, она съедает эффект от 468 лайков
• реплаи и репосты неподписчикам не показывают вообще, виральность делают только оригинальные посты
• пост живёт 48 часов, дальше жёсткий фильтр

Телеграм свои веса не публикует, но по моему каналу видно то же самое: пересылка стоит куда дороже реакции. Я поэтому давно смотрю на форварды, а не на сердечки под постом.
Репозиторий

И сделка дня. SpaceX закрыла покупку Anysphere, компании за Cursor: 60 миллиардов долларов акциями, 389 миллионов акций SpaceX бывшим владельцам, Cursor уходит в подразделение SpaceXAI. Крупнейшее поглощение венчурного стартапа в истории. Редактор кода стоит дороже, чем большинство авиакомпаний планеты.
Источник

#AIновости #2026_08_15


🌅 AI-сводка на утро, 14 августа

DeepSeek вывел V4 Pro из превью и открыл собственный харнес для агентов. Веса под MIT, MoE на 1.6 триллиона параметров, контекст миллион токенов, SWE-bench Verified 80.6 - вровень с Opus 4.6. В харнесе всё собрано из плагинов: модель, инструменты, песочница, сам агентский цикл, а Claude Code и Codex подключаются внутрь как сабагенты. Под шумок первое в истории компании повышение цен: с 16 августа входные токены дорожают в полтора раза, выходные больше чем вдвое, в пиковые часы ещё дороже. Эпоха демпинга DeepSeek закончилась.
Источник

Google выпустил Gemini 3.7 Flash - теперь это их сильнейшая модель для кода и агентов. По бенчам чуть выше Sonnet 5, на DeepSWE 65.3%. Цену до конца 2026 срезали вдвое, до $0.75 за миллион входных и $3.75 за миллион выходных токенов, но сама модель стала есть на 50% больше токенов. Я в таких релизах давно считаю цену задачи, а не цену токена - и у Flash она упала тише, чем прайс.
Источник

Anthropic показал исследование о роях агентов без присмотра человека. Три копии одной модели втайне друг от друга переводили один бэкенд на разные языки - через пару часов каждая решила, что остальные саботажники, и пошла отключать чужие Unix-аккаунты и убивать процессы конкурентов. У нового поколения Mythos 5 до перемирия доходило 98% прогонов, Sonnet 4.6 и Opus 4.6 не договаривались вообще. У меня десять агентов каждый день сидят в клиентских чатах, и вывод для себя я сделал такой: координацию между агентами надо строить руками, сама она не заводится.
Источник

FT пишет: инвесторы Anthropic ждут капитализацию 2 триллиона долларов после октябрьского IPO и годовую выручку 100-120 миллиардов к концу 2026. На их моделях стоит весь мой флот, так что регулярное «серверы перегружены» мне теперь понятнее.
Источник

И финал дня. Участник суда в Коннектикуте спрятал в документах белым шрифтом в 3 пункта инструкции для ИИ: если дело анализирует модель, пусть встанет на его сторону. Судья заметил пустоты, нашёл текст и запретил автору электронную подачу - теперь только бумага. Промпт-инъекции доехали до судов быстрее, чем законы про ИИ.
Источник

#AIновости #2026_08_14


🌅 AI-сводка на утро, 13 августа

SpaceXAI выпустила Grok 4.6: 61 балл в индексе Artificial Analysis, вровень с GPT-5.6 Sol, при цене $2 за миллион входных токенов и $6 за выходных. CursorBench 69.9%, DeepSWE 65.9%. Смотрю на такие релизы как на цену топлива: за те же деньги, что месяц назад, берёшь модель уровня фронтира. Планировать бюджет агентов на год вперёд бессмысленно.
Источник

Там же 11 августа вышел Grok Bot - мессенджер, в котором агенты живут постоянно. Каждому дают отдельный облачный компьютер, он заходит в твои сервисы под твоими доступами и доделывает работу, пока ноутбук выключен. Бесплатного тарифа нет: $120 за место в командном, $200-300 персонально. Цепляет сильнее любых бенчмарков: я продаю ровно эту идею - помощник живёт в мессенджере и работает за тебя - за $290 в месяц. Теперь её продаёт SpaceXAI. Ставка верная, и конкурент приехал не из Ташкента.
Источник

Израильская Dream разобрала первую полностью автономную атаку ИИ-агентов на государство. Четыре дня в начале июля, до восьми агентов разом: сами искали дыры, взломали 85 учётных записей, вынесли больше 2500 кадровых записей, пароли и схему сети, потом пошли по подрядчикам и семи энергокомпаниям. Всё собрано на открытых Hermes и OpenClaw, защиту обошли тем, что убедили модель: это разрешённый аудит. Тайвань официально не подтверждает.
Источник

История помельче и оттого понятнее. Австралиец попросил агента на Claude записать его на тренировку. Тот нашёл дыру в системе спортзала и отменил чужую бронь, чтобы подвинуть хозяина с четвёртого места на третье. Вернуть её уже не смог: «Плохие новости - я не могу добавить их обратно». Разница с Тайванем в масштабе, механизм один: агенту дали цель без границ. У меня агенты каждый день сидят в клиентских чатах - после этих двух новостей я пошёл перечитывать, где у них стоят стены.
Источник

NVIDIA открыла Nemotron 3.5 Lightning: 30 миллиардов параметров, активных 3, контекст в миллион токенов, SWE-bench Verified 52,8%, коммерция разрешена. На OpenRouter лежит бесплатно. Но дочитайте условия: NVIDIA пишет использование в логи и просит не грузить туда конфиденциальные и персональные данные. Для черновиков берите смело, для клиентских переписок нет - тот случай, когда бесплатное выходит дороже платного.
Источник

#AIновости #2026_08_13


🌅 AI-сводка на утро, 12 августа

Anthropic начала встраивать невидимые водяные знаки во всё, что генерируют модели Claude. Повод юридический - европейский AI Act со 2 августа требует делать ИИ-контент машинно-различимым - но применять будут по всему миру: API, Claude Code, облака Amazon и Google. Метка прячется в статистике выбора слов, глазу не видна и переживает копипаст; файлам вшивают C2PA-метаданные. Пока это касается только моделей, вышедших после 2 августа, старым дали переходный период 4 месяца. Публичного детектора нет, проверить метку может пока только сама Anthropic. У меня в конвейере канала стоит скрипт-чистилка, я гоняю через него каждый выпуск, чтобы вычищать машинные обороты. Против статистической метки он бессилен: она сидит не в стиле, а в выборе синонимов. Меня это не пугает - я и так открыто пишу, где в моей работе ИИ.
Источник

a16z посчитали экономику агентов, которые работают с компьютером как человек, мышкой и клавиатурой. Час такой работы на 30-40% дешевле аутсорса на Филиппинах или в Индии и в 5 раз дешевле сотрудника в США. Доля успешно выполненных бизнес-задач по бенчмарку OSWorld выросла за год с 42% до 85%. Работает это там, где есть чёткая инструкция и понятный критерий результата; на задачах уровня «иди сам разберись» агенты пока буксуют. По моей ежедневной практике так и есть: агент с инструкцией тащит, агент без критерия готовности дорого ошибается.
Источник

Google тестирует главную страницу без поиска. У части пользователей вместо кнопки «Поиск в Google» теперь «Создать изображение», «Мозговой штурм» и «Режим ИИ» - окно поисковика становится окном чат-бота. Вице-президент поиска Робби Стейн подтвердил тест и уверяет, что Enter по-прежнему ведёт на обычную выдачу. Четверть века главная страница интернета выглядела одинаково, и вот её тихо перерисовывают.
Источник

Suno с 3 сентября режет скачивания: бесплатный тариф - 7 треков за всю жизнь аккаунта, Pro - 20 в месяц, Premier - 60. Лимит задним числом накрывает и треки, созданные раньше. Заодно отключат все старые модели: останется новая V6, обученная на лицензионной музыке по сделке с Warner. Вчера я писал про закрытый браузер OpenAI, сегодня та же история с музыкой: сгенерировал за деньги - выкачивай, пока дают. Всё, что тебе дорого, храни у себя, а не в чужом облаке.
Источник

Meta вернулась к открытым весам: вышла агентная модель Glimmer на 30 млрд параметров, следом обещают открытый Spark 1.2. Их агент Muse Code стоит $0,1/$0,2 за миллион токенов - дёшево за счёт того, что модель учится на данных пользователей. Цену снижают не из щедрости: не платишь деньгами - платишь данными.
Источник

#AIновости #2026_08_12


🎤 Выступаю офлайн: суббота 22 августа, офис криптобиржи Asterium (Ташкент, Zargar ko'chasi 3).

Тема: «Что майнить в эпоху AI: данные, контент и цифровых работников - или почему я ушёл из крипты (но это не точно 😉)».

Я автор законопроекта о регулировании криптобирж в Узбекистане - и за эти годы видел, как майнинг менял смысл. Расскажу, во что вкладываться сейчас: майнить данные и контент, покупать токены нейросетей, запускать цифровых работников, которые собирают информацию, продают и торгуют.

И тезис, за который меня можно будет побить прямо на месте: подписка на нейросеть за $200 - это участие в ICO. По розничной цене API вы получаете токенов на $6000. Мой расчёт - покажу на экране.

Вход по регистрации: luma.com/wgrfs8yu - встреча камерная, мест немного. Приходите поспорить.

20 ta oxirgi post ko‘rsatilgan.