Да придет ИИ: ChatGPT, Claude, Gemini, Grok


Kanal geosi va tili: Rossiya, Ruscha


O‘xshash kanallar

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo dan repost
Как сэкономить токены в Claude Code ультимейт гайд

Основанный на моем более чем 1.5 годовом опыте работы с КК.

Поймите, основная статья расходов - это не генерация новых токенов - это чтение из кэша. Уже писал об этом тут.

Как это вообще происходит? В агентом цикле КК снова и снова перечитывает всякий мусор:
• Он шарахается по интернету и от туда все пылесосит в контекст
• Он шарахается по жесткому диску и все собирает.
• Его просто циклит на ровном месте.

Писал об этом тут.

Чтобы бороться с циклами я даже сделал отдельный проект, но он пока не готов.

КК имеет 2 типа кеша:
• стандартный 1 часовой - просто не отходите от КК больше чем на час, а если ушли на долго запускайте компактацию.
• 5 минутный для агентов. Просто не запускайте агентов самостоятельно. КК делает это сам автоматически когда нужно.

Подробнее про кэш.

Как сэкономить еще больше:

1. Начните с команды /context она показывает, чем вообще засрано. Так я обнаружил, что мой самописный MCP содержит в себе 134 туда с очень жирными описаниями, и вот это просто пассивно отжирало лимиты. все эти скиллы и мсп вы просто платите пассивный налог на каждый. писал об этом тут.
2. Команда /insights там КК выдает вам тонну советов, в том числе и по сокращению потреблению лимитов.
3. /skill-doctor - проверяет не жрут ли скиллы, скорее всего не жрут, но проверить стоит.
4. Не устанавливайте всякие сомнительные инструменты для "экономии токенов" из интернета. Как я обжогся с Headroom больше экспериментов не хочу (хотя в блог писать надо). А например в скилле superpowers (не знаю как сейчас, но раньше так было) дефолтная разработка была субагентами, а там кэш 5 минут, и лимиты это выжирало мгновенно. Не знаете как это работает — лучше не запускайте, вот что я для себя усек.

Для что я могу посоветовать для экономии токенов:

скил понитейл — как это работает? он сокращает написание кода. А значит меньше кода будет записано в контекст, и меньше контекста попадет в циклы. сам автор называет скромные цифры 20-30% экономии, но меня вдохновило сообщение в чате, там человек писал что перепробовал и стоунмэн, и сирена и кодеграф, реально экономит только понитейл.

команда /simplify - она проверяет код на задублирование, меньше кода - меньше мусора в кэше.

И заметьте ни слова про CLAUDE.md (писал тут) и /memory (еще не писал) т.к. это уже должно быть очевидно.

Если после прочтения этой статьи вам не удалось сэкономить токены — требуйте от меня возврата денег за чтение!


Пройдите интервью с ИИ!

Был бы я обычным пользователем я бы нафиг послал за такие просьбы, но как фанат ИИ я должен поучаствовать в развтии ИИ.

https://claude.ai/anthropic-interviewer/your-thoughts-on-ai?from=spotlight


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Ребята, дошли тут до меня интересные новости о том, что:

Франция созвала Совет Безопасности ООН, чтобы Дарио Амодеи зачитал по веб-трансляции своё сообщение

Франция, которая председательствует в Совбезе в сентябре, заранее созвала заседание «Artificial intelligence and international security» на 23 сентября. Еще 18 сентября Reuters писал, что Altman будет там выступать и что Anthropic тоже может принять участие.

Т.е. Антропики даже заранее свое участие не подтвердили.

А Anthropic объявила ART 23 сентября, то есть в день заседания. Амодеи просто очень удачно получил свежий пример для своего выступления.

Факт: Claude уже продемонстрировал довольно автономный поиск новой биологии.
Не доказано: что Claude сейчас способен самостоятельно создать новый опасный патоген, эффективное биологическое оружие или тем более средство «вымирания человечества».

Еще интереснее факт, что:

Всю лабораторную работу делают люди. Лаборатория Антропик работает только с уровнями биобезопасности BSL-1 и BSL-2 и не имеет дела с патогенами, опасными для человека.


Ребята, «Новый вариант CRISPR». Это пока гипотеза. И CRISPR ли это вообще? Функция системы ART неизвестна.

Не ведитесь на хайпожориков всяких. Читайте правильные ТГ-каналы.


На гитхабе стремительно вирусяться Jev репо

Вот например этот предлагает использовать Jev для стремительной компакции: https://github.com/tamaratran/fast-jev-compaction — уже 5К звезд.

Напишите в комментах, не страшно ли тестить такое?


Какая модель лучше пишет тексты на русском языке?

Для этого есть текстовый лидерборд arena.ai

Модели от ОпенАЙ тексты традиционно пишут ну очень плохо.

Вы можете сами зайти в Battle Mode и посравнивать как пишут тексты разные модели и сравнить между собой.

https://arena.ai/leaderboard/text/russian


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Claude тестирует новую версию Projects

Пока только в Claude Code.
Раньше проект был базой знаний с историей чата. В новой версии проект — это один непрерывный диалог. Формулируете задачу, Claude разбивает её на параллельные потоки и выполняет в облаке. Закрыли ноутбук — потоки продолжают работать.
Каждый поток стартует с доступом к файлам проекта, репозиториям, инструкциям и памяти. Библиотека проекта собирает всё, что вы загрузили, и всё, что создал Claude.
Доступ: часть пользователей Pro и Max с Claude Code. Остальные — по мере раскатки, затем очередь дойдёт до Cowork, Team и Enterprise.


Если нет доступа — записывайтесь в лист ожидания на claude.com/form/projects.
Старые проекты в чате и Cowork работают как раньше, апгрейд получат позже.
Лимиты расходуются как при любом использовании Claude. Несколько параллельных потоков тратят их быстрее.




Google выпустил Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking для голосовых агентов

И он нагибает все, кроме Gemini 3.1 Live и это все не модели кодирования. А голосовые агенты.

Extended Thinking занял первое место в рейтинге Artificial Analysis по качеству речь-в-речь — 82,6 балла, 97,7% на Big Bench Audio.

В правду говорят, не можешь победить в кодировании, победи в чем-нибудь другом.

Но если серьезно, то у Гугла несколько миллиардов


Не знаете в чем отличие между обычным чатом и Cowork в Claude.ai?

Вот и Антропик тоже не знают, поэтому объединили их в одно окно. Но функция будет выкатываться в течении 2х недель, так что время разобраться в чем там разница еще есть.

https://claude.com/blog/cowork-is-now-claude


Хочу посоветовать вам мой новый канал про Vibe Coding

Потому что весь движ сейчас там

@prog_ai


Протестировал GPT-2.0 vs GPT 2.5

Промпт:

Создай изображение, на котором умести как можно больше разных акул в натуральную величину, и к каждой акуле сделай подпись, что это за акула.

Как видим, изображение менее "плывет" на большом количестве деталей. Элементы не перекрывают друг-друга и подписи выполнены четко.

Какие проблемы еще вижу:

• Многословность. Создает на изображении много надписей, которых не просили
• С размерами проблемы. Внизу есть шкала от 0 до 18 метров, в то же время, 2 самые крупные акулы 18+12 метров = 30 метров влезают на первую строку, хотя не должны.
• Надписи мелкие, плохо читаются.

Но прогресс виден: Версия 2.0 даже не всем акулам подписи делала, а во втором случае все акулы даже пронумерованы и отсортированы по размеру.


Вышел GPT-image-2.5

Наконец-то обновился самый лучший генератор изображений!


Нвидеа покупает Обнимашки за $12,930,300,000

Это говорит о том, что Зеленый Гигант делает ставку на домашнее оборудование для конечных пользователей.

Т.е. раз уж корп. клиенты проектируют свои собственные чипы для отказа от Нвидеа, то Нвидеа сделает опенсорс модели дешевыми и разнообразными, чтобы мы покупали их железяки для запуска их моделей локально.

А я еще думал, за чей счет банкет.

https://blogs.nvidia.com/blog/nvidia-to-acquire-hugging-face/


Это новый Илон Маск


Fable 5.1 2 дня бесплатно на arena.ai


Ну че, А6ТРА уже тут


Подарите друзьям кредиты в ChatGPT

Это кстати еще один способ обходит санкции, но... получится уж больно дорого


Stability AI привлекла $76 млн от Electronic Arts, Sony Music, Universal Music, Warner Music и других

Компания объявила, что привлекла раунд B. Оценку не раскрыла.

Всего стартап привлёк $232 млн под руководством гендиректора Према Аккараджу. Он занял должность в 2024 году вместо сооснователя Эмада Мостака, который покинул пост на фоне ухода «ключевых» сотрудников и предполагаемых финансовых проблем.

Среди новых инвесторов — Electronic Arts, Sony Music Group, Universal Music Group, Warner Music Group, а также инвестфирмы AMD Ventures и Pacific Alliance Ventures. У компании уже есть партнёрства с Electronic Arts, Universal Music и Warner Music.

Предполагается, что будут разрабатывать модели для генерации музыки.


Вставь свое фото в ЧатГПТ:

Create a caricature of me and my job based on everything you know about me


Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo dan repost
При помощи проекта hhru сделал исследование труда рынка AI специалистов в РФ

Как было сделано исследование:

1. Спаршено 1770 резюме. Т.е. цифры в этих данных не сколько работодатели готовы платить, а сколько люди хотят получать.
2. Эти резюме распаршены по полям и записаны в базу данных.
3. Дальше Клод Код сделал запрос к этой БД ну че-то там нанализировал (я уже дважды не перепроверял)

Изначально запрос был "AI" по такому запросу находится 12000 резюме, но вот же нюанс:

.ai == Adobe Illustrator и в поиске находится 10 тыс. вакансий всяких ретушеров, пришлось добавить кое-какие фильтры, чтобы их убрать.

Кое-какие не очевидные выводы, которым я был удивлен:

Медиана зп у креативщиков и технарей примрено одинаковая. А вот по среднему картина обратная — технари 165k против креативщиков 144k. Расхождение объясняется тем, что среднее у технарей вытянуто вверх редкими очень дорогими резюме (p90 = 330k), тогда как креативный сегмент плотнее сгруппирован. Медиана описывает типичного человека, среднее — нет. Верить здесь следует медиане.

Удалёнка — норма: 1206 из 1559 (77%) готовы работать удалённо, из них 423 — только удалённо. Исключительно офис — 319 (20%).

Запросы описывают почти непересекающиеся группы: 1318 резюме из 1559 найдены ровно одним запросом, двумя — 198, тремя и более — 43. Терминология рынка фрагментирована: «Data Scientist», «ML-инженер» и «нейросети» приводят к разным людям, а не к одним и тем же под разными названиями. Самые массовые запросы — Data Scientist (752), AI (608), Machine Learning (149).

Итог
Три вывода, которые данные поддерживают устойчиво:
1. Опыт не окупается, навыки окупаются. Медиана по стажу падает после 6 лет, зато владение LLM-стеком даёт +50%, и английский C1 — тоже +50%.
2. LLM-компетенции остаются дефицитом. 11.7% рынка при заметной премии — окно ещё не закрылось.
3. «AI-специалист» — не одна профессия. Технический и креативный сегменты почти не пересекаются ни по навыкам, ни по запросам, при сопоставимых медианах.

Понравилось исследование, поставьте звезду проекту на ГитХабе:

https://github.com/axisrow/hhru

20 ta oxirgi post ko‘rsatilgan.