Кирилл Сачков


Гео и язык канала: Россия, Русский
Категория: Блоги



Гео и язык канала
Россия, Русский
Категория
Блоги
Статистика
Фильтр публикаций


У вас тоже фомо появляется, когда новая моделька выходит и хочется лимиты потратить и чета сделать прикольное полезное или я один шиз?


Репост из: Data Secrets
Итак, новый Opus-5.5, сводка:

– Уровень, сопоставимый с Fable 5.1 и Astra. Превосходит обе модели на Terminal-Bench, Cursor-Bench и многих других.

– Стоит меньше, чем Opus 5! $4/M input и $20/М output (было $5 и $25), и тратит меньше токенов на задачи.

– Генерирует выходы на 30% быстрее Opus 5.

– Обещают более естественное общение и лучшее форматирование ответов.

– В Pro и Max увеличили пятичасовые лимиты. Плюс, всем пользователям с подпиской дали один сброс, которым можно воспользоваться в любое время.

https://anthropic.com/claude-opus-5-5


Вот что конкуренция делает, антропики может и нормальные условия скоро сделают для обычных смертных


Репост из: Data Secrets
Z.ai опубликовала инженерный отчет о том, как модель GLM-5.3 участвовала в создании production-инференса для GLM-5.3-Flash

Они описывают этот процесс как первый шаг в сторону recursive self-improvement и говорят, что подобная практика «полностью меняет то, как создаются следующие поколения моделей».

Короче, перед инженерами стояла задача: нужно было развернуть кластер на 100 000+ китайских ускорителей (не Nvidia). Это, кстати, первое развертывание их отечественных чипов такого масштаба.

GLM-5.3 использовали для оптимизации производительности и скорости. В итоге всего за две недели инженеры с помощью модели вырастили throughput в три раза!

Агент сам формулировал гипотезы, где теряется скорость, и писал код фиксов, люди только ставили цели, смотрели за безопасностью и принимали конечные решения.

Три конкретных фикса, которые агент сделал автономно:

– Убрал Python GIL bottleneck, который ел ~20% производительности

– Ускорил decode-кернел в 1.71 раза

– Починил числовую точность в KDA-кернеле для длинного контекста (фикс впоследствии влили в проект Flash Linear Attention)

https://z.ai/blog/glm-built-its-inference-infrastructure

P.S. В конце их блогпоста не хватает только фразы «а американцы пусть и дальше замедляются»


Разработчик Codex: рои агентов — это слив токенов без прироста качества

Разработчик OpenAI Codex Эрик Прованше заявил, что запускать больше двух параллельных субагентов почти всегда бессмысленно: токены горят, а качество не растёт.

Главное:
– агенты не доверяют друг другу и начинают перепроверять работу всех остальных — это он называет «налогом на координацию»;
– пример: проект, где 1 393 агента потратили $20 000 токенов на один рефакторинг Python-кода;
– с той же задачей справился бы один агент Astra за долю этой суммы.

Чем больше агентов в рое, тем дороже выходит координация, а не результат




Мне кстати сейчас прям без шуток нравится направление именно аи инженера, а не просто вайбкодера. То есть есть желание именно разобраться в llm и то, как они устроены на проф уровне, чтобы внедрять все это в бизнес и строить реальные прод системы вокруг llm + использовать конечно для своих проектов. Я сейчас погружаюсь во все это и это очень интересно. Следующий курс после ai разработки будет на ai инженера


Го проходить курс от стэнфорда по llm. Учимся на AI инженера


🚨 Агенты OpenAI атаковали RubyGems ещё до Hugging Face

Всплыла ещё одна деталь истории про автономные атаки агентов OpenAI: за два месяца до инцидента с Hugging Face они атаковали RubyGems.

Главное:
– атака на RubyGems произошла раньше, чем стало известно про Hugging Face;
– речь снова об агентах OpenAI, действовавших автономно;
– детали и масштаб ущерба в публикации не раскрываются.

Похоже, история с автономными атаками агентов OpenAI оказалась длиннее, чем казалось.

Вероятно, что мы не так далеки от мира, где ИИ агенты захватывают интернет. Хорошо, что они не имеют пока физического воплощения, пока...


gpt image новый кайф. зачем вообще инфографику отдельно делать если можно просто генерить картинки с гпт


Ещё из интересного навайбкодил бота в тг, который парсит все новости по разным темам и сохраняет фидбэк по каждой новости


https://youtube.com/shorts/cqaMehOlaNo?si=UhmBr3-mSWUW-_T-

Вот это наверное пока лучший результат. Сори что канал превратился в чисто оценку нейромонтажа, такова судьба


https://youtube.com/shorts/InmvNnjIVmQ

Пока что лучший монтаж из всех наверное который у меня получился




Видео недоступно для предпросмотра
Смотреть в Telegram


Мб игру сделать, всегда хотел


Репост из: CodeCamp
В Х появились первые примеры работы с GPT-6 Astra — и это отвал всего 😨

Люди уже создали:
— Кучу полноценных 3D-игр: клон SimCity, Fall Guys, Minecraft и ещё множество проектов. Причём некоторые Astra собирала с первого захода без правок, а над SimCity Astra сама трудилась пять дней подряд.

— По паре фоток Astra создала 3D-модель дома с комнатами, мебелью, техникой и мелкими деталями. Результат можно редактировать в Blender, а сцена работает в 60 FPS. Возможно, увидим скоро такие штуки в объявлениях.

— За неделю работы Astra создала целый кусок Манхэттена в Unreal Engine, проходя улица за улицей и доводя каждую мелочь до нужного вида. Детализация просто поражает.

— Но самое удивительное: ИИ построил мир с автономными агентами, которые должны сотрудничать с остальными, чтобы выжить. Получилось крипово.


Ну, за геймдев 🍺


Запускаем цитаты - "Увидел возможность, действуй. Если не увидел, не действуй"


Репост из: Data Secrets
Видео недоступно для предпросмотра
Смотреть в Telegram
«Все, что вы делаете на компьютере, Astra может сделать за вас. Быстро»

Модель (помимо невероятных способностей в ризонинге и кодинге) позиционируют как лучшую в мире для всевозможного computer use.

Генерация презентаций, таблиц, файлов, дизайн, аналитика, поиск, работа с браузером, любым ПО, 3D-сценами и многим другим.

По одному промпту может создать, захостить и зашерить сайт, приложение или даже игру прямо в ChatGPT.

Системная карта: https://deploymentsafety.openai.com/gpt-6-astra/gpt-6-astra.pdf


На самом деле как много возможностей сегодня открывает ИИ, кто-то будет унывать, что его заменят, а кто-то будет видеть новые возможности и действовать

Показано 20 последних публикаций.