Градиент обреченный


Kanal geosi va tili: Rossiya, Ruscha


lingtrain.ru
habr.com/ru/users/averkij/
hfday.ru

Bog‘liq kanallar  |  O‘xshash kanallar

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


Тут сразу N замечательных девушек из канала @n_it_girls, попросили ответить на вопросы про секс, з/п и рок-н-ролл типичного IT'шника.

Девчонки клёвые, познакомился с ними на сентябрьских митапах. Подписываемся на них.

https://t.me/n_it_girls/1464


Сундар Пичаи проанонсировал Gemini 4 Argon. Пишут, что внутри им довольны, используют в исследованиях (есть результаты оптимизации квантовых алгоритмов), в оптимизации ресурсов (освободили 300TB оперативки в датацентрах), переписывают всё, что плохо лежит, на rust и т.д.

Скоро гугл выпустит этот газ, можно будет подышать.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Погонял новый Sonnet, сделал сценку Сити с машинками и NPC. Занимает всё около мегабайта, отрисовывается на three.js. Сделано на базе вот этой репы.


AMD покупает World Labs

Стартап от Фей Фей Ли из области моделей мира (это когда ИИ оперирует пространственными понятиями, строит 3D миры, понимает как и что внутри этого мира взаимодействует и т.д.), покупается за $8.2 миллиарда 😱.

Стартапу всего 2 года, у них есть есть продукт Marble, он публичный с конца 2025-го, в него мы уже обывательски потыкали.

Практическими кейсами у него, является обучение роботов (симуляция помещений, улиц, дорог, складов и т.д., генерация миллионов сцен, где робот будет планировать свои действия и дообучаться) и куча более очевидных применений типа игр, дизайна и т.д.

Для embodient agents (или «воплощенный ИИ» как его ещё переводят) тоже должно быть круто — робоагент строит внутри себя мир по камерам, размышляет, что произойдет при разных взаимодействиях со средой, и затем что-то выполняет в реальности.

Покупают всю RnD лабу Фей Фей Ли, а она сама становится исполнительным вице-президентом и Chief Scientist AMD. Очень круто.

https://ir.amd.com/news-events/press-releases/detail/1299/amd-to-acquire-world-labs-to-advance-the-future-of-ai-compute


Опять 5.5

Вышел Sonnet 5.5. В пресс-релизе сумели нарисовать график, где он выше всех. Обожаю такое.

Вообще же пишут, что предыдущая 5-я версия набирала на агентном бенчмарке Terminal Bench 4.0 только 10%, а новая модель аж 70%.

Смотрим её. Либо правда хороша, либо пора собирать Terminal Bench 5.0.


Чувак говорит, что при общении с новым чат-ботом от Meta тот скинул ему архив своей файловой системы. Для удобства даже закачал всё на Google Drive.

Вот это я понимаю сервис, не то что ваши вредные клоды.

https://mouse.dev/blog/muse-runtime-export/

4k 3 73 5 106

Опа, подарочки. Ждём три ресета от Codex’а.

3.1k 2 14 17 34

🔺 Сделал 23-х язычную Алису в стране чудес

В Алисе очень много словесных игр, абсурдных шуток и стихов, каждый переводчик в своё время по сути перепридумывал их под свой язык, так что очень интересно поразбираться у кого как получилось.

Эта книга была переведена на гораздо большее количество языков (и не один раз), так что в будущем ещё её подрасширим.

Скоро появятся ещё несколько редакций на русском, в том числе перевод Владимира Набокова, можно будет сравнивать между собой стили разных переводчиков.

Добавил в нашу читалку вместе с новыми языками. Теперь есть нидерландский, турецкий, шведский, венгерский и другие. Появились даже эсперанто и ложбан 😱.

P.S. Если найдете косяки, то пишите.

👉 https://lingtrain.ru/library/ru/alice-s-adventures-in-wonderland-carroll--f6b939


Вышел grok 4.7. Появился в курсоре и в родном консольном клиенте. В консоли можно пока пользоваться бесплатно.

Консоль ставится так:

irm https://x.ai/cli/install.ps1 | iex

Потыкал им в один проект со сложным UI. Где-то через 10 минут посыпались 500-е ошибки. Через полчаса ожило, потом опять падало. Явно у них сейчас послерелизная нагрузка. В целом же плюс-минус как Opus работает, только медленней (в этот конкретный запуск).

Если по цене за API говорить, то тут сильно лучше опуса — $2/$6 за in/out 1M токенов (у опуса $5/$25).

Grok харнесс у них, кстати, открытый, можно посмотреть исходники. Особенно любопытно смотреть, что они там исправляют каждый раз, когда подливают изменения из рабочего репозитория.

Upd. Бесплатный лимит совсем маленький


Мы боялись, что у нас отберет работу ИИ и совершенно упустили из виду мух-дрозофил 🤩


В зале HR проходят флеш собеседования

3k 1 39 11 52

Впитываем мысли Алёны и ребят


Сегодня тусим на Practical ML от Яндекса. Пришло примерно миллиард человек. Все красавцы.


Вот ты какой, рой агентов

3.7k 4 35 19 97

Ещё вчера был классный доклад про рекурсивные архитектуры

Есть ряд статей про такие архитектуры — HRM, TRM и URM (гуглим). Суть в том, что небольшая сеть, переиспользуя свои собственные веса, может многократно уточнять решение какой-то задачи, прежде чем выдать ответ.

Оказалось, что это хорошо ложится на логические задачи типа задач с ограничениями (судоку и другие варианты латинских квадратов, какуро и т.п.), лабиринтов, автоматов типа игры в жизнь и в целом задач с абстрактным рассуждением (ARC-AGI бенчмарк).

Из минусов то, что не получается загнать все такие таски в одну сеть, надо обучать под конкретную задачу. Из плюсов то, что одна модель может на своей задаче давать качество лучше любой LLM, быть сильно дешевле, быстрее и т.д.

Ребята собрали свою архитектуру на этой базе — STARM (Single Task Algorithmic Reasoning Models), оптимизировали её, получили SOTA качество. Выложили код.

👉 Хабр | GitHub


Люблю господина Сергея Николенко. Что в ЧКГ он мне всегда нравился, что книжки классные по ML у него есть, рекомендую для вкатывания.

- Говорит, что математика, кажется, всё, но математики это переживут.
- Обсудили коммунистический подход агентов, ломавших HF.
- Поразмышляли над архитектурами моделей лет через пять.
- Возможно, что следующие топовые архитектуры будут придуманы уже не нами.


Тусим сегодня на AI RnD Day от Сбера, доклады пока отличные, множество знакомых лиц, все красавцы.


Слушайте, а давно клод-код стал сам возобновлять таски, которые умерли по лимиту?

- limit resets 9:40pm
- сontinuing automatically at 9:40pm


Тем временем нашу нишевую читалку для изучения языков установили 500 раз за две недели.

👉 качаем тут: ios | android


Очень хорошая базовая лекция про обучение моделей на кластере (надо, когда на одну карту не влезаем)

🟢 Рассказывают про основы коммуникаций между gpu (all reduce, all gather, reduce scatter и т.д.), как они используются в разных режимах распараллеливания.

🟢 Как развивалась инженерная мысль от data и pipeline parallel до expert и context parallel (он же ring attention).

🟢 Почти во всех лекциях, кстати, хвалят deepseek за их подробные тех. отчеты и кучу ablation экспериментов. Поддерживаем. 👊

👉 https://www.youtube.com/watch?v=6-cXp-aOmdg

2.8k 2 178 1 34
20 ta oxirgi post ko‘rsatilgan.