Posts filter


40 процентов на археологе это сильно


даглар, родной, не останавливайся

скоро еще анонсируем сладкие призы😄😄😄 и как участвуя можно попасть в сабмит на 😄😄😄😄






👎подвезли контента с летней школы👍

• @vkurenkov порассуждал про клод и студентов
• @earo050 рассказал про навигационные vla-шки
• @komershan изложил про планирование в самовозках

было еще много других лекций, их найти можно тут


Forward from: Does RL work yet?
Получили Outstanding Paper Award на RLC 2026. RLC в целом последний оплот камерности и вайба, надеюсь это сохранится как можно дольше. Очень жаль, что не смог туда поехать, но получить какую-то награду и признание на RLC, признаюсь, в разы приятнее чем на большой тройке из ICML/NeurIPS/ICLR. Есть надежда, что присуждавшие реально прочитали статью, а не выбрали по порогу скора на ревью.

Кстати говоря, статья не новая и пережила несколько ресабмитов на нипс/исмль, так что не стоит отчаиваться после реджектов, всякое бывает.

https://t.me/airi_research_institute/1388


rq: +100 лямов или птичка в клетке?


Grokking refers to a phenomenon in deep learning where a neural network initially memorizes training data and only much later—sometimes after thousands of additional training steps—suddenly generalizes to new, unseen data. It is distinct from standard learning, where test accuracy improves smoothly as the model learns.


Video is unavailable for watching
Show in Telegram
уже завтра русский богатырь покажет как надо пришвартовывать лиганды в кармашки нашим западным партнерам

фулл тут: платно


еще один аксепт на айклир

Zero-Shot Adaptation of Behavioral Foundation Models to Unseen Dynamics

дефолтный лендос } код }


Потом вместе с друзьями (@zhemd, @ma_ksi_mko) получили Oral на ICLR.

Админ ебаных идей для рисерча был против и нам влепили деск реджект за два дня до конфы, но кому не пох? интернет все помнит

cadrille: Multi-modal CAD Reconstruction with Reinforcement Learning

бумажка пдфка } код }


В январе получили получили Oral (~top 5% статей) на AAAI.

Object-Centric Latent Action Learning

статья } код потерялся, но будет 100% }


Video is unavailable for watching
Show in Telegram
У нас за этот год уже набралось много классных результатов (помимо мемофф) — будем потихоньку делиться.

Vintix II: Decision Pre-Trained Transformer is a Scalable In-Context Reinforcement Learner

красивый блогпост с демо } код } датасет }


Заказали интеграцию у вандб

1.2k 0 14 15 35

Коллеги, добрый день.

По итогам участия в профильной конференции в Бразилии стало очевидно, что запуск собственного журнала является актуальной и перспективной инициативой.

Направляю предварительный набросок первого выпуска. Буду признателен за ваши комментарии и предложения.

С уважением,
@dunnolab


#iclr


Video is unavailable for watching
Show in Telegram
Андрей приехал с Сарова помогать к дедлайну нипса. Вот и думайте


#эстетика


🎄Новогодние вакансии в дуно 🎄

Вы часто спрашивали, как попасть к нам в команду. И мы вас услышали! В этот раз у нас настоящий новогодний апдейт: мы открываем набор в основную команду 🎁

Открыты две вакансии — выбирайте, что ближе: хотите заниматься рисерчем и растить хирш или прикладными проектами и растить метрики? Теперь можно и то, и другое.

🪖 Research Engineer в области RL

Вы будете работать над практическими R&D-проектами, от робототехники и управления беспилотным транспортом до рекомендательных систем и макроэкономического моделирования.


🧪Research Scientist в области RL

Вы будете заниматься написанием статей на top-tier конференции (NeurIPS, ICLR, ICML), проводить эксперименты и предлагать новые исследовательские идеи.


Узнать подробности и податься можно по ссылкам выше.

- - —
@dunnolab


@Nikita_Lyubaykin сначала жмет 130кг от груди, потом жмет пару уравнений в ноушн

хочешь также? ЖМИ СЮДА

20 last posts shown.