Путь в R&D - Каюмов Лев


Kanal geosi va tili: Rossiya, Ruscha
Toifa: Bloglar


Добро пожаловать на мой канал! Здесь я делюсь своим опытом участия в олимпиадах по математике, соревнованиях по программированию, подготовкой к ним и многими другими увлекательными темами.
Моя личка - @LevKayumov

Bog‘liq kanallar

Kanal geosi va tili
Rossiya, Ruscha
Toifa
Bloglar
Statistika
Postlar filtri


FAIO
Наша команда (@rand_lear и @vklnivi) заняла 12 место на отборе, а это значит, что мы проходим на финал в Казахстан! 🇰🇿

Также поздравляю @artyomjk @naladwepo @nxckp8_u с первым местом!

На пути R&D: 1696
@RnDLabs | #Хахатоны@rndlabs

280 0 0 17 34



YOUNGCON🌎

Недавно съездил на YOUNGCON в рамках соревнования ML Challenge от Яндекса

Место
Проходило все в Live Arena — это огромная площадка рядом с Одинцово, где мы жили 2 ночи. Было много спикеров и всяких активностей, но первую половину дня мы полностью пропустили, потому что писали соревку :)
Ну и что невероятно важно, было много мерча

Немного про соревнование
У нас было всего 4 часа на 4 задачи. Для ML-соревы это довольно мало. При этом был бесплатный API DeepSeek через SourceCode, чем-то похоже на OpenCode, поэтому получилась такая вайбкод-сорева, зато идейки быстро пилились. В итоге смог занять призовое 13 место и, если все ок и меня внезапно не забанят (потому что, а почему бы и нет), забрал плюшки от Яндекса 🤓

Нетворкинг
Самая лучшая часть поездки. По сути ехал ради этого :)
Встретился с друзьями, которых последний раз видел еще на НТО, погуляли, пообщались — вообще кайф. Познакомился с новыми людьми, все очень крутые, обожаю такой вайб выездов
Ну и, конечно, концерты Славы Марлоу и Токсиса, жестко попрыгали под конец💃

На пути R&D: 1613
@RnDLabs | #Хахатоны@rndlabs

164 0 0 10 29

Финал Innopolis Open по ИИ

В продолжение предыдущего поста — я все таки прошел в финал. Что было дальше...

Место проведения
Впервые побывал в Иннополисе, знал, что это мини город, но масштабы больше, чем я ожидал. Жили в общаге, которая соединена стеклянными мостами с корпусом университета, можно было ходить в тапочках и халатах, довольно вайбово. Сам университет современный и немножко отдает атмосферой ВШЭ

Что было на олимпиаде?
⚫️Первый день: решали задачи с большими условиями. Меня подвела невнимательность и обидный момент с тем, что на табло в аудитории оставалось еще около минуты, и у меня уже было готовое решение, но зайдя на платформу система писала, что соревнование уже закончилось из-за рассинхрона по времени....

⚫️Второй день: одна задача на 4 часа, она была похожа на ту, что я описывал в предыдущем посте, но под контролем агента находились три игрока, а решения участников сражались друг с другом (жаль, без эпичного pvp в прямом эфире). Реализовал классический DQN, но решение все равно вышло неплохим - первое место по этому дню🙂

Результат
Занял 9 место.....
А 8-ое место — это призерство (РСОШ 3 уровня), что дает 100 баллов ЕГЭ. Мне не хватило 10 баллов, а для понимания — это меньше 1% от общей суммы....... 😕

Итог 😱
Обидно упущенное призерство из-за невнимательности, в любом случае круто, что побывал там, познакомился с новыми людьми, в общем узнал про Иннополис и покайфовал! Это поражение только начало мини марафончика, впереди еще олимпиады, спойлер, результатом не лучше :) но об этом в следующих постах

На пути R&D: 1520
@RnDLabs | #Хахатоны@rndlabs

148 0 0 11 33

Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Гайд, как не пройти в финал олимпиады⏹

Примерно час назад писал второй отборочный тур Innopolis Open по ИИ, где была тема обучения с подкреплением, но прикол в том, что были разрешены только numpy и стандартные библиотеки. Задача в 1-ой и 2-ой тасках была научить агента собирать сокровища в динамической среде с ловушками и вернуться обратно

Первую задачу решил на 99/100.
Вторая была посложнее: карта 15×15 с преследующими ловушками и агент видел только 5×5 вокруг себя. Вместо нейросети решил сделать поэтапный BFS (поиск путей по графу в ширину) и получилось довольно хорошее решение на 80/100 на валидации, суммарно за 2 задания должно было быть примерно топ-20 (и соответственно вероятный проход в финал)

Когда решил отправить, оказалось, что прием решений закончился 10 минут назад.....💥

На пути R&D: 1456
@RnDLabs | #Хахатоны@rndlabs


Квантовый энкодер📝

Сидел я в новогодние праздники и подумал, что нужно как-то применить квантовую механику в ML и вот что получилось:

Расскажу про текстовый энкодер, это модель, которая кодирует текст с помощью так называемых эмбеддингов (векторов по сути) и из этого вектора следует, что где-то в плоскости этот текст точечно находится "здесь", однако смыслов может быть много 🤔
Я попробовал сделать на выходе квантовый модуль, и теперь результат модели имеет суперпозицию, то есть облако смыслов для входного текста, где разные варианты переплетаются и влияют друг на друга, а не точка в пространстве

Работает на библиотеке PennyLane, которая симулирует кубиты (это, как обычный биты, только у нас не 0 или 1, а 0 и 1 одновременно, просто они распределены по вероятности), есть и другие симуляторы, но они не поддерживают обратный процесс для параметров, поэтому для квантового ML чаще юзается эта библиотека

Итог 🤔
Получилось что-то интересное с чем можно много поиграться, улучшать и смотреть красивые визуализации, которые доступны только с комплексными числами и квантовыми состояниями. Считаю, что перспектива у квантового ML очень велика и этот термин будет проникать все больше, и больше, тк квантовые компы уже на пороге

На GitHub-е находится код с более подробными объяснениями и графиками, можете глянуть и поставить звездочку 💥

На пути R&D: 1443
@RnDLabs | #квантмех@rndlabs #research@rndlabs


Полугодовой олимпиадный итог🎄

Пролетела основная часть олимпиадного сезона и вот подведенные, не очень оптимистичные результаты

Где участвовал
AI Challenge, Всерос по ИИ, ВсОШ по ИИ (это разное), Inopolis ИИ, НТО ИИ и БДиМО, Яндекс кап
Почти все соревнования делали вместе с @rndcore

Результаты.
❌ AI Challenge:
Прошли в полуфинал, проделали много работы, в итоге баллы не известны и не очень понятно по какому критерию мы не смогли пройти

❌ Всерос ИИ:
Прошел в основной этап, занял 82 место, плохо выступил

❌ Яндекс кап:
Интересная сорева, решил взять таску с диффузионными моделями, но все идеи начали приходить когда все закончилось, в итоге пролетел

❌ НТО БДиМО:
К сожалению, не хватило 18 баллов...

? ВсОШ по ИИ:
Школьный этап прошел, в нем были базовые задачки на комбинаторику, мат. стат. и алгоритмы. Муниципальный этап написал плохо, посмотрим, как пойдет дальше (вероятнее всего, получится пройти, т.к. Владимире мало людей пишут)

✅ Inopolis ИИ:
Прошел во второй этап, ждем 20 января

✅ НТО ИИ:
Весной едем на финал 🤩
Задачи поделились на индивидуальный этап и командный, в первом нужно было предсказать оценку книги пользователем, а во втором - ранжировать список из 20 книг

Вывод
В общем, этот год слил, но я не расстраиваюсь, набрался кучей опыта + еще остались соревнования и 1 класс впереди - делаем. Надежды на БВИ умирают последними👍

На пути R&D: 1428
@RnDLabs | #Хахатоны@rndlabs

254 0 0 11 45

Полуфинал AI Challenge🚀
Снова участвуем с напарником @rndcore в AI Challenge от Сбера, который успешно залутан в прошлом году! На этот раз решаем задачу модели Изинга — минимизация энергии кристаллических решёток с помощью RL🧠

И вот позавчера с неприятными скрипом пришло письмо о прохождение нашей команды в полуфинал.

Поясняю почему
В таблице проходящих была одна команда дважды, а из топа никого и нас не было. После письма организаторам исправили список, наша команда появилась, но многих из лидеров всё равно нет. Таблица без разбалловки, поэтому непонятно почему кого-то нет или кто сделал лучшее решение

Вывод

Если AI Challenge проходит гладко, вас, наверное, обманули — это не AI Challenge🚨

PS
Пока писал пост, еще пришло письмо о проходе в основной этап всеросса по ИИ😎

На пути R&D: 1352
@RnDLabs | #Хахатоны@rndlabs


Начало сезона олимпиад🦜
Сейчас активно начинается сезон олимпиад, поэтому немного расскажу что случилось за последний месяц и какие планы:

- В конце августа выиграл мерч на Буткемп-ИИ — до сих пор не пришел(
- Мы отправили итоговое решение основного этапа AIJ, результаты ждём примерно 7 октября
- Параллельно идут НТО по ИИ и БДиМО (большие данные и машинное обучение), в которых тоже участвую.
- Скоро стартует всеросс по ИИ, новый ВсОШ по инфе, где основная тема - это ИИ
- Еще хочу попробовать ДАНО, залететь в высшую пробу от ВШЭ и физтех олимпиады(но на них я особо не рассчитываю)

Определенно цель вновь увидеться со всеми ребятами, забрать БВИ и пройти на отбор IOAI еще раз, поэтому жестко попотеем :)

В общем все меньше и меньше остается времени на личную жизнь и это прикольно😂 Думаю, что постов будет больше, если нигде не провалюсь)

На пути R&D: 1336
@RnDLabs | #Хахатоны@rndlabs


Мнимая идея📝

Пока изучал комплексные числа, пришла идея расширить возможности нейросетей путем добавления комплексного пространства. Это может дать все возможные и невозможные действия с числами, например, извлечения корней из отрицательных чисел и большую гибкость с данными. Спросил у perplexity про идею, оказалось, такое уже есть, называются они: "Комплекснозначимые Нейронные Сети" (КНС)…

Как они работают и чем отличаются от обычных?
⚫️КНС оперируют с комплексными числами, в которых есть действительная и мнимая части. Все данные в КНС — комплексные числа: входные данные, весовые коэффициенты и функции активации.
⚫️Нейроны в КНС мощнее, чем в обычных нейросетях, так как работают сразу с двумя измерениями признаков — действительной и мнимой частью.

👀Где их можно использовать?
Они хорошо применимы, где идет работа с фазами или амплитудами, с помощью таких сложных штук, как преобразование Фурье, можно разложить звуковую дорожку на амплитуды, колебания, фазы и работать с этим, однако в современных решениях не находил, чтобы такой вид нейросетей применялся, но может быть скоро их где-то увидим :)

На пути R&D: 1298
@RnDLabs | #funfact@rndlabs


Data Secrets dan repost
Российские школьники победили на Международной олимпиаде по ИИ

Она проходила в Китае 2-8 августа. Российские школьники завоевали 8 медалей, в том числе 6 золотых, 1 серебряную и 1 бронзовую. Это абсолютный рекорд среди 61 страны. В общекомандном зачете, кстати, сборная тоже вошла в топ.

Кажется, растет новое поколение крутых исследователей.

Изо всех сил радуемся и поздравляем ребят! 🎉


Наши разнесли Международную олимпиаду по ИИ в Китае(та самая IOAI) — 6 золотых, 1 cебренная и 1 бронзовая медаль, больше всех остальных стран!

Поздравляю наших слонов с победой!🔥

@RnDLabs


Попробую новый формат в канале. Обзор статьи Text-to-LoRA: Instant Transformer Adaption | arxiv

TL;DR
Меня заинтересовал концепт гиперсетей, о котором я раньше не слышал, и то, что сделали в статье, вызвало вопрос: можно ли теперь вручную не прописывать LoRA для моделей и тратить "млрды" времени и ресурсов на дообучение? После прочтения оказалось, что можно :)
Введем пару терминов и сокращений, чтобы понимать происходящее:
1. Text-to-LoRA (T2L) — модель из статьи, которая по текстовому описанию задачи может генерировать LoRA-адаптеры или сжимать их для больших языковых моделей (LLM).

2. Large Language Model (LLM) — большая языковая модель.

3. Supervised Fine-Tuning (SFT) — контролируемое дообучение модели с учителем (на основе правильных меток).

4. Low-Rank Adapters (LoRA) — метод SFT, добавляющий адаптеры в модель через низкоранговое разложение матриц A и B, что облегчает обучение больших LLM.

5. Zero-shot — способность модели работать с новыми, ранее не встречавшимися данными без дополнительного обучения, как человек, который применяет знания к новым ситуациям.

🌧️🌧️🌧️🌧️🌧️🌧️🌧️🌧️🌧️🌧️
О чем статья?
Авторы демонстрируют свою новую гиперсеть T2L, которая может адаптировать базовую LLM с помощью LoRA за мгновенье с помощью естественного языка
We introduce Text-to-LoRA (T2L), a model capable of adapting large language models (LLMs) on the fly solely based on a natural language description of the target task.

т.е. написать для решения математической задачи такой промпт:
This task challenges your problem-solving abilities through mathematical reasoning. You must carefully read each scenario and systematically work through the data to compute the final outcome.

Она добавит подходящий адаптер, и тогда базовая модель сможет правильно решить задачу

Архитектура T2L
T2L включает три варианта по размеру: S (small), M (medium) и L (large). Основные компоненты:

Task emb — векторное представление задачи (например, решение математической задачи)
Task enc — кодирование задачи в скрытое представление
Module emb — Для каких модулей нужны адаптеры
Depth emb — На каких слоях ставить адаптеры
MLP — многослойный перцептрон, обрабатывающий полученные эмбеддинги
A/B emb, Rank emb — задают структуру адаптера относительно архитектуры (S, M, L)
Head — итоговый выход — сгенерированные LoRA-адаптеры

Обучение T2L
(Схему обучения прикреплю в коментах). Модель может обучаться двумя способами:
1. Reconstruction W -> Пытается реконструировать, в контексте данной задачи, десцелировать адаптеры, сжимать их

2. SFT , Loss -> Обучается напрямую на задачах с размеченными данными, минуя стадию реконструкции адаптеров и сразу их генерирует
В итоге лучший результат для zero-shot был SFT


Результаты
Модель круто сжимает адаптеры в 64, 128 и 256 раз с небольшой потерей производительности. Архитектуры T2L среднего (M) и большого (L) размеров генерируют LoRA-адаптеры, превосходящие сильный мультизадачный бейзлайн MT-LoRA, который не учитывает специфику каждой задачи, тогда как T2L успешно использует текстовое описание для лучшей адаптации

Плюсы:
✅ Не нужно обучать отдельные адаптеры для каждой задачи — достаточно текстового описания
✅ Мгновенная генерация адаптера позволяет быстро и дёшево адаптировать модель под новые задачи
✅ Делает настройку ИИ-моделей доступной для широкого круга пользователей

Минусы❓
❌ Слишком тонкая настройка под определенную задачу через промпт
❌ Для какой-то сильно уникальной задачи будет тяжко и лучше написать самостоятельно

На пути R&D: 1232
@RnDLabs | #ArtOverview@rndlabs


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
А вот и обещанная пасхалка, если кто не видел

🥚 ПАСХАЛОЧКА
Оставил пасхалку - если найдете, то пишите в комментах.


На пути R&D: 1215
@RnDLabs | #web@rndlabs


Запилил, наконец, персональный сайт!

Вдохновился сайтами крутанов с NEOAI.
Захотел сделать что-то свое оригинальное и лаконичное. Придумал такую идею. Зацените - levandox.com

Хост - домашний сервер
Время разработки - часов 8-10, включая эксперименты с разными идеями.
Стек - React, впервые с ним познакомился.

🥚 ПАСХАЛОЧКА
Оставил пасхалку - если найдете, то пишите в комментах.

На пути R&D: 1208
@RnDLabs | #web@rndlabs


🚀 На отборе IOAI: финишная прямая и впечатления

📅 6 мая приехал на отборочный тур международной олимпиады по ИИ. Сегодня — уже последний 6 день

🌍 Локация:
Живём в СберУниверситете - это супер место! Территория огромная: лес, река, водопады, лабиринты из кустов... Инфраструктура тоже не уступает: бассейн, бильярд, баня, спортзал, маршруты на несколько км вдоль

💻 Соревнования:
3 дня (7-9 мая) — по 6-7 часов кодинга интересных заданий без перерывов, еду нам приносили к месту. Результаты +- в середине таблицы, но главное - +опыт.

🎤 После задач:
Вечерами — много воркшопов. Например, выступал Себрант (Яндекс), но честно — после 6 часов кода мозг немного «закипает»....

В следующем году обязательно залечу еще раз :)

На пути R&D: 1199
@RnDLabs | #IOAI@rndlabs


🚀Моё близкое знакомство с моделью SAM

🔍Как дошёл до этого:
— В процессе подготовки к финалу, который состоится уже завтра, DLS решил потренироваться в сегментации. Начал с YOLO - куча сверточных слоёв дали неплохой результат на валидации, но хотелось посмотреть и другие модели

— Переключился на SAM и я его могу описать как «графический трансформер» - энкодеры, декодеры, механизмы внимания, работа с эмбеддингами изображений. Есть у него особенность, он работает только с подсказками (изначально так обучался) и есть возможность zero-shot. Zero-shot продемонстрирован на фотке, я предполагаю, что из-за архитектуры трансформера, после обучения у него сложились представления об объектах и модель очень хорошо может их выделять. Довольно мощно


⚙️ Что делать если нет подсказок?
— Можно создать ансамбль из YOLO, детектить объекты и передавать рамки в SAM, получая итоговые маски.
Но на финале DLS (7 задач за 6 часов) такие ансамбли — роскошь :)

— Ещё есть идейка CLIP + SAM: текстовые промпты («объект справа внизу, квадратный, мелкий») CLIP поможет объединить ембеддинги текста с ембеддингами изображений и, так как SAM знает устройство объектов, то можем получить соответствующую маску

На пути R&D: 1186
@RnDLabs | #cv@rndlabs


🔥 Завершение онлайн-подготовки к IOAI. Что дальше?

Важный рубеж: закончилась полугодовая онлайн-часть курса по подготовке к IOAI (международная олимпиада по ИИ в Китае)!

О курсе 💡
Сказать, что это было круто — ничего не сказать. Это топовый уровень:

▸ Преподаватели-практики из лучших вузов всего мира, топовых AI-компаний и гранд мастеров kaggle. Много семинаров с качественной и понятной подачей, о которых можно с ними же и обсудить

▸ Программа — от классического ML до диффузионных моделей. Интересные соревнования, для которых нам выделили сервер с большим кол-во ресурсов так как приходилось работать с LLM моделями

▸ Комьюнити — 80+ человек со всей России и не только. Со всеми приятно общаться и все шарят в этой теме

Что впереди? 🚀
Уже 6–11 мая — очный этап в Москве. Организаторы обещают условия, максимально приближенные к IOAI.


На пути R&D: 1181
@RnDLabs | #Хахатоны@rndlabs


Прошёл в финал олимпиады DLS! 🚀

Прошёл отборочный этап олимпиады, о которой писал в прошлом посте:

Об олимпиаде
С 5 по 6 апреля проводился отборочный тур олимпиады DLS, на решение давалось 24 часа. По призам:
Победителям и призером подарят какие-то подарочки и мерч, также 5 баллов ИД (индивидуальные достижения) на поступление в бакалавриат МФТИ. Моя цель - мерччч🧦


и недавно стали известны результаты, занял 6 место из 100+ участников, а значит прохожу в финал (проходят первые 30 мест), очень этому рад 👍

Следующий шаг - финал, который должен пройти 29 апреля, мерч все ближе 👀

PS
Сильно болел, поэтому не было постов, начинаю восстанавливаться :)

На пути R&D: 1174
@RnDLabs | #Хахатоны@rndlabs


Вы знали, что слово "1C" повышает вашу заработную плату, а слово "python" сильно понижает?)
Deeper Learning School

Сегодня решал олимпиаду и наткнулся на такой интересный результат анализа значимости слов в вакансиях 🐍

————————

Об олимпиаде
С 5 по 6 апреля проводился отборочный тур олимпиады DLS, на решение давалось 24 часа. По призам:
Победителям и призером подарят какие-то подарочки и мерч, также 5 баллов ИД (индивидуальные достижения) на поступление в бакалавриат МФТИ. Моя цель - мерччч 🧦

Что я думаю?
Отборочный тур был супер, многое вспомнил в теоретической части и в целом задачки интересные. Почти во всем уверен, надеюсь, что пройду :) Результаты прибегут в ближайшее время.....🕒 А теперь пришло время сесть за школьное дз (нет) 😂

На пути R&D: 1164
@RnDLabs | #Хахатоны@rndlabs

20 ta oxirgi post ko‘rsatilgan.