Фильтр публикаций


Про БАДы

За последние пару лет я заметил у себя довольно устойчивую корреляцию между эффективностью, здоровьем и уводольствием от жизни. Это напрямую влияет и на харды, и на софты.

Пик осознания пришелся на осень, когда я обнаружил у себя потерю настроения одновременно с дефицитом витамина Д. И исправил это.

Речь не про «волшебные таблетки». И банальности писать не хочется. Я считаю, что разбор этой темы выходит за рамки любого телеграм-поста.

Поэтому я просто составил субъективный тир-лист добавок, основанный на личных наблюдениях за несколько циклов приема.

Делитесь своим топом в комментариях, с наступающим!


🏆 Yandex Cup ML track 2025

Совершенно новый опыт для меня - финал в формате 5-часового контеста в духе ICPC и IOAI. Три задачи, каждая решалась идейно, а с техникой и дебагом помогал вайб-кодинг.

Первые три часа просидел в конце лидерборда, борясь с первой задачей. Переключившись на более сложные, за оставшиеся два часа удалось прыгнуть в топ паблика. После шейкапа удержал первое место - в последней задаче даже достиг авторского решения.

Третья победа подряд за месяц (еще AIJJC), 1.5М призовых суммарно - я в прайме. И это не случайность: последнее время уделял здоровью и навыкам работать эффективно особенное внимание. Про это напишу в следующем посте.

1.3k 0 16 11 112

AIDAO 2025. Сделили это снова!

О задаче:
Необходимо построить Bird's-Eye View сегментационную карту ограждений по 4 камерам с автономного транспорта. По сути, 2D-оценка проходимости в координатах машины: каждая BEV-ячейка говорит, можно туда ехать или нет.
По уровню сложности/интересности на класс выше всех задач, что я видел на подобных соревнованиях.

Что сделали?
- Взяли сильные енкодеры (convnext, etc) для мультикамерных фич.
- С помощью intrinsics и extrinsics между машиной и камерами перекидывали image-фичи в BEV-пространство.
- В BEV-пространстве сверху поставили UNet-like декодер на обычных свертках.
- Добавили Gaussian supervision: на тонких линиях bce loss работал плохо, поэтому предсказывали более мягкий таргет - размытую область.
а также работали с аугами, фильтрацией и ембеддингами машин.


Ощущения:
Мы лидировали на лидерборде все время, и "убегать" оказалось тревожнее, чем "догонять" - особенно учитывая личные ожидания по перфомансу. Тем не менее, мы поймали свою волну, стабильно усиливались с каждой посылкой и имели запас времени в несколько часов)

github - код решения
Спасибо Даше за блестящую работу! Ее впечатления на itmo news


TOEFL С1.

Расскажу, как прокачал две самые сложные секции - Speaking и Writing. О них полно информации в интернете, но поделюсь именно тем, чего там не нашёл.

При подготовке критически важны две вещи: практика и обратная связь. Если с Listening и Reading всё понятно - правильный ответ один, то оценить своё письмо или устную речь практически нереально, особенно если готовитесь самостоятельно, без репетитора.

Writing я прокачивал с помощью Claude 4 и ChatGPT 4.5. Незамысловатный промпт, созданный гпт на основе критериев, позволяет получить скор, детальный фидбэк и, главное, образец того, как должно быть. Задав целевые метрики, двигаешься в сторону их максимизации. (Я тренировался с подсветкой опечаток и получал обычно выше балл - не повторяйте эту ошибку)

Самое эффективное, что помогло поднять Speaking с уровня робота 🤖 с постоянными "эээ" до advanced балла буквально за три недели - это чтение вслух на английском. Всего 20-30 минут перед сном: 1) улучшился контроль скорости речи и дыхания; 2) я начал говорить фразами, а не отдельными словами.

Надеюсь, что в ближайший год выкатят full-duplex speech2speech ллмки и изучать любой язык (навык) станет гораздно доступнее

587 0 17 14 37

На яндекс капе взял третье место в треке Self-Driving Cars.
Надо было предсказать траекторию движения, получая информацию о повороте руле (steering) и acceleration и первых пяти секунд траектории.

Таска очень понравилась, много вариативности, хороший датасет и пространство для маневров. Например, второе место на бустингах и физике, первое на lstm и анализ карты высот и в обоих решениях провели блестящую работу по анализу данных.

Я выбрал для себя путь оверинжиниринга, поиграться с lstm, разными енкодерами, вниманием. Потому что было интересно успеть именно это в сжатые сроки участия.

Конечно же, самая приятная часть капа - оффлайн финал в другой стране, нетворк. Половину ML финалистов уже знаю с прошлого года))


В комментарии скину фоточки из Ташкента, почуствуйте

- github
- Запись с топ решениями (я с 39.04)

505 0 13 31 45

Победили на международной студенческой олимпиаде AIDAO — Artificial intelligence and data analysis Olympiad

Задачка классная, много точек для творчества и экспериментов даже в серьезных рамках инференса (CPU, 1.5 GB ram)
Всего было 32 часа на решение, очень сильно помогли насмотренность и инженерная интуиция.
Забавно вышло, что один из трешхолдов конечного пайплайна я поставил на глаз, а после перебора он оказался лучшим)

Конкуренция была действительно высокой, на отборе 350+ активных команд (в т.ч. из других стран), в финале 30, в среднем по 3 человека. Спасибо Даше за потрясающую командную работу. Нас было двое, так что "проходили на сложных настройках"))

Лидеры паблика сменялись буквально каждый час, нереальный pace-make. За час до конца мы решили отказался от стабильного ансамбля маленьких моделек и закинуть одну модель побольше, лучшую по валидации, но, очевидно, менее стабильную к шейкапу.

Эмоциально самая приятная победа из всех:
Cильнейшие соперники, равные условия по времени и компьюту, красивое решение из соло модели.

upd: github

- Про задачу подробности: https://habr.com/ru/news/863312/
- https://t.me/aitalenthubnews/1383
- https://news.itmo.ru/ru/university_live/achievements/news/14067/

737 0 9 14 48

Всем привет! Я стал частью команды фундаментальных исследований MTS AI-chat core team

Создание и состав команды заслуживает лонгрида и я лучше сошлюсь на хабр статью, рекомендую к прочтению!!

Год назад я не представлял об академических и карьерных возможностях, которые могут открыться. Комьюнити (особенно aith) помогли мне узнать о них и воспользоваться этими шансами.

важно найти место, которое даст возможность реализовывать личные амбиции и цели, где твои kpi сонаправленны с kpi команды с запасом роста на несколько лет.


Заняли 3 место (100к) из 25 команд на региональном цифровом прорыве этого сезона

Кейс и данные понравились - поиск по музейных экспонатам и генерация описания по 45к пар картинка-текст, некоторые объекты имели по 50 фоток. Был ЛБ по классификации экспонатов, где мы с отрывом в 10% были топ1, но вес он имел такой же, как и презентация

по стеку:
- поиск по CLIP + faiss, удаление дублей по хэшу
- генерация описания через Omnifusion + RAG на исходной картинке и топ 10 близких описаний
- для классификации clip knn и resnet34 (still 🌿 🕸?) 🤩 с грамотными аугами и блендингом


по традиции, презентация, решение, а также стратегии с первого места в комментах

2.9k 0 19 14 34

Выиграли с ребятами международный хакатон в Сириусе в рамках World Youth Festival.

Задача состояла в детекции и трекинге рыб с камер go pro на Камчатке. Оценивали по метрике IOU и фичам, два дня на решение
Поделюсь с вами секретами, которые позволили нам выиграть

по технической части:
- Label studio ML backend
позволяет реализовать auto-labeling, pre-annotation и active learning. Сила в том, что предсказания можно редактировать, что зачастую не успевают реализовать в обычных UI решениях на хакатоне.

по скору на лб:
- Weighted box fusion
Кагловский способ выбить лучший скор - сблендить несколько detection моделей или TTA (test time augmentations).

по презентации:
- Оцените экономический эффект, посчитайте прибыль. Хотя бы примерно оцените стоимость железа и масштабируемость. Не грузите жюри фреймворками, графиками лосса и гиперпараметрами - это скучно.

Итого: +500к, посетили фестиваль, сочи парк, пообщались с зарубежными коллегами. В комменты скину презентацию и фотки с путешествий

3k 0 26 17 46

Всем привет!
Я стал частью R&D команды лаборатории нейронных систем и глубокого обучения МФТИ - DeepPavlov.

Лаборатория, изначально входившая в состав физтех-био, начинала с исследований естественных нейронных сетей. Однако со временем фокус сместился к разработке алгоритмов глубокого обучения, обработке естественного языка, созданию диалоговых систем и, что особенно важно, к исследованиям в области обучения с подкреплением, когда это еще не было мейнстримом.

Интересный факт: как вы могли догадываться, названиe DeepPavlov вдохновлено именем ученного Ивана Петровича Павлова, чьи исследования условных рефлексов положили начало методам обучения с подкреплением и подчёркивают взаимосвязь между естественной наукой и современным ИИ.

В лаборатории сосредоточены выдающиеся исследователи и разработчики, чьи opensource(!) библиотеки и научные работы вносят значительный вклад в глобальное развитие AI и NLP.

Для меня — это огромный шаг вперёд в профессиональном и академическом развитии, возможность участвовать в проектах, которые меняют мир.


22

Подведя итоги года, всегда хочется оценить его количественно, посчитать грейды, медальки, галочки в ту-ду листах.
Но ведь самое важное — это то, что не укладывается в рамки таблиц, диаграмм и дискретных точек, не так ли?


Всем привет 🙃

Прошедшие выходные я провел в Алматы, на финале Yandex Cup.

Побег из рутины и шикарный отель способствовали отдыху как духовно, так и физически. В то время, пока участники бились за кубок в день финала, в секции МЛ шел разбор топ решений и ламповый нетворк.

Возможность пообщаться с коллегами по цеху в неформальной обстановке - бесценна. Каждый имеет уникальную траекторию развития и во время нетворка открывает для себя новые карьерные и академичные перспективы, о которых и не задумывался.

Такие мероприятия дарят чувство быть «среди своих».
Спасибо 📱

К слову, не пропустите новогоднюю ML-тренировку. До встречи!


💊 Another med kaggle, another medal

Привет, друзья!
Завершилось соревнование RSNA по классификации травм на КТ-снимках, наша команда вошла в топ 6%!

Первые две медали были для меня знаком победы, но на этот раз испытал небольшое разочарование. Это неотъемлемая часть пути.
При этом, соревнование действительно оказалось тяжелым, не многие преодолели "константное" предсказание.

Что пошло не так?
Мы выбрали один подход и придерживались его: 3D сегментация и 3D классификация отдельных органов. Это оказалось неверным решением: люди в топе использовали пайплайны проще, основанные на 2D.

Какие преграды встретились?
В начале соревнования нас было пятеро, до конца дошло лишь трое. Пики вовлеченности не совпали и помимо задачи приходилось решать орг. вопросы.

Что можно улучшить?
Разделять зоны ответственности и дедлайны. Грамотно наладить валидацию и проверять больше гипотез, установить культуру проведения экспериментов.

Спасибо команде за отвественность и самоотдачу: Егору (пост о соревновании с его точки зрения, рекомендую) и Дане.

PS.
Вайб поста обусловлен небольшим выгоранием)

PSS. Э
то соревнование позволило нам пройти отбор на международный хакатон в Сириус, подробности в марте


🏆 Цифровой прорыв 2023 взят!

🎯 Кейс заключался в создании HR-бота на основе LLM, отвечающего на вопросы по базе знаний.

🛠 И не обошелся без своих трудностей: Во-первых, условия запрещали использование онлайн API, что добавило нам задачу подъема LLM на своих мощностях.

📑 Второй проблемой стали файлы с базой знаний, большая часть которых имела слабоструктурированный текст в разметке markdown.

🕒 Первый (из двух) дней хакатона выпал на наши рабочие дни, мы практически ничего не сделали. Спасибо команде за дух и боевой настрой! Мы взяли себя в руки и за несколько часов до защиты произошла... ✨магия ✨
Бот, бэкенд и модель, разрабатываемые параллельно, безошибочно взаимодействовали.

И это тот самый случай, когда важны техническая часть (был лидерборд) и дизайн (в комментах скину демку).
Делюсь с вами презентацией и кодом.

Изучайте, делитесь, участвуйте и побеждайте!

trust the process. stay tuned.

2k 0 17 9 19

🤓 Готовь сани курсы летом!

Привет, друзья!
Пост о ресурсах для самообразования вызвал у вас интерес. Сегодня рассказываю о бесплатных курсах.

*️⃣ Deep Learning School - (сейчас набор!) курс от МФТИ, активное комьюнити, хорошая база по DL, два независимых семестрам с лекциями и дз. Первый посвящен классическим алгоритмам и компьютерному зрению (ML/CV), второй - обработке текста и аудио (NLP/Audio)

*️⃣ Курсы Samsung по CV и NLP - аналогичны DLS, но более хардкорные задания: математика и реализация алгоритмов с нуля. (На старте карьеры не потянул:))

*️⃣Курс ШАД по NLP - приятное повествование и визуальное оформление. Задания от NER до тюна LLM.

*️⃣ Магистерский курс по NLP от МФТИ - блокноты двух версий - самостоятельное решение и ответы. Видео и текстовые лекции, презентации, расписанные по неделям.

*️⃣ курсы MLops и ML System Design - прикладная реализация ML систем. На них вы научитесь культуре экспериментирования и переносу моделей в продакш. Приближены к реальном работе.

Дополнительно:
*️⃣Магистерский курс МФТИ modern state of AI.
*️⃣ Список курсов с ODS.

Пересечений тем множество, выбирайте оптимальную траекторию обучения.

Делись с другом и ставь 🔥, если не слышал о них


Финал хакатона 🔓 (техническая часть)

Завершился хакатон «Цифровой прорыв» в Питере, наша команда прошла в финал и заняла 5/20 место🏅

Нам предстояло найти ключевое слово и соответствующее ему число на изображении. Для этого мы использовали технологии OCR и отношения между ключевыми словами.

Процесс:
- классификация соц. сети по скриншоту.
- прочтение текста с помощью EasyOCR;
- выделение пар слово-число с помощью AgglomerativeClustering и анализа графов.

Было реализовано два варианта выделения пар - через ближайшее число к ключевому слову и через нахождение минимального подграфа.
На этом весь ML закончился.

Сложно сказать, чего нам не хватило для победы, ведь лидерборда и метрик не было - лишь оценки судей на основе презентаций.
Можете ознакомится с решением.


⬆️ Инструменты и ресурсы для самообразования

Привет всем!🍸

Перед началом учебного года и в преддверии бурной активности (2 хакатона 🔓 и 1 кагл минимум), я решил взять небольшой перерыв и вам советую. Важно использовать это время с пользой и составить план обучения на семестр. Делюсь ресурсами, которые помогли мне и которыми я регулярно пользуюсь:

🌡 Практика без теории слепа.

И приводит к стагнации на раннем этапе, поэтому ботаем хэнбук от яндекса с отличной визуализацией или/и фундаментальные лекции Воронцова.

😵 Теория без практики мертва.

И не дает реальных навыков, поэтому закрепляем каждую главу в виде задачек на кагле или coderun. Кстати, лидер последнего сезона Coderun в категории ML поделился своими решениями и советами — настоятельно рекомендую ознакомиться!

🪙 Профессиональное видение - ценность специалиста.

Оно нарабатывается не только опытом, но и постоянным обучением, обменом знаниями и саморефлексией. Важно следить за передовыми решениями и анализировать текущие тенденции.
Здесь можно изучать актуальные статьи, а тут — разбираться с кодом к ним, строка за строкой.

Делитесь своими источниками знаний в комментариях! Следующий пост будет про полноценные курсы


Поднимаюсь на новую ступень своего Kaggle пути:
теперь я - Kaggle Expert 🧑‍🏫

Второе соревнование завершается уверенной бронзой на позиции 376/6712, однако безумный шейкап на тысячи мест и качество данных оставляет больше вопросов, чем ответов.

Я прокачал скилл AutoML и хочу с вами поделится своим решением:

🛠 Feature engineering - автоматическая генерация новых фич на основе существующих и отбор с помощью корреляционного анализа

📊 Multilabel stratification - итеративная стратификация по нескольким переменным, позволяет достичь стабильной кросс валидации при дисбалансе/перекосе в данных

🕯 Ensemble+optuna - построение ансамбля моделей автоматическим подбором весов и трешхолдов с помощью optuna

решение


Дайджест текущих соревнований:

🗣️ Bengali.AI Speech Recognition

Распознавание индийского диалекта, отличный вариант прокачаться в области ASR на стыке с NLP.

✍🏻 CommonLit - Evaluate Student Summaries

Задача по оцениванию эссе студентов. Необходимо определить, насколько хорошо студент (а может и чатгпт в будущем) раскрыл тему и качественно передал свою мысль - одна из самых горячих областей NLP на стыке с ранжированием RecSys.

🩻 RSNA 2023 Abdominal Trauma Detection

Детекция и классификация травм живота на компьютерной томограмме. Много данных, классов и типов болезни - есть где развернуться. Из интересных технологий - применение 2.5D или 3D CNN для серии КТ снимков.

👀 MosquitoAlert (18 дней до конца первого этапа)

Задача по детекции и классификации комаров на снимках пользователей (в основном 1 комар на ладони/столе). Идеально, чтобы влиться в сферу CV, личная рекомендация для новичков.


🔬 В одном клике от золота или мой дебют на Kaggle 🔬

Привет, друзья! Сегодня я хочу поделится с вами опытом с недавнего соревнования от лаборатории HuBMAP по сегментации клеток.

Я присоединился к соревнованию совершенно спонтанно всего за две недели ⏳ до его завершения. Это был настоящий вызов, и в последние дни приходилось работать в ужасном цейтноте, но именно тогда я смог сделать одни из лучших посылок.

Благодаря ценным советам и поддержке от дружественного сообщества Kaggle, мне удалось отправить свою первую рабочую посылку всего за пару часов! 🚀

Одной из основных трудностей, с которой столкнулись все участники - ограниченное количество качественно размеченных данных и подавляющее большинство некачественных (вполне реальный кейс). Ни кросс-валидация, ни лидерборд не давали ясный ориентир. В подобных ситуациях интуиция и профессиональная насмотренность👀 играют ключевую роль.

Как раз из-за цейтнота я не смог грамотно выбрать финальное решение, которое позволило бы занять золотые или серебрянные места. В итоге, крепкая бронза 🥉 55/1064.

Всего на несколько дней я углубился в тему сегментации и это дало буст не только в соревнованиях, но и в работе🧠. Уже не первый случай, когда технологии с хакатонов/сорев идут в продакшн.

Для вас я подготовил репозиторий с полным решением: от EDA до инференса.
ключевые слова: adversarial validation, multilabel stratification kfold, maskrcnn, yolov8, Unet++, test time augmentation, weighted box fusion.

Показано 20 последних публикаций.

834

подписчиков
Статистика канала