lect02_Тренировки_Data_Dojo_26s_LLM_и_Малоресурсные_языки.pdf
Прилагаю слайды и подборку ссылок по прошедшей лекции. Если в телеге слайды не загружаются – вот ссылка на диск.
Как правильно фармить kaggle – Классная статья, не только про kaggle, а про то, как построить правильный pipeline для ML экспериментов.
Выступление Салавата про межславянский язык с DataFest 2025
NLLB – No Language Left Behind: блогпост, модель и статья
Tiny Aya – модель-переводчик для малоресурсных языков, февраль-март 2026: блогпост, модель и статья
Lingtrain – упомнинал про чудесный инструмент для выравнивания книжек на разных языках (и не только) за авторством Сергея @doomgrad
Если что-то еще хотели бы добавить – пишите в комментарии :)
Успехов! И доброго всем вечера)
Как правильно фармить kaggle – Классная статья, не только про kaggle, а про то, как построить правильный pipeline для ML экспериментов.
Выступление Салавата про межславянский язык с DataFest 2025
NLLB – No Language Left Behind: блогпост, модель и статья
Tiny Aya – модель-переводчик для малоресурсных языков, февраль-март 2026: блогпост, модель и статья
Lingtrain – упомнинал про чудесный инструмент для выравнивания книжек на разных языках (и не только) за авторством Сергея @doomgrad
Если что-то еще хотели бы добавить – пишите в комментарии :)
Успехов! И доброго всем вечера)