🇰🇷 Едем на ICML 2026 в Корею!
Команда уже в пути для участия в одной из самых престижных конференций по машинному обучению.
📄 4 статьи лаборатории приняты в основной трек конференции:
🛠️Также мы участвуем в двух воркшопах:
*️⃣Две из принятых статей написаны с коллегами из Yandex Research, небольшой разбор они публиковали в своем канале
До встречи в Сеуле! 👋
Команда уже в пути для участия в одной из самых престижных конференций по машинному обучению.
📄 4 статьи лаборатории приняты в основной трек конференции:
▪️ One-Step Gradient Delay is Not a Barrier for Large-Scale Asynchronous Pipeline Parallel LLM Pretraining
▪️From Optimization to Generalization under Heavy-Tailed Data: The Role of Gradient Clipping
▪️Softsign: Smooth Sign in Your Optimizer For Better Parameter Heterogeneity Handling
▪️Gradient-Free Approaches is a Key to an Efficient Interaction with Markovian Stochasticity
🛠️Также мы участвуем в двух воркшопах:
1️⃣Workshop on Connecting Low-rank Representations in AI
▪️Tensorion: A Tensor-Aware Generalization of the Muon Optimizer - совместно с ВШЭ
2️⃣Workshop on Weight-Space Symmetries
▪️Hierarchical Mixture-of-Experts with Two-Stage Optimization
▪️Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression
Analyzing Stream Collapse in Hyper-Connections: From Diagnosis to Mitigation
*️⃣Две из принятых статей написаны с коллегами из Yandex Research, небольшой разбор они публиковали в своем канале
До встречи в Сеуле! 👋