Китайцы MiniMax выпустили новую модель для ИИ-агентов с 1млн контекста, при этом цен дешевых больше нет
M3 - это новая флагманская модель от китайской компании MiniMax, которая позиционируется как фронтир для программирования, агентных задач с поддержкой в 1млн контекста и мультимодальная.
Архитектура у М3 - MiniMax Sparse Attention (MSA) - новая разреженная архитектура внимания. По сравнению с M2: префилл в 9.7раз быстрее, декодирование в 15.6раз быстрее на 1млн токенах.
Также с релизом M3 MiniMax сильно урезали тарифы.
Старый Plus ($20) раньше давал ~18 млрд токенов, а теперь ~1.6–1.7 млрд.
Чтобы вернуть прежний объём, нужно перейти на тариф Max за $50.
Это не первый случай, когда китайцы убирают низкие цены, ранее мы писали об этом же на примере Alibaba/Qwen ; Zhipu/GLM. А тут мы объясняем с чем это связано и как теперь на этом зарабатывать.
M3 - это новая флагманская модель от китайской компании MiniMax, которая позиционируется как фронтир для программирования, агентных задач с поддержкой в 1млн контекста и мультимодальная.
Архитектура у М3 - MiniMax Sparse Attention (MSA) - новая разреженная архитектура внимания. По сравнению с M2: префилл в 9.7раз быстрее, декодирование в 15.6раз быстрее на 1млн токенах.
Также с релизом M3 MiniMax сильно урезали тарифы.
Старый Plus ($20) раньше давал ~18 млрд токенов, а теперь ~1.6–1.7 млрд.
Чтобы вернуть прежний объём, нужно перейти на тариф Max за $50.
Это не первый случай, когда китайцы убирают низкие цены, ранее мы писали об этом же на примере Alibaba/Qwen ; Zhipu/GLM. А тут мы объясняем с чем это связано и как теперь на этом зарабатывать.