⚡️ Вышла Muse Glimmer 30B: локальная модель для кодинга помещается в 24 ГБ памяти
На прошлой неделе компания Цукерберга выпустила в бету Muse Code, терминального кодинг-агента на базе большой модели Muse Spark 1.2. На Terminal-Bench модель уступила только Opus 5, обойдя GPT-5.6 Terra, Grok 4.5 и Gemini 3.6 Flash.
Для ускорения генерации также добавили небольшую вспомогательную модель: с ней Glimmer выдаёт в среднем 233 токена в секунду на RTX 5090, 50 на M5 Max и 38 на M4 Max.
@ai_for_devs
На прошлой неделе компания Цукерберга выпустила в бету Muse Code, терминального кодинг-агента на базе большой модели Muse Spark 1.2. На Terminal-Bench модель уступила только Opus 5, обойдя GPT-5.6 Terra, Grok 4.5 и Gemini 3.6 Flash.
Теперь опубликовали на Hugging Face веса Muse Glimmer. Это мультимодальная модель на 30 млрд параметров с контекстом 131к токенов, лицензией Apache 2.0 и 17-гигабайтной квантизацией для запуска на устройствах с 24 ГБ памяти.
В агентном кодинге она заметно сильнее Gemma4-31B, а с Qwen3.6-27B идёт примерно вровень: Glimmer лучше на SWE-Bench Pro, Qwen лучше на Terminal-Bench.
Для ускорения генерации также добавили небольшую вспомогательную модель: с ней Glimmer выдаёт в среднем 233 токена в секунду на RTX 5090, 50 на M5 Max и 38 на M4 Max.
@ai_for_devs