🧠 JetBrains выпустила Mellum2.1: открытую модель для своих агентов на своём железе
Это не готовая фича в IDE и не замена Claude или GPT, а модель для тех, кто собирает своих агентов или хочет держать код у себя. Внутри 12B MoE (2.5B активных), лицензия Apache 2.0. Новое дал RL: в миллионах sandbox'ов модель училась изучать репозиторий, править файлы и проверять изменения.
Сценарии от JetBrains:
👉 исполнитель в агентной системе: найти причину падающего теста, набросать фикс и проверить его
👉 быстрый sub-agent: под нагрузкой почти вдвое быстрее Qwen3.5-9B, а с MTP одиночный запрос быстрее в ~1,6 раза
👉 приватный self-hosted деплой
👉 общий ассистент, включая математику и reasoning
⚠️ Важно: сравнивают с моделями класса 9B. На SWE-bench Verified рост с 2 до 47, но Qwen3.5-9B выше (50). Цифры от JetBrains, про IDE и Junie в анонсе ничего.
На Hugging Face уже есть веса и GGUF для llama.cpp, Ollama и LM Studio, а MTP head для vLLM будет позже.
🔗 Анонс в блоге
🤗 Hugging Face
#AI #JetBrains #Mellum #LLM
Это не готовая фича в IDE и не замена Claude или GPT, а модель для тех, кто собирает своих агентов или хочет держать код у себя. Внутри 12B MoE (2.5B активных), лицензия Apache 2.0. Новое дал RL: в миллионах sandbox'ов модель училась изучать репозиторий, править файлы и проверять изменения.
Сценарии от JetBrains:
👉 исполнитель в агентной системе: найти причину падающего теста, набросать фикс и проверить его
👉 быстрый sub-agent: под нагрузкой почти вдвое быстрее Qwen3.5-9B, а с MTP одиночный запрос быстрее в ~1,6 раза
👉 приватный self-hosted деплой
👉 общий ассистент, включая математику и reasoning
⚠️ Важно: сравнивают с моделями класса 9B. На SWE-bench Verified рост с 2 до 47, но Qwen3.5-9B выше (50). Цифры от JetBrains, про IDE и Junie в анонсе ничего.
На Hugging Face уже есть веса и GGUF для llama.cpp, Ollama и LM Studio, а MTP head для vLLM будет позже.
🔗 Анонс в блоге
🤗 Hugging Face
#AI #JetBrains #Mellum #LLM