DeepGrove старается предоставиться нами фронтир интеллидженс он эни девайс и для этого совмещает все:
Превью maple — это MoE модель с 20.2B параметрами из которых активных 1.49B, сквантованная в 2,5 бита (они называют это тернарными TQ1 и TQ2), весит от 6 гигабайт и ниже (в зависимости от кванта), показывает скорость на процессорах от 46 токенов в секунду на DDR4, что очень вкусно для локального запуска даже без видеокарт.
А главное — бенчи! Немного уступает Qwen3.5-35B-A3B и превосходит всех конкурентов. И это превью версия! Есть шанс, что на релизе релиза будет прям отличной моделью (учитываем размер и скорость!).
Без вижна, но в дуэте с LFM-2.5-VL-3B смотрится уже интересно для агентов.
Для любителей покопаться, есть ускорение на CUDA.
Осталось придумать применение, конечно, и опробовать ролеплей.
#нейросеть #нейросети #neuralnetwork #neuralnetworks #генерациятекста
Превью maple — это MoE модель с 20.2B параметрами из которых активных 1.49B, сквантованная в 2,5 бита (они называют это тернарными TQ1 и TQ2), весит от 6 гигабайт и ниже (в зависимости от кванта), показывает скорость на процессорах от 46 токенов в секунду на DDR4, что очень вкусно для локального запуска даже без видеокарт.
А главное — бенчи! Немного уступает Qwen3.5-35B-A3B и превосходит всех конкурентов. И это превью версия! Есть шанс, что на релизе релиза будет прям отличной моделью (учитываем размер и скорость!).
Без вижна, но в дуэте с LFM-2.5-VL-3B смотрится уже интересно для агентов.
Для любителей покопаться, есть ускорение на CUDA.
Осталось придумать применение, конечно, и опробовать ролеплей.
#нейросеть #нейросети #neuralnetwork #neuralnetworks #генерациятекста