#ai #мысли #мюсли
Когда какую локальную llm ~20B использовать:
На практике это определяет сценарий использования. Чатбот, стриминг ответа, интерактивный помощник? Decode важнее, Qwen выигрывает. Быстро переварить длинный документ и выдать короткое резюме? PP важнее, Gemma впереди.
Из статьи:
https://habr.com/ru/companies/gpugo/articles/1056192/
Когда какую локальную llm ~20B использовать:
На практике это определяет сценарий использования. Чатбот, стриминг ответа, интерактивный помощник? Decode важнее, Qwen выигрывает. Быстро переварить длинный документ и выдать короткое резюме? PP важнее, Gemma впереди.
Из статьи:
https://habr.com/ru/companies/gpugo/articles/1056192/