NVIDIA запустила Groq 3 LPX - отдельный ускоритель генерации токенов для платформы Vera Rubin
По данным NVIDIA, в бенчмарке Artificial Analysis система достигла 3400 output-токенов в секунду на Gemma 4 31B при контексте 100 000 токенов.
Компания называет это самым быстрым зафиксированным результатом для этой модели.
Также NVIDIA заявляет до 4x более быстрый отклик по сравнению с ближайшей альтернативной платформой - прежде всего для AI-агентов и других latency-sensitive нагрузок.
Первым облачным провайдером с Groq 3 LPX станет Nebius через Token Factory. Затем ускоритель появится и в инфраструктуре Groq.
https://x.com/nvidianewsroom/status/2091904293343252534
По данным NVIDIA, в бенчмарке Artificial Analysis система достигла 3400 output-токенов в секунду на Gemma 4 31B при контексте 100 000 токенов.
Компания называет это самым быстрым зафиксированным результатом для этой модели.
Также NVIDIA заявляет до 4x более быстрый отклик по сравнению с ближайшей альтернативной платформой - прежде всего для AI-агентов и других latency-sensitive нагрузок.
Первым облачным провайдером с Groq 3 LPX станет Nebius через Token Factory. Затем ускоритель появится и в инфраструктуре Groq.
https://x.com/nvidianewsroom/status/2091904293343252534