На российским рынке появятся ПАКи с китайским кремнием
MWS AI и группа Rubytech испытали программно-аппаратный комплекс на восьми китайских графических процессорах. Коммерческий запуск запланирован на 2027 год.
⏹️ На ПАК развернули две модели MWS AI — Cotype Pro 3 (27 млрд параметров) и облегчённую Cotype Light 3 (9 млрд). Обе заточены под ИИ-агентов, работающих без постоянного участия человека.
⏹️ При входном контексте около 27 000 токенов (примерно 50-60 страниц текста) система формировала первый ответ за 8 секунд. По словам Rubytech, в отдельных сценариях инференса результат сопоставим с Nvidia H100 — одним из самых распространённых ИИ-ускорителей на рынке. Настройка драйверов и программного окружения подняла производительность платформы в 2-2,2 раза.
⏹️ Тестами китайских GPU занимаются и другие крупные игроки. ВТБ с марта 2026 года использует их в опытно-промышленной эксплуатации для компьютерного зрения и распознавания речи.
❗️ Не все китайские платформы одинаково хороши. Fplus тестировала ускоритель Tongxin, который в реальных задачах уступил даже устаревшему Nvidia A40 — подвели несовместимость с CUDA и незрелость софта. При этом Huawei Ascend, по оценке экспертов, уже достигает 60-80% производительности H100, а карты MetaX C550 корректнее сравнивать с более старым A100.
⭐️ Софт— это больное место китайского кремния. Например, Z․AI пришлось выкупить разработчика, который придумал способ абстрагировать «зоопарк» китайских чипов. Даже инференс у всех работает по-своему. При этом готовые ПАКи выбирают, чтобы сборка работала буквально из коробки. Если вендор не «приручит» софт, то смысл будто теряется.
🕹️ Серверная в Telegram | в MAX
MWS AI и группа Rubytech испытали программно-аппаратный комплекс на восьми китайских графических процессорах. Коммерческий запуск запланирован на 2027 год.
⏹️ На ПАК развернули две модели MWS AI — Cotype Pro 3 (27 млрд параметров) и облегчённую Cotype Light 3 (9 млрд). Обе заточены под ИИ-агентов, работающих без постоянного участия человека.
⏹️ При входном контексте около 27 000 токенов (примерно 50-60 страниц текста) система формировала первый ответ за 8 секунд. По словам Rubytech, в отдельных сценариях инференса результат сопоставим с Nvidia H100 — одним из самых распространённых ИИ-ускорителей на рынке. Настройка драйверов и программного окружения подняла производительность платформы в 2-2,2 раза.
⏹️ Тестами китайских GPU занимаются и другие крупные игроки. ВТБ с марта 2026 года использует их в опытно-промышленной эксплуатации для компьютерного зрения и распознавания речи.
❗️ Не все китайские платформы одинаково хороши. Fplus тестировала ускоритель Tongxin, который в реальных задачах уступил даже устаревшему Nvidia A40 — подвели несовместимость с CUDA и незрелость софта. При этом Huawei Ascend, по оценке экспертов, уже достигает 60-80% производительности H100, а карты MetaX C550 корректнее сравнивать с более старым A100.
⭐️ Софт— это больное место китайского кремния. Например, Z․AI пришлось выкупить разработчика, который придумал способ абстрагировать «зоопарк» китайских чипов. Даже инференс у всех работает по-своему. При этом готовые ПАКи выбирают, чтобы сборка работала буквально из коробки. Если вендор не «приручит» софт, то смысл будто теряется.
🕹️ Серверная в Telegram | в MAX