🚀 Strata v0.1.34 - AMD на Windows, MCP для автонастройки и быстрый cancel запросов
Обновы летят как из пулемета. В этот раз на NVIDIA большого прироста скорости нет, зато релиз заметно улучшает работу с агентами и добавляет полноценный Windows-билд для AMD.
🔥 Главное нововведение - AMD теперь поддерживается на Windows через обычный START-HERE.bat.
Поддерживаются:
• RX 7900 XT / XTX
• RX 7800 XT / 7700 XT
• RX 9060 XT
• RX 9070 / 9070 XT
• Radeon AI PRO R9700
• RX 6800 / 6900 series
⚠️ Пока у AMD под Windows есть ограничения: одна GPU на модель и без vision. На Linux AMD по-прежнему поддерживает multi-GPU, а изображения обрабатываются через CPU.
👁 Что с Vision
В предыдущей v0.1.33 разработчик исправил strata-vision.exe. Сборка из v0.1.32 случайно требовала AVX-512 и могла не запускаться на многих Ryzen и Intel с ошибкой «illegal instruction».
Теперь vision encoder снова собран более универсально:
• AVX2
• без OpenMP
• сохранена поддержка RTX 20
Также vision encoder можно вынести на отдельную NVIDIA GPU через параметр:
"cuda_device": 1
То есть основную модель можно оставить на одной карте, а обработку изображений отправить на другую.
Для нового AMD Windows backend vision пока не поддерживается.
🤖 Ещё одна интересная новинка - собственный MCP-сервер tools/strata_mcp.py.
Теперь Claude Code, Cursor, Codex или Copilot могут сами:
• проверить конфигурацию ПК
• подобрать подходящую модель
• установить Strata
• запустить сервер
• проверить его состояние
• остановить Strata
• показать параметры подключения.
⚡️ Очень полезный фикс для агентских workflow: отменённый запрос теперь освобождает engine примерно за 1 секунду.
Раньше, если клиент закрывал соединение, non-streamed запрос мог продолжать генерировать до max_tokens, а streamed-запрос - продолжать обрабатывать длинный prompt. Следующий запрос в это время ждал.
В пользовательских отчётах задержка доходила до 17-33 секунд.
Теперь после disconnect/cancel вычисление быстро прекращается. В тесте разработчика после отмены длинного 57K prompt следующий короткий вопрос получил ответ примерно за 0.6 секунды.
📦 Setup тоже немного доработали:
• при продолжении прерванной загрузки теперь нужно свободное место только под оставшуюся часть файла
• перед скачиванием 111-ГБ UD-Q4_K_XL на AMD setup отдельно предупреждает, потому что эта комбинация пока не протестирована
• AMD больше не называется experimental в основной документации
Для пользователей RTX 30/40/50 самые полезные изменения:
• быстрый cancel запросов
• MCP-сервер
• исправления vision из v0.1.33
• дополнительные серверные и setup-фиксы
Обновление стандартное:
git pull
затем:
START-HERE.bat
Setup сам установит Strata engine v0.1.34.
https://github.com/Niko1221/Strata/releases/tag/v0.1.34
Кто рискнет поставит обнову, пишите в комментарии свой отзыв.
MrGips • Про LLM / НАШ ЧАТ
Обновы летят как из пулемета. В этот раз на NVIDIA большого прироста скорости нет, зато релиз заметно улучшает работу с агентами и добавляет полноценный Windows-билд для AMD.
🔥 Главное нововведение - AMD теперь поддерживается на Windows через обычный START-HERE.bat.
Поддерживаются:
• RX 7900 XT / XTX
• RX 7800 XT / 7700 XT
• RX 9060 XT
• RX 9070 / 9070 XT
• Radeon AI PRO R9700
• RX 6800 / 6900 series
⚠️ Пока у AMD под Windows есть ограничения: одна GPU на модель и без vision. На Linux AMD по-прежнему поддерживает multi-GPU, а изображения обрабатываются через CPU.
👁 Что с Vision
В предыдущей v0.1.33 разработчик исправил strata-vision.exe. Сборка из v0.1.32 случайно требовала AVX-512 и могла не запускаться на многих Ryzen и Intel с ошибкой «illegal instruction».
Теперь vision encoder снова собран более универсально:
• AVX2
• без OpenMP
• сохранена поддержка RTX 20
Также vision encoder можно вынести на отдельную NVIDIA GPU через параметр:
"cuda_device": 1
То есть основную модель можно оставить на одной карте, а обработку изображений отправить на другую.
Для нового AMD Windows backend vision пока не поддерживается.
🤖 Ещё одна интересная новинка - собственный MCP-сервер tools/strata_mcp.py.
Теперь Claude Code, Cursor, Codex или Copilot могут сами:
• проверить конфигурацию ПК
• подобрать подходящую модель
• установить Strata
• запустить сервер
• проверить его состояние
• остановить Strata
• показать параметры подключения.
⚡️ Очень полезный фикс для агентских workflow: отменённый запрос теперь освобождает engine примерно за 1 секунду.
Раньше, если клиент закрывал соединение, non-streamed запрос мог продолжать генерировать до max_tokens, а streamed-запрос - продолжать обрабатывать длинный prompt. Следующий запрос в это время ждал.
В пользовательских отчётах задержка доходила до 17-33 секунд.
Теперь после disconnect/cancel вычисление быстро прекращается. В тесте разработчика после отмены длинного 57K prompt следующий короткий вопрос получил ответ примерно за 0.6 секунды.
📦 Setup тоже немного доработали:
• при продолжении прерванной загрузки теперь нужно свободное место только под оставшуюся часть файла
• перед скачиванием 111-ГБ UD-Q4_K_XL на AMD setup отдельно предупреждает, потому что эта комбинация пока не протестирована
• AMD больше не называется experimental в основной документации
Для пользователей RTX 30/40/50 самые полезные изменения:
• быстрый cancel запросов
• MCP-сервер
• исправления vision из v0.1.33
• дополнительные серверные и setup-фиксы
Обновление стандартное:
git pull
затем:
START-HERE.bat
Setup сам установит Strata engine v0.1.34.
https://github.com/Niko1221/Strata/releases/tag/v0.1.34
Кто рискнет поставит обнову, пишите в комментарии свой отзыв.
MrGips • Про LLM / НАШ ЧАТ