На Хабре вышел толковый пост Hermes Agent Desktop: настройка под реальные задачиАвтор месяц работал с Hermes Agent через CLI (WSL) — десктопа под Windows не было. В версии v0.15.2 вышел установщик Desktop APP на Electron для Windows, macOS и Linux.
В GUI 13 разделов. Разберем настройки:
Model. Основная модель — ollama-cloud/kimi-k2.6. Context Length держу на 0: Hermes сам запрашивает у провайдера актуальный лимит. Захардкоженное число устаревает — Kimi перешёл с 128K на 256K.
По умолчанию все auxiliary-задачи стоят на provider: auto и откатываются на основную модель. Триллион параметров тратится на заголовки и поиск по сессиям. Прописал каждой задаче свою модель:
- vision → qwen3-vl:235b-instruct
- web_extract, compression, curator → kimi-k2.5
- skills_hub, approval, mcp, title_gen, session_search → rnj-1:8b
Баг: session_search нельзя назначить через GUI — список auxiliary-задач зашит в коде Electron, эту задачу не добавили. Лечится через CLI:
hermes config set auxiliary.session_search.provider ollama-cloud
hermes config set auxiliary.session_search.model rnj-1:8b
После перезапуска работает, но UI всё равно показывает auto.
Chat. Personality — Philosopher. Reasoning Blocks — Off.
Appearance. Tool Call Display — Technical: показывает raw JSON аргументов и результатов вызовов. Нужно для отладки. Не отлаживаете — ставьте Product.
Workspace. Главное изменение — Environment Passthrough: PATH,CUDA_PATH. Без него агент не видел CUDA, приходилось прописывать абсолютные пути к Python, pip, nvidia-smi. Auto-Approve File Writes — Off.
Safety. Approval Mode — Manual: подтверждение перед каждой опасной командой. Approval Timeout поднял с 60 до 120 секунд. Redact Secrets — On: скрывает пароли, ключи и токены из контекста перед отправкой в модель.
Memory & Context. Persistent Memory — On: сохраняет факты между сессиями. Protected Recent Messages поднял с 20 до 30 — эти сообщения не сжимаются.
Advanced. Max Agent Steps поднял с 90 до 120 — pipeline автопостинга обрывался на 90. Subagent Model — rnj-1:8b вместо kimi-k2.6.
Gateway. Локальный шлюз на localhost, работает offline. Если уже запущен CLI-шлюз с тем же Telegram-токеном, Desktop отключит его при старте. Нужны разные токены или один шлюз.
Минусы:1. Electron ест ~400 МБ в простое — в 5 раз больше CLI.
2. Свои темы сделать нельзя.
3. На Linux не standalone: Python-зависимости ставятся вручную.
4. Конфликт шлюзов по одному токену.
5. Редактор конфига базовый.
6. Session Search назначается только через CLI.
Итог: тот же агент, навыки и память, но без терминала. Параллельные чаты окупают переход.
Полная версия статьи:
https://habr.com/ru/articles/1044270/