Настройка моделей
Hermes использует два типа слотов для моделей:
- Основная модель — то, с помощью чего агент думает. Каждое сообщение пользователя, каждый цикл вызова инструментов, каждый потоковый ответ проходят через эту модель.
- Вспомогательные модели — более мелкие фоновые задачи, которые агент делегирует. Сжатие контекста, зрение (анализ изображений), суммаризация веб-страниц, поиск по сессиям, оценка одобрения, маршрутизация инструментов MCP, генерация заголовков сессий и поиск навыков. Для каждой задачи есть отдельный слот, который можно переопределить независимо.
На этой странице описана настройка обоих типов из панели управления. Если вы предпочитаете конфигурационные файлы или CLI, перейдите к разделу Альтернативные методы внизу.
Страница Models
Откройте панель управления и нажмите Models на боковой панели. Вы увидите два раздела:
- Model Settings — верхняя панель, где вы назначаете модели слотам.
- Usage analytics — ранжированные карточки, показывающие все модели, которые запускали сессии за выбранный период, с количеством токенов, стоимостью и значками возможностей.

Верхняя карточка — это панель Model Settings. В основной строке всегда указано, какую модель агент будет использовать для новых сессий. Нажмите Change, чтобы открыть выбор.
Настройка основной модели
Нажмите Change на строке Main model:
В окне выбора две колонки:
- Слева — аутентифицированные провайдеры. Отображаются только те провайдеры, которые вы настроили (установили API-ключ, прошли OAuth или определили как пользовательскую конечную точку). Если провайдера нет, перейдите в Keys и добавьте его учётные данные.
- Справа — отфильтрованный список моделей для выбранного провайдера. Это агентные модели, которые Hermes рекомендует для данного провайдера, а не полный список
/models(который на OpenRouter включает более 400 моделей, включая TTS, генераторы изображений и реранкеры).
Введите текст в поле фильтра, чтобы сузить поиск по имени провайдера, слагу или ID модели.
Выберите модель, нажмите Switch, и Hermes запишет её в ~/.hermes/config.yaml в раздел model. Это применяется только к новым сессиям — любой уже открытый чат продолжает использовать ту модель, с которой был запущен. Чтобы заменить модель в текущем чате, используйте внутри него слэш-команду /model.
Настройка вспомогательных моделей
Нажмите Show auxiliary, чтобы открыть восемь слотов задач:
Каждая вспомогательная задача по умолчанию имеет значение auto — это означает, что Hermes использует для неё вашу основную модель. Переопределите конкретную задачу, когда хотите использовать более дешёвую или быструю модель для фоновой работы.
Типичные сценарии переопределения
| Задача | Когда переопределять |
|---|---|
| Title Gen | Почти всегда. Flash-модель за $0.10/M пишет заголовки сессий не хуже Opus. В конфигурации по умолчанию для OpenRouter установлено google/gemini-3-flash-preview. |
| Vision | Когда ваша основная модель — это модель для кодирования без поддержки зрения (например, Kimi, DeepSeek). Укажите google/gemini-2.5-flash или gpt-4o-mini. |
| Compression | Когда вы тратите токены рассуждения на Opus/M2.7 только для суммаризации контекста. Быстрая чат-модель справляется с задачей в 50 раз дешевле. |
| Session Search | Когда поисковые запросы расходятся — максимальное количество одновременных запросов по умолчанию равно 3. Дешёвая модель делает расходы предсказуемыми. |
| Approval | Для approval_mode: smart — быстрая/дешёвая модель (haiku, flash, gpt-5-mini) решает, автоматически одобрять ли команды с низким риском. Дорогие модели здесь — пустая трата. |
| Web Extract | Когда вы активно используете web_extract. Та же логика, что и для сжатия — суммаризация не требует рассуждений. |
| Skills Hub | hermes skills search использует эту модель. Обычно достаточно auto. |
| MCP | Маршрутизация инструментов MCP. Обычно достаточно auto. |
Переопределение отдельной задачи
Нажмите Change на любой строке вспомогательной задачи. Откроется тот же выбор, с тем же поведением — выберите провайдера + модель, нажмите Switch. Строка обновится и покажет провайдер · модель вместо auto (use main model).
Сброс всех задач на auto
Если вы перестарались с настройками и хотите начать заново, нажмите Reset all to auto в верхней части раздела вспомогательных моделей. Все слоты вернутся к использованию основной модели.
Быстрый выбор "Use as"
У каждой карточки модели на странице есть выпадающее меню Use as. Это быстрый путь — выберите модель, которую видите в аналитике, нажмите Use as и назначьте её на основной слот или любую конкретную вспомогательную задачу одним кликом:
В выпадающем меню есть:
- Main model — то же самое, что нажать Change на основной строке.
- All auxiliary tasks — назначает эту модель сразу на все 8 вспомогательных слотов. Полезно, когда вы хотите использовать одну дешёвую flash-модель для всех фоновых задач.
- Отдельные задачи — Vision, Web Extract, Compression и т.д. Текущая назначенная модель для каждой задачи отмечена как
current.
Карточки помечены значками main или aux · <задача>, если они в данный момент назначены на что-то — так вы сразу видите, какие из ваших исторических моделей и где используются.
Что записывается в config.yaml
Когда вы сохраняете настройки через панель управления, Hermes записывает в ~/.hermes/config.yaml:
Основная модель:
model:
provider: openrouter
default: anthropic/claude-opus-4.7
base_url: '' # очищается при смене провайдера
api_mode: chat_completions
Переопределение вспомогательной модели (пример — Vision на Gemini-Flash):
auxiliary:
vision:
provider: openrouter
model: google/gemini-2.5-flash
base_url: ''
api_key: ''
timeout: 120
extra_body: {}
download_timeout: 30
Вспомогательная модель в режиме авто (по умолчанию):
auxiliary:
compression:
provider: auto
model: ''
base_url: ''
#... остальные поля без изменений
provider: auto с model: '' указывает, что Hermes использует базовую модель для этой задачи.
Когда изменения вступят в силу?
- CLI («чат Гермеса»): при следующем вызове «чат Гермеса».
- Шлюз (Telegram, Discord, Slack и т.д.): при нынешней новой сессии. Существующие сессии сохраняют свою модель. Перезапустите шлюз («Перезапуск шлюза Гермеса»), если вы хотите применить изменения ко всем сессиям.
- Вкладка чата в панели управления (
/chat): при новом PTY. Текущий открытый чат сохранит свою модель — воспользуйтесь внутри него/modelдля горячей замены.
Изменения никогда не сбрасывают кеши промптов в запущенных сессиях. Это сделано намеренно: замена основной модели внутри сессии требует сброса кеша (системный запрос содержит конкретный контент для моделей), и мы предоставляем это для явной слэш-команды /model внутри чата.
Устранение неполадок
"Нет аутентифицированных провайдеров" в окне выбора
Hermes отображает провайдера только при наличии рабочих учетных данных. Проверьте Ключи на боковой панели — вы должны увидеть одно из: API-ключ, успешный OAuth или URL-адрес пользовательской конечной точки. Если нужного провайдера нет, выполните hermes setup для его настройки или включите Keys и разделы переменного окружения.
Основная модель не изменилась в современном чате
Ожидаемое поведение. Панель управления записывает config.yaml, который читает новые сессии. Текущий открытый чат — это активный процесс-агент, он сохраняет модель, с которой был запущен. Используйте /model <имя> внутри чата для быстрой замены моделей в этой сессии.
Переопределение вспомогательной модели "не сработало"
Проверьте три вещи:
- Вы начали новую сессию? Существующие чаты не перечитывают конфигурацию.
- Установлен ли
providerв значении, отличном отauto? Если в поле указаноauto, задача всё ещё использует базовую модель. Нажмите Изменить и выберите действительного провайдера. - Аутентифицирован ли провайдер? Если вы указали
minimaxв задаче, но у вас нет API-ключа MiniMax, эта задача вернётся к провайдеру по умолчанию (openrouter) и запишет предупреждение вagent.log.
Я выбрал модель, но Hermes сменил провайдера
На OpenRouter (или любом агрегаторе) сначала разрешаются внутри агрегатора стандартные названия моделей. Таким образом, claude-sonnet-4 на OpenRouter становится anthropic/claude-sonnet-4.6, оставаясь на вашей аутентификации OpenRouter. Но если вы ввели «Клод-сонет-4» при родной аутентификации антропной, он будет действовать как «Клод-сонет-4-6». Если вы видите неожиданную смену провайдера, проверьте, что ваш текущий провайдер соответствует ожидаемому — окно выбора всегда показывает текущую основную модель в верхней части диалога.
Альтернативные методы
Слэш-команда CLI
Внутри любой сессии hermeschat:
/model gpt-5.4 --provider openrouter # только для сессии
/model gpt-5.4 --provider openrouter --global # также сохраняется в config.yaml
--global делает то же самое, что и кнопка Изменить в панели управления, плюс переключает текущую сессию на месте.
Пользовательские псевдонимы
Определите собственные имена для частого использования моделей, а затем воспользуйтесь /model <псевдоним> в CLI или на любой платформе для обмена сообщениями:
# ~/.hermes/config.yaml
model_aliases:
fav:
model: claude-sonnet-4.6
provider: anthropic
grok:
model: grok-4
provider: x-ai
Или из командной строки (краткая форма, провайдер/модель):
hermes config set model.aliases.fav anthropic/claude-opus-4.6
hermes config set model.aliases.grok x-ai/grok-4
Затем в чате /model fav или /model grok. Пользовательские псевдонимы переопределяют внутренние короткие имена (sonnet, kimi, opus и т.д.). Полную справку см. в разделе Пользовательские псевдонимы моделей.
Подкоманда модель Гермеса
hermes model # Интерактивный выбор провайдера и модели (основной способ смены настроек по умолчанию)
«Модель Гермеса» проводится вами через выбор провайдера, аутентификацию (OAuth-потоки открывают браузер; провайдеры с API-ключом запрашивают ключ), а затем конкретный выбор модели из каталога провайдера. Выбор записи в model.provider и model.model в ~/.hermes/config.yaml.
Чтобы вывести список провайдеров/моделей без запуска интерактивного выбора, воспользуйтесь панелью управления или конечными точками REST ниже. Чтобы проверить, что CLI будет использоваться прямо сейчас: hermes config get model и hermes status.
Прямое редактирование конфигурации
Отредактируйте ~/.hermes/config.yaml и перезапустите то, что его читает. Полную схему см. в Справочнике по конфигурации.
ОТДЫХ API
Панель управления использует три конечные точки. Полезно для скриптов:
# Список аутентифицированных провайдеров + каталоги моделей
curl -H "X-Hermes-Session-Token: $TOKEN" http://localhost:PORT/api/model/options
# Чтение текущих назначений основной и вспомогательных моделей
curl -H "X-Hermes-Session-Token: $TOKEN" http://localhost:PORT/api/model/auxiliary
# Установка основной модели
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
-d '{"scope":"main","provider":"openrouter","model":"anthropic/claude-opus-4.7"}' \
http://localhost:PORT/api/model/set
# Переопределение одной вспомогательной задачи
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"vision","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set
# Назначение одной модели на все вспомогательные задачи
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
http://localhost:PORT/api/model/set
# Сброс всех вспомогательных задач на auto
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
-d '{"scope":"auxiliary","task":"__reset__","provider":"","model":""}' \
http://localhost:PORT/api/model/set
Токен сессии внедряется в HTML-панель управления при запуске и меняется при каждом перезапуске сервера. Возьмите его из инструментов разработчика браузера (window.__HERMES_SESSION_TOKEN__), если напишете скрипты для рабочей панели управления.