Настройка моделей

Hermes использует два типа слотов для моделей:

На этой странице описана настройка обоих типов из панели управления. Если вы предпочитаете конфигурационные файлы или CLI, перейдите к разделу Альтернативные методы внизу.

Страница Models

Откройте панель управления и нажмите Models на боковой панели. Вы увидите два раздела:

  1. Model Settings — верхняя панель, где вы назначаете модели слотам.
  2. Usage analytics — ранжированные карточки, показывающие все модели, которые запускали сессии за выбранный период, с количеством токенов, стоимостью и значками возможностей.Обзор страницы Models

Верхняя карточка — это панель Model Settings. В основной строке всегда указано, какую модель агент будет использовать для новых сессий. Нажмите Change, чтобы открыть выбор.

Настройка основной модели

Нажмите Change на строке Main model:Диалог выбора модели

В окне выбора две колонки:

Введите текст в поле фильтра, чтобы сузить поиск по имени провайдера, слагу или ID модели.

Выберите модель, нажмите Switch, и Hermes запишет её в ~/.hermes/config.yaml в раздел model. Это применяется только к новым сессиям — любой уже открытый чат продолжает использовать ту модель, с которой был запущен. Чтобы заменить модель в текущем чате, используйте внутри него слэш-команду /model.

Настройка вспомогательных моделей

Нажмите Show auxiliary, чтобы открыть восемь слотов задач:Панель вспомогательных моделей развёрнута

Каждая вспомогательная задача по умолчанию имеет значение auto — это означает, что Hermes использует для неё вашу основную модель. Переопределите конкретную задачу, когда хотите использовать более дешёвую или быструю модель для фоновой работы.

Типичные сценарии переопределения

Задача Когда переопределять
Title Gen Почти всегда. Flash-модель за $0.10/M пишет заголовки сессий не хуже Opus. В конфигурации по умолчанию для OpenRouter установлено google/gemini-3-flash-preview.
Vision Когда ваша основная модель — это модель для кодирования без поддержки зрения (например, Kimi, DeepSeek). Укажите google/gemini-2.5-flash или gpt-4o-mini.
Compression Когда вы тратите токены рассуждения на Opus/M2.7 только для суммаризации контекста. Быстрая чат-модель справляется с задачей в 50 раз дешевле.
Session Search Когда поисковые запросы расходятся — максимальное количество одновременных запросов по умолчанию равно 3. Дешёвая модель делает расходы предсказуемыми.
Approval Для approval_mode: smart — быстрая/дешёвая модель (haiku, flash, gpt-5-mini) решает, автоматически одобрять ли команды с низким риском. Дорогие модели здесь — пустая трата.
Web Extract Когда вы активно используете web_extract. Та же логика, что и для сжатия — суммаризация не требует рассуждений.
Skills Hub hermes skills search использует эту модель. Обычно достаточно auto.
MCP Маршрутизация инструментов MCP. Обычно достаточно auto.

Переопределение отдельной задачи

Нажмите Change на любой строке вспомогательной задачи. Откроется тот же выбор, с тем же поведением — выберите провайдера + модель, нажмите Switch. Строка обновится и покажет провайдер · модель вместо auto (use main model).

Сброс всех задач на auto

Если вы перестарались с настройками и хотите начать заново, нажмите Reset all to auto в верхней части раздела вспомогательных моделей. Все слоты вернутся к использованию основной модели.

Быстрый выбор "Use as"

У каждой карточки модели на странице есть выпадающее меню Use as. Это быстрый путь — выберите модель, которую видите в аналитике, нажмите Use as и назначьте её на основной слот или любую конкретную вспомогательную задачу одним кликом:Выпадающее меню Use as

В выпадающем меню есть:

Карточки помечены значками main или aux · <задача>, если они в данный момент назначены на что-то — так вы сразу видите, какие из ваших исторических моделей и где используются.

Что записывается в config.yaml

Когда вы сохраняете настройки через панель управления, Hermes записывает в ~/.hermes/config.yaml:

Основная модель:

model:
  provider: openrouter
  default: anthropic/claude-opus-4.7
  base_url: ''        # очищается при смене провайдера
  api_mode: chat_completions

Переопределение вспомогательной модели (пример — Vision на Gemini-Flash):

auxiliary:
  vision:
    provider: openrouter
    model: google/gemini-2.5-flash
    base_url: ''
    api_key: ''
    timeout: 120
    extra_body: {}
    download_timeout: 30

Вспомогательная модель в режиме авто (по умолчанию):

auxiliary:
  compression:
    provider: auto
    model: ''
    base_url: ''
    #... остальные поля без изменений

provider: auto с model: '' указывает, что Hermes использует базовую модель для этой задачи.

Когда изменения вступят в силу?

Изменения никогда не сбрасывают кеши промптов в запущенных сессиях. Это сделано намеренно: замена основной модели внутри сессии требует сброса кеша (системный запрос содержит конкретный контент для моделей), и мы предоставляем это для явной слэш-команды /model внутри чата.

Устранение неполадок

"Нет аутентифицированных провайдеров" в окне выбора

Hermes отображает провайдера только при наличии рабочих учетных данных. Проверьте Ключи на боковой панели — вы должны увидеть одно из: API-ключ, успешный OAuth или URL-адрес пользовательской конечной точки. Если нужного провайдера нет, выполните hermes setup для его настройки или включите Keys и разделы переменного окружения.

Основная модель не изменилась в современном чате

Ожидаемое поведение. Панель управления записывает config.yaml, который читает новые сессии. Текущий открытый чат — это активный процесс-агент, он сохраняет модель, с которой был запущен. Используйте /model <имя> внутри чата для быстрой замены моделей в этой сессии.

Переопределение вспомогательной модели "не сработало"

Проверьте три вещи:

  1. Вы начали новую сессию? Существующие чаты не перечитывают конфигурацию.
  2. Установлен ли provider в значении, отличном от auto? Если в поле указано auto, задача всё ещё использует базовую модель. Нажмите Изменить и выберите действительного провайдера.
  3. Аутентифицирован ли провайдер? Если вы указали minimax в задаче, но у вас нет API-ключа MiniMax, эта задача вернётся к провайдеру по умолчанию (openrouter) и запишет предупреждение в agent.log.

Я выбрал модель, но Hermes сменил провайдера

На OpenRouter (или любом агрегаторе) сначала разрешаются внутри агрегатора стандартные названия моделей. Таким образом, claude-sonnet-4 на OpenRouter становится anthropic/claude-sonnet-4.6, оставаясь на вашей аутентификации OpenRouter. Но если вы ввели «Клод-сонет-4» при родной аутентификации антропной, он будет действовать как «Клод-сонет-4-6». Если вы видите неожиданную смену провайдера, проверьте, что ваш текущий провайдер соответствует ожидаемому — окно выбора всегда показывает текущую основную модель в верхней части диалога.

Альтернативные методы

Слэш-команда CLI

Внутри любой сессии hermeschat:

/model gpt-5.4 --provider openrouter             # только для сессии
/model gpt-5.4 --provider openrouter --global    # также сохраняется в config.yaml

--global делает то же самое, что и кнопка Изменить в панели управления, плюс переключает текущую сессию на месте.

Пользовательские псевдонимы

Определите собственные имена для частого использования моделей, а затем воспользуйтесь /model <псевдоним> в CLI или на любой платформе для обмена сообщениями:

# ~/.hermes/config.yaml
model_aliases:
  fav:
    model: claude-sonnet-4.6
    provider: anthropic
  grok:
    model: grok-4
    provider: x-ai

Или из командной строки (краткая форма, провайдер/модель):

hermes config set model.aliases.fav anthropic/claude-opus-4.6
hermes config set model.aliases.grok x-ai/grok-4

Затем в чате /model fav или /model grok. Пользовательские псевдонимы переопределяют внутренние короткие имена (sonnet, kimi, opus и т.д.). Полную справку см. в разделе Пользовательские псевдонимы моделей.

Подкоманда модель Гермеса

hermes model            # Интерактивный выбор провайдера и модели (основной способ смены настроек по умолчанию)

«Модель Гермеса» проводится вами через выбор провайдера, аутентификацию (OAuth-потоки открывают браузер; провайдеры с API-ключом запрашивают ключ), а затем конкретный выбор модели из каталога провайдера. Выбор записи в model.provider и model.model в ~/.hermes/config.yaml.

Чтобы вывести список провайдеров/моделей без запуска интерактивного выбора, воспользуйтесь панелью управления или конечными точками REST ниже. Чтобы проверить, что CLI будет использоваться прямо сейчас: hermes config get model и hermes status.

Прямое редактирование конфигурации

Отредактируйте ~/.hermes/config.yaml и перезапустите то, что его читает. Полную схему см. в Справочнике по конфигурации.

ОТДЫХ API

Панель управления использует три конечные точки. Полезно для скриптов:

# Список аутентифицированных провайдеров + каталоги моделей
curl -H "X-Hermes-Session-Token: $TOKEN" http://localhost:PORT/api/model/options

# Чтение текущих назначений основной и вспомогательных моделей
curl -H "X-Hermes-Session-Token: $TOKEN" http://localhost:PORT/api/model/auxiliary

# Установка основной модели
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
  -d '{"scope":"main","provider":"openrouter","model":"anthropic/claude-opus-4.7"}' \
  http://localhost:PORT/api/model/set

# Переопределение одной вспомогательной задачи
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
  -d '{"scope":"auxiliary","task":"vision","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
  http://localhost:PORT/api/model/set

# Назначение одной модели на все вспомогательные задачи
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
  -d '{"scope":"auxiliary","task":"","provider":"openrouter","model":"google/gemini-2.5-flash"}' \
  http://localhost:PORT/api/model/set

# Сброс всех вспомогательных задач на auto
curl -X POST -H "Content-Type: application/json" -H "X-Hermes-Session-Token: $TOKEN" \
  -d '{"scope":"auxiliary","task":"__reset__","provider":"","model":""}' \
  http://localhost:PORT/api/model/set

Токен сессии внедряется в HTML-панель управления при запуске и меняется при каждом перезапуске сервера. Возьмите его из инструментов разработчика браузера (window.__HERMES_SESSION_TOKEN__), если напишете скрипты для рабочей панели управления.