Google Близнецы

Агент Hermes поддерживает Google Gemini в качестве собственного провайдера, используя Google AI Studio/Gemini API — конечную точку, несовместимую с OpenAI. Это Hermes преобразовывает свой внутренний цикл сообщений и инструментов, ориентированных на OpenAI, в собственном API Gemini generateContent, сохраняя при этом вызове инструменты, потоковую передачу, мультимодальные входные данные и метаданные ответы, специально для Gemini.

Hermes также поддерживает отдельного провайдера Google Gemini (OAuth), который использует тот же бэкенд Cloud Code Assist, что и CLI Gemini от Google. Используйте провайдера с API-ключом («gemini») для исключения риска государственного пути API.

Предварительные требования

Быстрый старт

# Добавьте ваш API-ключ Gemini
echo "GOOGLE_API_KEY=..." >> ~/.hermes/.env

# Выберите Gemini в качестве провайдера
hermes model
# → Выберите "More providers..." → "Google AI Studio"
# → Hermes проверит ваш тарифный план и покажет модели Gemini
# → Выберите модель

# Начните чат
hermes chat

Если вы предпочитаете прямое редактирование конфигурации, используйте небольшой базовый URL-адрес Gemini API:

model:
  default: gemini-3-flash-preview
  provider: gemini
  base_url: https://generativelanguage.googleapis.com/v1beta

Конфигурация

После выполнения hermes model ваш ~/.hermes/config.yaml будет сохраняться:

model:
  default: gemini-3-flash-preview
  provider: gemini
  base_url: https://generativelanguage.googleapis.com/v1beta

А в ~/.hermes/.env:

GOOGLE_API_KEY=...

Нативный API Gemini

Рекомендуемая конечная точка:

https://generativelanguage.googleapis.com/v1beta

Гермес обнаруживает эту конечную точку и создает свой собственный адаптер Близнецов. Внутренний Hermes по-прежнему хранит цикл агента в сообщениях, ориентированных на OpenAI, а затем преобразует каждый запрос в собственную схему Gemini:

Близнецы 3 также могут прикрепить сигнатуры мыслей к другим частям ответа. Нативный адаптер Hermes сегодня используется для циклов инструментов агента, поэтому он пока не воспроизводит каждую сигнатуру, не связанную с вызовом инструмента, с полной глубиной на уровне частей.

Предпочитайте нативную конечную точку

Google также предоставляет OpenAI-совместимую конечную точку:

https://generativelanguage.googleapis.com/v1beta/openai/

Для сеанса агента Гермеса предпочитайте нативную конечную точку Близнецова, указанную выше. Hermes включает адаптер Gemini для прямого отображения использования многошаговых инструментов, результатов вызовов инструментов, потоковой передачи, мультимодальных входных данных и метаданных ответов Gemini на API generateContent Gemini. Конечная точка подключения к OpenAI все еще полезна, когда вам нужна совместимость с API OpenAI.

Если вы ранее установили GEMINI_BASE_URL по URL-адресу /openai, удалите его или замените:

GEMINI_BASE_URL=https://generativelanguage.googleapis.com/v1beta

Провайдер OAuth

Hermes также имеет провайдера google-gemini-cli:

hermes model
# → Выберите "Google Gemini (OAuth)"

Он использует вход через браузер PKCE и бэкенд Cloud Code Assist. Это может быть полезно для пользователей, которым нужен OAuth в стиле Gemini CLI, но Hermes показывает явное предупреждение, поскольку Google может рассматривать использование OAuth-клиента Gemini CLI через программное обеспечение как нарушение политики. Для продакшена или использования с минимальным риском прочитайте провайдера с API-ключом, как указано выше.

Доступные модели

Селектор hermes model показывает модели Близнецов, внесенные в реестр провайдеров Hermes. Распространенные варианты:

Модель уверенность личности Примечания
Предварительный просмотр Gemini 3.1 Pro gemini-3.1-pro-preview производитель Наиболее предварительная модель, когда она доступна
Предварительный обзор Gemini 3 Pro близнецы-3-про-превью Мощная модель для рассуждений и кодирования
Предварительный просмотр Близнецов 3 gemini-3-flash-preview Рекомендуемый баланс скорости и возможностей по умолчанию
Предварительный просмотр Gemini 3.1 Flash Lite gemini-3.1-flash-lite-preview Самый быстрый/самый дешевый вариант, когда он доступен

Доступность моделей со временем меняется. Если модель исчезла или не была включена для вашего переключателя, снова запустите hermes model и выберите одну из текущего списка.

ℹ️ Info

Идентификаторы моделей Используйте собственные идентификаторы моделей Gemini, такие как gemini-3-flash-preview, а не идентификаторы в стиле OpenRouter, например google/gemini-3-flash-preview, когда provider: Gemini.

Последние псевдонимы

Google предоставляет гибкие псевдонимы для процессоров Pro и Flash Gemini. gemini-pro-latest и gemini-flash-latest полезны, когда вы хотите, чтобы Google автоматически обновлял модель без изменения вашей конфигурации Hermes.

Псевдоним В настоящее время отслеживается Примечания
Близнецы-про-последние Последняя модель Gemini Pro Лучше всего, когда вам нужен настоящий Про по умолчанию от Google
gemini-flash-последний Последняя модель Gemini Flash Лучше всего, когда вам нужен текущий Flash по умолчанию от Google
model:
  default: gemini-pro-latest
  provider: gemini
  base_url: https://generativelanguage.googleapis.com/v1beta

Если вам нужна строгая воспроизводимость, предпочитайте явные идентификаторы моделей, такие как «gemini-3.1-pro-preview» или «gemini-3-flash-preview».

Джемма через Gemini API

Google также предоставляет модели Gemma через Gemini API. Гермес распознает их как модели Google, но не содержит записей Джеммы с очень низким уровнем пропускной способности при выборе моделей по умолчанию, чтобы новые пользователи случайно не выбирали модель оценочного уровня для агента длительной сессии.

Полезные идентификаторы для оценки включают:

Модель уверенность личности Примечания
Джемма 4 31Б ИТ джемма-4-31b-это Более крупная модель Джемма; полезно для оценки совместимости и качества
Джемма 4 26Б А4Б ИТ джемма-4-26b-a4b-it Вариант с включением активных параметров, если они доступны

Эти модели лучше учитывать как варианты оценки ключей Gemini API. Ценообразование Gemma API от Google осуществляется только по бесплатному тарифу на использование, и лимиты ниже по сравнению с продакшен-моделями Gemini, поэтому для длительного использования агента Hermes следует перейти на платную модель Gemini, самостоятельное развертывание или другого провайдера с соответствующей квотой.

Чтобы использовать модель Gemma, скрытую от селектора, укажите ее напрямую:

model:
  default: gemma-4-31b-it
  provider: gemini
  base_url: https://generativelanguage.googleapis.com/v1beta

Переключение моделей во время сессии

Используйте команду /model во время разговора:

/model gemini-3-flash-preview
/model gemini-flash-latest
/model gemini-3-pro-preview
/model gemini-pro-latest
/model gemma-4-31b-it
/model gemini-3.1-flash-lite-preview

Если вы еще не настроили Близнецов, выйдите из сессии и сначала выполните модель Гермеса. /model переключает между уже настроенными провайдерами и моделями; он не собирает новые API-ключи.

Диагностика

hermes doctor

Доктор недавно:

Для использования проверок квоты OAuth выполняются внутри сессии Hermes:

/gquota

/gquota применяется к провайдеру OAuth google-gemini-cli, а не к провайдеру с API-ключом AI Studio.

Шлюз (Платформы обмена сообщениями)

Gemini работает со всеми платформами шлюза Hermes (Telegram, Discord, Slack, WhatsApp, LINE, Feishu и т.д.). Настройте Gemini в качестве провайдера, затем запустите шлюз обычным способом:

hermes gateway setup
hermes gateway start

Шлюз читает config.yaml и использует ту же конфигурацию провайдера Gemini.

Устранение неполадок

«Нативному клиенту Gemini требуется ключ API»

Гермес не смог найти API-ключ. Добавьте один из них в ~/.hermes/.env:

GOOGLE_API_KEY=...
# или
GEMINI_API_KEY=...

Затем снова выполняем модель Гермеса.

«Этот ключ API Google находится на уровне бесплатного использования»

Гермес теперь ключи Gemini API во время настройки. Квоты бесплатного тарифа могут быть исчерпаны после нескольких шагов агента, поскольку при использовании инструментов повторные попытки, предложения и вспомогательные задачи могут включать несколько моделей вызовов.

Включите биллинг в проект Google Cloud, примените свой ключ, при необходимости сгенерируйте новый ключ, а затем выполните:

hermes model

"404 модель не найдена"

Выбранная модель недоступна для ваших учетных записей, региона или коммутатора. Снова выполните модель Гермеса и выберите другую модель Близнецов из текущего списка.

Модель Джемма не отображается в hermes model

Гермес может по умолчанию закрыть модель Джемми с низким уровнем выбросов из селектора. Если вы хотите оценить ситуацию из них, укажите идентификатор модели непосредственно в ~/.hermes/config.yaml.

"429 квота сверхна" на Gemma

Модели Gemma, доступные через Gemini API, полезны для оценки, но их лимиты бесплатного тарифа Gemini API низкие. Используйте их для проверки совместимости, а затем переключитесь на платную модель Gemini или другого провайдера для длительных сессий агента.

Настроена OpenAI-совместимая конечная точка

Проверьте ~/.hermes/.env на наличие:

GEMINI_BASE_URL=https://generativelanguage.googleapis.com/v1beta/openai/

Замените его на родную конечную точку или удалите переопределение:

GEMINI_BASE_URL=https://generativelanguage.googleapis.com/v1beta

Предупреждение о входе через OAuth

Провайдер google-gemini-cli использует поток OAuth Gemini CLI / Cloud Code Assist. Гермес предупреждает перед его запуском, поскольку это отличается от официального пути с API-ключом AI Studio. Используйте провайдера: Gemini с GOOGLE_API_KEY для официальной организации с ключом API.

Вызовские инструменты устраняют ошибки в схемах

Обновите Гермеса и еще раз выполните модель Гермеса. Нативный адаптер Gemini очищает схемы инструментов для более строгого формирования объявлений функций Gemini; Старые сборки или пользовательские конечные точки могут не поддерживать это.

Связанные разделы