Провайдеры памяти

Агент Hermes подключается с 8 плагинами внешних поставщиков памяти, которые предоставляют агенту постоянные межсессионные знания помимо встроенных MEMORY.md и USER.md. Одновременно может быть активирован только один внешний провайдер — встроенная память всегда активна вместе с ним.

Быстрый старт

hermes memory setup      # интерактивный выбор + конфигурация
hermes memory status     # проверить, что активно
hermes memory off        # отключить внешнего провайдера

Вы также можете выбрать активный провайдер памяти через «Плагины Hermes» → Плагины провайдера → Поставщик памяти.

Или установите вручную в ~/.hermes/config.yaml:

memory:
  provider: openviking   # или honcho, mem0, hindsight, holographic, retaindb, byterover, supermemory

Как это работает

Когда провайдер памяти активен, Hermes автоматически:

  1. Внедряет контекст провайдера в системный запрос (что знает провайдера)
  2. Предварительно загружает соответствующие воспоминания перед каждым шагом (фоново, неблокирующе)
  3. Синхронизирует шаги разговора с провайдером после каждого ответа
  4. Извлекает воспоминания по завершении сеанса (для провайдеров, которые это известно)
  5. Зеркалирует запись встроенной памяти у внешнего провайдера.
  6. Добавляет инструменты, специальные для провайдера, чтобы агент мог искать, хранить и управлять воспоминаниями.

Встроенная память (MEMORY.md/USER.md) продолжает работать точно так же, как и раньше. Внешний провайдер является независимым.

Доступные провайдеры

Хончо

AI-нативное межсессионное моделирование пользователя с диалектическим рассуждением, внедрением контекста с видимой сессией, семантическим поиском и постоянными выводами. Базовый контекст теперь включает сводку сессии с представлением пользователей и карточками коллег, давая агенту уведомление о том, что уже обсуждалось.

Лучше всего для Мультиагентные системы с межсессионным контекстом, конкурентные пользователь-агент
Требует pip install honcho-ai + ключ API или самостоятельный хостинг
Хранение данных Honcho Cloud или самостоятельный хостинг
Стоимость Цены Honcho (облако) / бесплатно (самостоятельный хостинг)

Инструменты (5): honcho_profile (чтение/обновление карточек коллеги), honcho_search (семантический поиск), honcho_context (контекст сессии — сводка, представление, карточка, сообщения), honcho_reasoning (синтез LLM), honcho_conclude (создание/удаление выводов)

Архитектура:уровневое двухвое внедрение контекста — базовый уровень (сводка сессии + представление + карточка коллеги, обновляется с интенсивностью contextCadence) плюс диалектическое дополнение (рассуждение LLM, обновляется с индикатором dialecticCadence). Диалектика автоматически выбирает холодные стартовые промпты (общие факты о пользователе) против теплых промптов (контекст с регионом сессии) на основе того, существует ли базовый контекст.

Три ортогональных конфигурационных рычага независимо контролируют стоимость и ввод:

Мастер настроек:

hermes memory setup        # выберите "honcho" — запускает пост-настройку, специфичную для Honcho

Устаревшая команда hermes honcho setup всё ещё работает (теперь она перенаправляет на hermes Memory setup), но регистрируется только после выбора Honcho в качестве активного провайдера памяти.

Конфиг: $HERMES_HOME/honcho.json (локальный для профиля) или ~/.honcho/config.json (глобальный). Порядок разрешения: $HERMES_HOME/honcho.json > ~/.hermes/honcho.json > ~/.honcho/config.json. См. справочник конфигурации и руководство по представлению Honcho.

<подробности>

Полный справочник конфигурации
Ключ По умолчанию Описание
apiKey -- API-ключ с app.honcho.dev
baseUrl -- Базовый URL для самостоятельного хостинга Honcho
peerName -- Идентичность пользователей-коллеги
айПир ключ хоста Идентичность AI-коллеги (один на профиль)
рабочее пространство ключ хоста Общий ID рабочего пространства
contextTokens null (без лимита) Бюджет токенов для автоматического внедрения контекста на шаг. Усекается по границам слов
контекстКаденция 1 Минимальное количество шагов между вызовами API context() (обновление базового слоя)
диалектикаКаденция 2 Минимальное количество шагов между вызовами LLM peer.chat(). составляет 1–5. Применяется только к режимам гибрид/контекст
диалектическая глубина 1 Количество проходов .chat() на один вызов диалектики. Ограничено 1–3. Проход 0: холодный/тёплый промпт, проход 1: самоаудит, проход 2: согласование
диалектикаDepthLevels ноль Опциональный массив уровней распределения на проходе, например ["минимальный", "низкий", "средний"]. Переопределяет пропорциональные значения по умолчанию
уровень диалектического рассуждения 'низкий' Базовый уровень рассуждения: минимальный, низкий, средний, высокий, макс
диалектическийДинамический правда Если true, модель может переопределить уровень рассуждения для каждого вызова через параметр инструмента
dialecticMaxChars 600 Макс. символы результата диалектики, внедренного в системный запрос
режим отзыва 'гибрид' гибрид (автовнедрение + инструменты), контекст (только внедрение), инструменты (только инструменты)
writeFrequency 'асинхронный' При отправке сообщений: async (фоновый поток), turn (синхронно), session (пакетно при завершении) или число N
сохранить сообщения правда Сохранять ли сообщения в API Honcho
режим наблюдения 'направленный' «направленный» (все включенные) или «унифицированный» (общий пул). Переопределяется объектом наблюдение
messageMaxChars 25000 Макс. символы в сообщении (разбивается на части при превышении)
dialecticMaxInputChars 10000 Макс. символы для ввода диалектики запроса в peer.chat()
сессионная стратегия 'для каждого каталога' для каждого каталога, для каждого репозитория, для каждого сеанса, глобальный

</подробнее>

<подробности>

Минимальный honcho.json (облако)
{
  "apiKey": "your-key-from-app.honcho.dev",
  "hosts": {
    "hermes": {
      "enabled": true,
      "aiPeer": "hermes",
      "peerName": "your-name",
      "workspace": "hermes"
    }
  }
}

</подробнее>

<подробности>

Минимальный honcho.json (самостоятельный хостинг)
{
  "baseUrl": "http://localhost:8000",
  "hosts": {
    "hermes": {
      "enabled": true,
      "aiPeer": "hermes",
      "peerName": "your-name",
      "workspace": "hermes"
    }
  }
}

</подробнее>

💡 Tip

Миграция с hermes honcho Если вы ранее использовали «hermes honcho setup», ваша конфигурация и все данные на стороне сервера останутся нетронутыми. Просто повторите через мастер настройки или вручную установите memory.provider: honcho, чтобы реактивировать через новую систему.
Многопользовательская настройка:

Honcho моделирует разговоры как обмен сообщениями между коллегами — один пользовательский коллега плюс один AI-коллега в профиле Гермеса, все в одном рабочем пространстве. Рабочее пространство — это общая среда: глобальные пользователи-коллеги для всех профилей, каждый AI-коллега имеет свою собственную идентичность. Каждый AI-коллега строит независимое представление/карточку из своих фундаментальных принципов, поэтому профиль "кодер" остается ориентированным на код, а профиль "писатель" остается редакционным для того же пользователя.

Сопоставление:

Предложение Что это
Рабочее пространство Общая обстановка. Все профили Hermes в одном рабочем месте демонстрируют одну и ту же идентичность пользователя.
Пользовательский коллега (peerName) Человек. Общий для всех профилей в рабочем пространстве.
AI-коллега (aiPeer) Один на профиль Гермес. Ключ хоста hermes → по умолчанию; hermes.<профиль> для других.
Наблюдение Переключатели для каждого коллеги, управляющие темой, которую Honcho моделирует из своих сообщений. «направленный» (по умолчанию, все четыре включения) или «унифицированный» (пул одного наблюдателя).

Новый профиль, коллеги свежа Honcho

hermes profile create coder --clone

--clone создает блок хоста hermes.coder в honcho.json с aiPeer: "coder", общим workspace, унаследованным peerName, recallMode, writeFrequency, observation и т.д. AI-коллега охотно создаётся в Honcho, чтобы он до первого сообщения.

Существующие профили, обратное заполнение коллег Honcho

hermes honcho sync

Сканирует каждый профиль Hermes, создаёт блоки хостов для любого профиля без него, наследует настройки блока hermes по умолчанию и с нетерпением создаёт новых AI-коллегов. Идемпотентно — пропускает профиль, у которого уже есть блок хоста.

Наблюдение за каждым профилем

Каждый хост-блок может независимо переопределять конфигурацию наблюдения. Пример: профиль, ориентированный на код, где AI-коллега наблюдает за пользователем, но не моделирует себя:

"hermes.coder": {
  "aiPeer": "coder",
  "observation": {
    "user": { "observeMe": true, "observeOthers": true },
    "ai":   { "observeMe": false, "observeOthers": true }
  }
}

Переключатели наблюдения (один набор на коллегах):

Переключатель Эффект
наблюдай за мной Honcho строит представление этого совета из своих естественных сообщений
наблюдать за другими Этот коллега наблюдает за сообщениями других коллег (питает межколлегиальное обсуждение)

Предустановки через observationMode:

Переключатели на стороне сервера, установленные через панель управления Honcho, имеют приоритет над локальными значениями по умолчанию — синхронизируются обратно при инициализации сессии.

См. страницу Honcho для полного справочника по наблюдению.

<подробности>

Полный пример honcho.json (многопрофильный)
{
  "apiKey": "your-key",
  "workspace": "hermes",
  "peerName": "eri",
  "hosts": {
    "hermes": {
      "enabled": true,
      "aiPeer": "hermes",
      "workspace": "hermes",
      "peerName": "eri",
      "recallMode": "hybrid",
      "writeFrequency": "async",
      "sessionStrategy": "per-directory",
      "observation": {
        "user": { "observeMe": true, "observeOthers": true },
        "ai": { "observeMe": true, "observeOthers": true }
      },
      "dialecticReasoningLevel": "low",
      "dialecticDynamic": true,
      "dialecticCadence": 2,
      "dialecticDepth": 1,
      "dialecticMaxChars": 600,
      "contextCadence": 1,
      "messageMaxChars": 25000,
      "saveMessages": true
    },
    "hermes.coder": {
      "enabled": true,
      "aiPeer": "coder",
      "workspace": "hermes",
      "peerName": "eri",
      "recallMode": "tools",
      "observation": {
        "user": { "observeMe": true, "observeOthers": false },
        "ai": { "observeMe": true, "observeOthers": true }
      }
    },
    "hermes.writer": {
      "enabled": true,
      "aiPeer": "writer",
      "workspace": "hermes",
      "peerName": "eri"
    }
  },
  "sessions": {
    "/home/user/myproject": "myproject-main"
  }
}

</подробнее>

См. справочник конфигурации и руководство по представлению Honcho.


ОпенВикинг

Контекстная база данных от Volcengine (ByteDance) с иерархией знаний в стиле файловой системы, многоуровневым поиском и автоматическим извлечением памяти в 6 категориях.

Лучше всего для Самостоятельные методы управления со структурированным обзором
Требует pip install openviking + работающий сервер
Хранение данных Самостоятельный хостинг (локально или в облаке)
Стоимость Бесплатно (открытый исходный код, AGPL-3.0)

Инструменты: viking_search (семантический поиск), viking_read (многоуровневый: Abstract/overview/full), viking_browse (навигация по файловой системе), viking_remember (сохранение фактов), viking_add_resource (загрузка URL/документов)

Настройка:

# Сначала запустите сервер OpenViking
pip install openviking
openviking-server

# Затем настройте Hermes
hermes memory setup    # выберите "openviking"
# Или вручную:
hermes config set memory.provider openviking
echo "OPENVIKING_ENDPOINT=http://localhost:1933" >> ~/.hermes/.env

Ключевые особенности: - Многоуровневая загрузка контекста: L0 (~100 токенов) → L1 (~2к) → L2 (полный) - Автоматическое извлечение памяти при завершении сессии (профиль, предпочтения, сущности, события, случаи, шаблоны) - Схема URI viking:// для иерархического просмотра знаний.


Мем0

Серверное извлечение фактов LLM с семантическим поиском, переранжированием и автоматической дедупликацией.

Лучше всего для Бесконтактного управления памятью — Mem0 обрабатывает извлечение автоматически
Требует pip install mem0ai + API-ключ
Хранение данных Облако Mem0
Стоимость Цены Mem0

Инструменты: mem0_profile (все сохранённые воспоминания), mem0_search (семантический поиск + переранжирование), mem0_conclude (сохранение дословных фактов)

Настройка:

hermes memory setup    # выберите "mem0"
# Или вручную:
hermes config set memory.provider mem0
echo "MEM0_API_KEY=your-key" >> ~/.hermes/.env

Конфиг: $HERMES_HOME/mem0.json

Ключ По умолчанию Описание
user_id гермес-пользователь Идентификатор пользователя
агент_ид гермес Идентификатор агента

Оглядываясь назад

Долговременная память с графом знаний, изучением сущностей и многостратегическим поиском. Инструмент hindsight_reflect обеспечивает межпамятный синтез, которого нет ни у одного другого провайдера. Автоматически сохраняет полные шаги разговора (включая вызовы инструментов) с отслеживанием документов на уровне сессии.

Лучше всего для Восстановления на основе графа знаний с отношениями сущностей
Требует Облако: API-ключ с ui.hindsight.vectorize.io. Локально: API-ключ LLM (OpenAI, Groq, OpenRouter и т.д.)
Хранение данных Hindsight Cloud или локальный встроенный PostgreSQL
Стоимость Цены Hindsight (облако) или бесплатно (локально)

Инструменты: hindsight_retain (сохранение с извлечением сущностей), hindsight_recall (многостратегический поиск), hindsight_reflect (межпамятный синтез)

Настройка:

hermes memory setup    # выберите "hindsight"
# Или вручную:
hermes config set memory.provider hindsight
echo "HINDSIGHT_API_KEY=your-key" >> ~/.hermes/.env

Мастер настройки автоматически устанавливает параметры и устанавливает только то, что необходимо для подключения устройства («hindsight-client» для облаков, «hindsight-all» для локального). Требуется hindsight-client >= 0.4.22 (автоматически обновляется при запуске сессии, если устарело).

UI локального режима: hindsight-embed -p hermes ui start

Конфиг: $HERMES_HOME/hindsight/config.json

Ключ По умолчанию Описание
режим облако облачный или локальный
bank_id гермес Идентификатор банка памяти
отзыв_бюджет середина Тщательность определения: «низкая» / «средняя» / «высокая»
режим_памяти гибрид гибрид (контекст + инструменты), контекст (только автовнедрение), инструменты (только инструменты)
auto_retain правда Автоматическое сохранение шагов разговора
auto_recall правда Автоматически из включения событий перед каждым шагом
retain_async правда Обработать сохранение асинхронно в пространстве
сохранить_контекст разговор агента Гермеса и пользователя Метка контекста для сохранённых воспоминаний
сохранить_теги Теги по умолчанию, примененные к сохранённым воспоминаниям; объединяются с тегами вызова инструмента
сохранить_источник Опциональный metadata.source, прикрепляемый к сохранённым воспоминаниям
retain_user_prefix Пользователь Метка перед шагами пользователя в автоматически сохранённых транскриптах
retain_assistant_prefix Ассистент Метка перед шагами ассистента в автоматически сохранённых транскриптах
recall_tags Теги для фильтрации при поиске

См. Плагин README для полной конфигурации справочника.


Голографический

Локальное хранилище фактов SQLite с полнотекстовым поиском FTS5, оценкой надежности и HRR (голографическими сокращенными представлениями) для композиционных алгебраических запросов.

Лучше всего для Локальная память с расширенным поиском, без внешних зависимостей
Требует Ничего (SQLite всегда доступен). NumPy опционально для алгебры HRR.
Хранение данных Локальный SQLite
Стоимость Бесплатно

Инструменты: fact_store (9 действий: добавить, найти, проверить, связано, обосновать, противоречить, обновить, удалить, составить список), fact_feedback (оценка полезно/бесполезно, которая обучает оценивать надежность)

Настройка:

hermes memory setup    # выберите "holographic"
# Или вручную:
hermes config set memory.provider holographic

Конфиг: config.yaml в разделе plugins.hermes-memory-store

Ключ По умолчанию Описание
db_path $HERMES_HOME/memory_store.db Путь к базе данных SQLite
auto_extract ложь Автоматически из фактов при завершении сессии
default_trust 0,5 Оценка доверия по умолчанию (0,0–1,0)

Уникальные возможности: - зонд — алгебраический поиск, специфичный для явлений (все о фактах человека/вещи) - причина — композиционные И-запросы по существу сущностей - contradict — обнаружение конфликтующих фактов. - Оценка доверия с асимметричной обратной связью (+0,05 полезно / -0,10 бесполезно)


Ретайндб

Облачный API памяти с гибридным поиском (Vector + BM25 + Reranking), 7 типами памяти и дельта-сжатием.

Лучше всего для Команды, уже использующие инфраструктуру RetainDB
Требует Учётная запись RetainDB + API-ключ
Хранение данных Облако RetainDB
Стоимость $20/месяц

Инструменты: retaindb_profile (профиль пользователя), retaindb_search (семантический поиск), retaindb_context (контекст, релевантный задаче), retaindb_remember (сохранение с типом + сравнениею), retaindb_forget (удаление воспоминаний)

Настройка:

hermes memory setup    # выберите "retaindb"
# Или вручную:
hermes config set memory.provider retaindb
echo "RETAINDB_API_KEY=your-key" >> ~/.hermes/.env

БайтРовер

Постоянная память через CLI brv — иерархическое дерево знаний с многоуровневым поиском (нечёткий текст → поиск через LLM). Локально-первый с опциональной облачной синхронизацией.

Лучше всего для Разработчики, которым нужна портативная, локально-первая память с CLI
Требует ByteRover CLI (npm install -g byterover-cli или скрипт установки)
Хранение данных Локально (по умолчанию) или ByteRover Cloud (опциональная синхронизация)
Стоимость Бесплатно (локально) или цены ByteRover (облако)

Инструменты: brv_query (поиск в дереве знаний), brv_curate (сохранение фактов/решений/шаблонов), brv_status (версия CLI + статистика дерева)

Настройка:

# Сначала установите CLI
curl -fsSL https://byterover.dev/install.sh | sh

# Затем настройте Hermes
hermes memory setup    # выберите "byterover"
# Или вручную:
hermes config set memory.provider byterover

Ключевые особенности: - Автоматическое извлечение перед сжатием (сохраняет инсайты до того, как сжатие контекста их отбросит) - Дерево серверов хранится в $HERMES_HOME/byterover/ (с областью профиля) - SOC2 Type II сертифицированная облачная синхронизация (опционально)


Суперпамять

Семантическая долговременная память с поиском по профилю, семантическим поиском, явными инструментами памяти и загрузкой разговора при завершении сессии через API графа Supermemory.

Лучше всего для Семантическое восстановление с профилированием пользователей и построением графа на уровне сессии
Требует pip install supermemory + ключ API
Хранение данных Облако Суперпамяти
Стоимость Цены Суперпамять

Инструменты: supermemory_store (сохранение явных воспоминаний), supermemory_search (поиск по семантическому сходству), supermemory_forget (забыть по ID или запросить наилучшего совпадения), supermemory_profile (постоянный профиль + недавний контекст)

Настройка:

hermes memory setup    # выберите "supermemory"
# Или вручную:
hermes config set memory.provider supermemory
echo 'SUPERMEMORY_API_KEY=***' >> ~/.hermes/.env

Конфиг: $HERMES_HOME/supermemory.json

Ключ По умолчанию Описание
container_tag гермес Тег контейнера, необходимые для проверки и записи. Поддерживает шаблон {identity} для тегов с областью профиля.
auto_recall правда Внедрять релевантный контекст памяти перед шагами
auto_capture правда Сохранять уточненные шаги пользователь-помощник после каждого ответа
max_recall_results 10 Макс. количество извлеченных элементов для формирования в контекст
профиль_частота 50 Включить профиль фактов на первом шаге и шагах N шагов
capture_mode все Пропуск микроскопических или тривиальных шагов по умолчанию
режим_поиска гибрид Режим определения: «гибрид», «воспоминания» или «документы»
api_timeout 5.0 Таймаут для SDK и запрос загрузки

Переменные окружения: SUPERMEMORY_API_KEY (обязательно), SUPERMEMORY_CONTAINER_TAG (переопределяет конфиг).

Ключевые особенности: - Автоматическое ограждение контекста — удаление извлечённых воспоминаний из захваченных шагов, чтобы предотвратить рекурсивное загрязнение памяти. - Загрузка разговора при завершении сессии для более богатого построения знаний на уровне графа - Факты профиля включаются на первом этапе и с настраиваемыми интервалами. - Фильтрация тривиальных сообщений (пропускает "ок", "спасибо" и т.д.) - Контейнеры с региональным профилем — викор {identity} в container_tag (например, hermes-{identity}hermes-coder) для публикации упоминаний по профилю Hermes - Многоконтейнерный режим — включает enable_custom_container_tags со списком custom_containers, чтобы агент мог читать/записывать в именованные контейнеры. Автоматические операции (синхронизация, предварительная загрузка) продолжаются на протяжении всего контейнера.

<подробности>

Пример многоконтейнерной конфигурации
{
  "container_tag": "hermes",
  "enable_custom_container_tags": true,
  "custom_containers": ["project-alpha", "shared-knowledge"],
  "custom_container_instructions": "Используйте project-alpha для контекста кодинга."
}

</подробнее>

Поддержка: Discord · support@supermemory.com


Сравнение провайдеров

Провайдер Хранение Стоимость Инструменты Зависимости Уникальная особенность
Хончо Облако Платно 5 хончо-ай Диалектическое моделирование пользователя + контекст с областью сессии
ОткрытыйВикинг Самостоятельный хостинг Бесплатно 5 openviking + сервер Иерархия файловой системы + многоуровневая загрузка
Мем0 Облако Платно 3 mem0ai Серверное извлечение LLM
Оглядываясь назад Облако/Локально Бесплатно/Платно 3 задним числом-клиент Граф знаний + синтез отражает
Голографический Локально Бесплатно 2 Нет Алгебра HRR оценка + доверие
СохранитьБД Облако $20/мес 5 просьбы Дельта-сжатие
БайтРовер Локально/Облако Бесплатно/Платно 3 CLI brv Извлечение перед сжатием
Суперпамять Облако Платно 4 суперпамять Ограждение контекста + загрузка графа сессии + многоконтейнерность

Изоляция профилей

Данные каждого провайдера изолированы по профилю:

Создание провайдера памяти

См. Руководство разработчика: Плагины провайдеров памяти для информации о том, как создать свой участок.