Опубликовано
State вместо истории: как малая модель с окном 32k тянет многоходовый чат
Автор: Гусев Николай [портфолио]
Дата обновления не указана в исходнике.
Темы: agent-memory, ai-agents, benchmarks, local-models
State вместо истории: как малая модель с окном 32k тянет многоходовый чат
Сложность: высокая
Проверил на своей 4060 три механики длинных сессий: классический ReAct со сквозным транскриптом, SKILL.state и связку compress + поиск по архиву, как в Hermes Agent. К 25-му ходу ReAct раздувает промпт в 19 раз и хоронит ранний факт, state держит промпт плоским, а recall на малой модели даёт только дословный поиск по архиву. На заметку агентостроителям: если строите своих агентов, не обязательно упираться в дефолтный ReAct - есть способы получше.
→ Читать на Telegra.ph: https://telegra.ph/State-na-svoej-4060-ReAct-SKILLstate-i-poisk-na-8-GB-09-12
🌐 hermes-agent.ru 📦 Материалы и харнессы: https://github.com/NikolayGusev-astra/channel-materials/tree/master/2026-09-12-skill-state-bench ℹ️ Хотите попробовать, но нет времени разбираться? Напишите в контакты на сайте - поможем с настройкой и подбором сценария под ваши задачи. 🛠 Наши сервисы: pii-guard.ru | llm.pii-guard.ru | hermes-agent.ru | shturman.ai - сотрудничество и вопросы: TG @sneg1313