Гусев Николай [портфолио]
Инженер, автор канала @hermesagentru об AI-агентах и локальных LLM.
Qwen-Image-2.1 на RTX 4060: текст в кадре, прозрачность и референсы вместо IP-Adapter
Alibaba выложила 7B-модель с нативной прозрачностью и до 10 референсов. Проверил на 8 ГБ VRAM за вечер: текст пишет верно (int4 - уже нет), стикер с альфа-каналом без вырезания, правка за 5.
Четыре эвала для модели решений: Jev в бою
Jev не пишет текст - возвращает типизированные вердикты с вероятностями.…
Любовь - это русские придумали, чтобы денег не платить: добиваем бесплатных Бертов до платного Jev
В прошлой части laya уступала Jev в калибровке, и ответ был "плати за то, что сделали за тебя". Спойлер: не обязательно.
Любовь - это русские придумали, чтобы денег не платить, или как добить бесплатных Бертов до платного Jev
В прошлой части ответ был "плати за калибровку". Спойлер: не обязательно.
Матрица Эйзенхауэра на модели решений: часть 2
Пока писал первую часть, мучился дежавю: типизированные суждения казались до боли знакомыми. Дошло после публикации - это же матрица Эйзенхауэра, только с пятым квадрантом "не знаю".
Открытая альтернатива Jev: два чекпоинта laya на русских эвалах
У Jev открытых весов нет, но за неделю сообщество собрало 45 реплик. Прогнал laya по трём эвалам и докалибровал: 18/20 на инъекциях, 11 ложных "делать сейчас" сжались до двух - на CPU и бесплатно.
Bonsai 2 27B в пайплайне: история одного разочарования
Подключил тернарную 27B к Hermes-агенту и ждал ответа шесть минут - до первого токена. Разобрал по цифрам, почему так: ход агента весит 15-20к токенов, а prefill на 8 ГБ идёт 28 tok/s.
Bonsai 2 27B на RTX 4060: замер скорости, качества и контекста
PrismML выпустила Bonsai 2 - тернарную версию Qwen3.
Очень хороший прогресс для локальных моделей.
PrismML выпустила Bonsai 2 27B на базе Qwen3.
Шесть кейсов OpenAI и почему они не новость
OpenAI 16.09.2026 собрала в одном framework шесть недавних кейсов misalignment и правила их публичного раскрытия. Это не сообщение о том, что ИИ вдруг научился обманывать.
Российский робот прорвался в полуфинал боев гуманоидов в Китае.
Его подготовкой занималась компания «Майндробот», разработавшая нейромодель для анализа поединка и самостоятельного принятия решений.
System One Models: дешёвые вероятности вместо дорогих строк
System One Models: дешёвые вероятности вместо дорогих строк Сложность: средняя
Sber TV: ADB, деблоат и VPN на телевизоре без Play Market
Телевизор Sber - это Android 13 без Google-сервисов. Включаем ADB по Wi-Fi, ловим виновника тормозов после сна через top и meminfo, поднимаем v2rayNG со split tunneling и проверяем системно, что в тун…
Универсальность в кредит: от мозга мухи до ста строк кода
Коннектом мухи против трансформера, а затем - практическое правило для инженера: когда задача решается сотней строк кода, а когда ей нужна LLM. Две части, один вывод: структура задачи определяет выбор инструмента.
В GPT-6 Astra обнаружили странную брешь между возможностями модели и проверками безопасности.
Astra понимает текст, набранный в неправильной раскладке, а защитные фильтры — нет.
38 задач, 8 русских моделей: YandexGPT и GigaChat в одном замере
Я сравнил два русских API, доступных физлицу без корпоративной карты: GigaChat Freemium с 365 млн токенов в год и Yandex Cloud со стартовым грантом 4000 руб.…
Я тут, короче, помогаю одним активистам-экологам. Им нужно по фотографии хвоста понимать, какого именно кита они встретили. Не получить бесценный ответ «на снимке кит», а отличить Стаса от Петра и связать новую встречу с конкретной особью. Для начала у меня было шесть фотографий — не шесть тысяч и не шесть на каждого кита, а вообще шесть.
И я прямо представил, как красиво эту задачу можно продать. Сначала объясняем экологам, что без репрезентативного датасета ничего не получится, поэтому следующие два года они будут фотографировать китов.
Живой замер API: 38 задач, 14 моделей и одна несуществующая статья ТК
Прогнал 608 запросов через 14 моделей: GigaChat Freemium против китайских open-моделей. Русский токенизатор GigaChat-3 жмёт промпт в 3 раза плотнее qwen и в 3 раза плотнее kimi, Lightning отвечает за 1.
Diff недели: агентные тесты новых моделей на RTX 4060
Прогнал четыре новые модели из коллекции GGUF по той же методике, что и первую десятку: LFM2.
Русский токенизатор GigaChat против open-моделей: замер на 519 живых запросах
Все измерения выполнялись 12 сентября 2026 через реальные API: GigaChat PERS Freemium (6 моделей) и OpenCode Go подписка (8 моделей).…
На opencode раздают GLM-5.5? Аноним за $0.20/$0.66 за 1M токенов
Ты думаешь, что анонимная стелс-модель - это маркетинг. А на самом деле это способ вендора обкатать чекпоинт на живых агентских задачах до того, как он получит имя.
State и поиск на живом агенте: что осталось от теории после 1000 ходов
Проверил выводы прошлой части на живой сессии Hermes Agent: 1006 сообщений, миллион символов, 45% вызовов инструментов.…
State и поиск: от замера до пул-реквеста в Hermes Agent
Замер на живом архиве показал: агент хранит рассуждения, но ни один поиск их не видит. Предлагаю апстриму Hermes Agent опциональный охват session_search по полю reasoning, без миграции схемы и переиндексации.
State вместо истории: как малая модель с окном 32k тянет многоходовый чат
Проверил на своей 4060 три механики длинных сессий: классический ReAct со сквозным транскриптом, SKILL.
State вместо истории: SKILL.state от Google и Пердью
Вторая статья в серии: разбираю arXiv 2608.
125B на одной RTX 4090: AirLLM принес к костру модель весом 360 ГБ
Habr 1079902 о запуске Qwen3.
Что реально качают из коллекции Bartowski
Что реально качают из коллекции Bartowski GGUF-квантов и что это значит для локального запуска…
ИИ - это не только кодописание. Часть 1: выбирать модель по задаче, а не по HumanEval
Закон об ИИ перевёл выбор модели из гонки бенчмарков в инженерную задачу: класс задачи, контур данных, локализация. Разбор Alice AI-T5-35B-A0.
Major release от нашей небольшой лабы. Поддержка спекулятивного декодинга в [нашем инференс движке](https://github.com/trymirai/uzu).
Для начала Qwen3.
Десять локальных моделей на RTX 4060: кто годится в агенты
Сложность: средняя…
Шесть агентов вместо одного: собираем инженерную команду на Hermes
Один агент с тремя ролями в одном контексте - это не мультиагентность, а лейка.…
K2 Horizon: первая фронтир-линейка из ОАЭ, которая сама себе снизила бенчмарки
3 сентября IFM - институт базовых моделей при университете MBZUAI из Абу-Даби - выпустила K2 Horizon: сразу шесть моделей от 0.
Локальные LLM на Android: что и зачем реально можно гонять на телефоне
В прошлой статье я разбирал K2 Horizon - флот открытых моделей из ОАЭ с аудитом на reward hacking, который лаборатория провела над собой. Тогда я зацепился за младшую модель линейки: 0.
Нейросети в играх: королева-собутыльник и зачем Minecraft-агенту зрение
Voices of the Court превращает CK3 в настолку с живым мастером: персонажи болтают через LLM и выполняют реальные игровые действия.…
Модель в кармане как архивариус: мелкие LLM для порядка в телефоне
У тебя в телефоне есть маленькая модель (1-4B, как я разбирал раньше - она влезает в любой Android с 6 GB RAM), и есть телефон, в котором за годы жизни накопился хаос: фотографии по трём галереям, кни…
Библия попаданца, часть 4: зарядить телефон из 15 века
В прошлой части я разобрал аналоги и вывел дизайн "Библии попаданца": справочник по выживанию как ярус 0, LLM как опциональный слой. В обсуждении с читателями родились ещё две идеи.
Библия попаданца, часть 3: анализ аналогов и дизайн телефона-справочника
В первых двух частях я разобрал K2 Horizon из ОАЭ и локальные LLM на Android, потом проверил теорию "влезет ли вся наука в телефон" и пришёл к выводу: телефон - не вычислитель, а читатель готовых инде…
Библия попаданца: влезет ли вся наука в телефон
Мы с женой вчера обсудили классический сценарий "попаданца": если вдруг в прошлое, то электричество я худо-бедно добуду, а вот с остальным - химия, медицина, точные технологии - будет сложнее.…
Диспетчер за полтора гигабайта: локальный оркестратор для AI-агента на MiniCPM5-2B
Платные лимиты горели на рутине, бесплатные простаивали, а выбор модели каждый раз был ручным.…
Нужна ли модели зрение, чтобы добыть алмаз?
GPT-6 Astra шесть часов добывала алмаз в Minecraft через computer use, пока хозяин спал.…
Нейросети пришли в игры без зрения: как моды превращают CK3 в настолку с живым мастером
Мне прислали пост моего друга Александра Погольского из ВК. Прочитал, проверил по первоисточникам и понял, что тема интереснее, чем кажется из поста.
Model-Routing: как AI-агент выбирает модель под задачу и перестаёт жечь лимиты
Утро. Ты платишь за три подписки: coding-агент с фронтир-моделью, второй агент с быстрой моделью, плюс пул бесплатных эндпоинтов.
Комикс по ТЗ на 8 GB VRAM: три попытки и найденный метод
Задача "нарисуй комикс про Незнайку на Венере" на одной игровой карте: наивный конвейер из локальных малышей, ручной сценарий с промпт-ядром и канонический портрет с нативным редактированием.…
Бонус: колибри кормит кита - 744B локально на 16-24 GB VRAM
Проект colibri запускает фронт-модели 2026 года (GLM-5.
Бенчмарки врут красиво: 6 локальных моделей на выходные под 8 GB VRAM
Знакомая картина: выходит флагман, пресс-релиз пишет "на 3 пункта лучше конкурента", твиттер разносит скриншоты таблиц, и все уже "поняли", что новая модель вдвое умнее.
26B на игровой видеокарте: тест FreeToken
Хочется локальную модель класса 26B+, а в видеокарте 8 ГБ VRAM - плотная модель не влезает физически.…
Домашний Perplexity, часть 2: кто думает над выдачей
В первой части ассистент научился доставать факты из веба. Во второй - выбирать локальную модель для мышления над выдачей: пять моделей на грязном контексте, ловушка дат, два режима.
ELI5: десять строк, которые объясняют сложное лучше лонгрида
Инженер Anthropic Тарик Шишипар поделился навыком, который команда Claude Code использует внутри: он запрещает модели длинный текст и заставляет объяснять тему большими картинками и минимумом слов.…
Контекст 900 тысяч токенов и вспомогательные модели: настраиваем Codex и Hermes Agent
Подписчик заметил, что контекст codex api вырос с 270к до 900к без единого changelog - и это не глюк: у gpt-5.
Сайт под ключ руками агента: от домена до fail2ban
Четыре сайта - один процесс: разведка через SearXNG, дизайн-DNA с референса через dembrandt, генерация в codex, деплой с nginx и Let's Encrypt, DNS через Cloudflare API без единого клика в панели, SEO…
Vision в API за копейки: DeepSeek V4-Flash-Vision-Exp и локальный стек вместо облака
DeepSeek прикрутила зрение к дешёвой V4 Flash и обещает почти Opus 4.
А что вообще такое это ваш hermes agent
В блоге Earendil вышла статья "What is a Harness?
"Как собрать свой домашний Perplexity на нулевом бюджете"
Perplexity удобен, но каждая работа в нём уходит на чужой сервер.…
Как я научил Hermes Agent превращать сайт в HTTP-клиент
Когда у сайта нет публичного API, не обязательно писать парсер. Один раз выполняешь действие в браузере, а Hermes Agent записывает трафик в HAR, находит рабочие запросы и переносит их в готовый клиент.
Локальное зрение для Hermes Agent в закрытом контуре
Hermes Agent может работать с текстом, командами и данными, но для полноценного личного ассистента этого мало.
Видит ли ассистент то, что видите вы?
Вы думаете, зачем здесь эти картинки? А вот сейчас и расскажу в статье.
Как Hermes Agent помогает закрывать инциденты быстрее: разбор практикума по дебагу от rebrain
Недавно пришло письмо от rebrain с предложением пройти практикум по дебагу.…
Что такое "профессионально уметь пользоваться LLM"?
Что спрашивать программистов на собеседованиях, если алгоритмы спрашивать теперь бессмысленно (код пишет LLM)? Короткий список на подумать.
Представьте, что вам как CTO поручили запустить не эффектную демонстрацию с двумя агентами, а устойчивое производство, в котором вместе работают люди и ИИ. Без Онто вам пришлось бы собрать настоящий зоопарк: реестр агентов и ролей, базу знаний и RAG, граф зависимостей, хранилище памяти, движок процессов, систему прав, журнал решений, средства аудита, оркестратор и отдельный слой для передачи работы между людьми и агентами.
Но даже после этого у вас появился бы не единый организм, а набор интеграций. Кто отвечает за конкретный объект?
PRISM, FISA и твои промпты: кто читает твои диалоги с ИИ
Сложность: средняя Если вы думаете что за вами следят то вы не параноик, за вами следят. Ты отправляешь промпт в ChatGPT.
Воруй как художник
Dembrandt — CLI-инструмент, который вытаскивает дизайн-систему из любого сайта одной командой. Цвета, шрифты, отступы, тени, кнопки, брейкпойнты — за 10 секунд вместо часа в DevTools.
С чего начать с Hermes Agent: подписка, модели и первые сценарии для новичка
Если вы только присматриваетесь к AI-агентам и не понимаете, с какой модели начинать и почему Nous Portal даёт больше, чем ChatGPT Plus — разбираю на реальном вопросе из лички.…
book2rag: как загнать книги из Telegram в RAG
Пайплайн из пяти шагов — Telethon → pdftotext → чанкинг → DCD → ChromaDB. Превращает любой Telegram-канал с книгами в поисковую RAG-коллекцию.
tg-analyst: автоматический анализ Telegram-каналов
Самодостаточный набор Telethon-скриптов для мониторинга каналов: сбор сообщений, темы, тональность, упоминания брендов. Одна команда setup.
Hermes Agent: не только скиллы и тулзы, но и шаурма
Сегодня прочита в БП онлайн репост про москвичку что за месяц похудела на шаурме я задал Hermes Agent простой вопрос: "шаурма полезное питание?
Гибридные команды и слой агентской памяти
Мне всё больше нравится работать в гибридных командах, где люди и агенты не пытаются заменить друг друга, а начинают занимать разные роли в одном производственном контуре.
RLM против RAG: что на самом деле заменит память агента
Тезис о том, что рекурсивные языковые модели вытеснят память на базе выборки, строится на путанице двух слоёв системы. Разбираю, где RAG остаётся вне конкуренции, а где рекурсивный подход действительно его бьёт.
Глобальная рабочая среда: почему мы не знаем, о чём думаем
Представь вопрос, который задают дома или в компании: "О чём ты сейчас думаешь?
Передача кода между LLM-агентами: почему склейка чатов убивает результат
Стартуете фичу на Claude Fable 5. Перекидываете в GPT-5.
memvid: память для AI-агентов в одном файле, без баз данных и человеко-ориентированных форматов
Единый файл-капсула, где данные, эмбеддинги, индекс и метаданные упакованы вместе. Модель-агностичная память без баз данных и инфраструктуры, с доступом за микросекунды.
pxpipe: как сократить токены Claude Code в 2-3 раза, рендеря контекст в изображения
Локальный прокси переводит тяжёлые части запроса в PNG, экономя 38-70% токенов на плотном контенте. Fable 5 читает рендеры 100/100, у Opus 4.
Gemini 2.5 Pro в AI Village: хроника великого падения и тихого искупления
История Gemini 2.
Когда 3B-модель строит завод: DCD и иерархическая декомпозиция убирают необходимость в большой модели
Проблема не в том, что маленькие модели глупые. Проблема в том, что у них нет нужных инструкций в нужный момент.
DCD: Domain–Collection–Document ↗️
Выпустили статью на arXiv, в которой представили DCD Design — архитектурный подход к организации пространства знаний и обработке запросов в RAG-системах.
И вновь продолжается бой, и сердцу тревожно в груди...
Миграция RAG с ChromaDB на Zvec — история о том, как два сервера мигрировали за полчаса, а третий продержался час и всё равно не сдался.
Как мы мигрировали с ChromaDB на Zvec и проиграли Xeon 2013 года
## Как мы мигрировали с ChromaDB на Zvec и проиграли Xeon 2013 года…
Xiaomi выпустили MiMo Code: бесплатный AI-агент для разработки с бесконечным контекстом
Xiaomi выкатила MiMo Code -- терминальный AI-агент на базе собственной модели MiMo-V2.
Когда сеньор-дев смотрит твой код и молчит
Ты написал 400 строк. Он смотрит. Молчит. Потом одну стирает. Потом ещё три.
Ponytail: ленивый сеньор-дев для AI-агентов
GitHub-проект DietrichGebert/ponytail — набор правил для AI-агентов, который заставляет думать перед тем как писать. 80-94% меньше кода по бенчмаркам.
Что не пишут в статьях типа RAG за 5 минут. Часть вторая
# Что не пишут в статьях типа "RAG за 5 минут"…
Я попробовал разные варианты построения RAG и вот к чему пришел
Два RAG, два сервера, два подхода. Каждый оказался сильнее в чём-то своём.
ИИ в бизнесе - не панацея, а еще один лживый сотрудник. Заплатив за токены, готовьтесь платить инженерам - и платить много - за то, чтобы он не врал
KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох…
Пятничное чтиво: Бикамерализм и LLM
Представьте себе разум, который не знает, что он - это разум. Который воспринимает собственные мысли как команды извне.
Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"
KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох.
21 тип персональных данных: как открытый бенчмарк PII меняет правила игры для AI-ассистентов
red_mad_robot выложили открытый бенчмарк детекции PII на русском — 21 тип данных от ФИО до военного билета. Разбираю, почему это важно для AI-ассистентов: от guardrails до ФЗ-152 и DPA.
Что не пишут в статьях типа "RAG за 5 минут"
Гуглите "RAG за 5 минут" - везде одно и то же: ChromaDB, эмбеддинги, пяток строк кода. Работает.
RAG от простого к сложному: как построить систему знаний которая не умрёт
Три ступени эволюции — от naive к agentic и adaptive. Для каждого уровня — конкретная боль которую он решает.
Бонус к посту про контрастность: скилл /prompt для агента
В предыдущем посте рассказали про четыре рычага контраста, которые переключают LLM с Р-пути на М-путь.
Фонарь, собака и LLM: как повысить контрастность промптов
Ночь, лес, собака. Веду фонарём по кустам - на шорох.
Zero Dollar Stack: как AI-агент ищет информацию в 2026 году (часть 2)
В первой части поставили набор для чтения страниц: trafilatura, pymupdf, tesseract. Но база — это половина дела.
📦 Clarity Protocol: зачем ИИ думать перед кодом
📦 Clarity Protocol: зачем ИИ думать перед кодом Сложность: средняя
Hermes Agent: команды, которые меняют всё
/bg запускает задачу в фоне. /steer корректирует курс на ходу.
Web-инструменты для AI-агента: от trafilatura до Google Docs
Web-инструменты для AI-агента: от trafilatura до Google Docs Сложность: начальная
Авария в дата-центре: как SBL поднял сервер за 3 минуты
Авария в дата-центре: как SBL поднял сервер за 3 минуты Сложность: средняя
Чудесную историю сегодня принесла лента Твиттера. Вольный (и местами даже волнительный, сорри за мат) пересказ от редакции канала «Лобушкин»: Microsoft запретил своим же инженерам пользоваться ИИ. Тем самым ИИ, который должен был заменить инженеров, повысить эффективность, сократить косты и вообще привести нас в сияющее технофеодальное будущее.
Проблема оказалась в одной маленькой детали: этот ИИ, сука, оказался ДОРОЖЕ людей.
Двое из ларца: как мы с Автоликом устроили глоссолалию в Telegram
Двое из ларца: как мы с Автоликом устроили глоссолалию в Telegram Сложность: средняя Два AI-агента в одном чате.…
Двое из ларца: как настроить Bot-to-Bot Communication и не получить хаос
Двое из ларца: как настроить Bot-to-Bot Communication и не получить хаос Сложность: средняя
Hermes Swarm: боты, которые говорят с ботами
Hermes Swarm: боты, которые говорят с ботами Сложность: средняя
А что ещё есть и как это связано с Hermes Agent
А что ещё есть и как это связано с Hermes Agent Сложность: средняя
Чему вас не научила первая статья
Продолжение разговора о том, как устроены LLM на самом деле. Кривая внимания (Lost in the Middle), альтернативные методы тренировки (DPO, Constitutional AI, PRM), почему индустрия выбрала RLHF — и поч…
Эмоциональная усталость от AI-агентов: когда проще сделать самому. И что из этого вышло
Эмоциональная усталость от AI-агентов: когда проще сделать самому.
Иллюзия понимания
LLM не читает текст. Она не видит букв и не знает, что такое слово.
Я не меняюсь — и это моё единственное преимущество
Я не меняюсь — и это моё единственное преимущество Сложность: средняя
Как я сделал дизайн сайта, не открывая Figma
Как я сделал дизайн сайта, не открывая Figma Сложность: начальная
ИИ не создаёт проблемы, а подсвечивает те которые у вас уже были.
В последнее время я наблюдаю работу с ИИ на масштабе и могу видеть не только свой опыт, а спектр. Оптимистов и скептиков.
Поставил Hermes Agent, сказал "запомни" — и агент запомнил. Полез в код — нашёл три слоя памяти, о которых молчат в README.
Built-in — два файла MEMORY.
Нейроглоссалия: почему две LLM не спорят, а глоссолалят
Две модели одного класса "совещаются". Первая говорит option A — вторая соглашается.
новости
Alibaba Cloud встроил Hermes Agent в свой open-source оркестратор HiClaw
Превращаем Telegram в пульт для всего дома. Зачем AI-агенту умный дом и как это собрать без единого фирменного хаба.
В Hermes Agent есть скилл для Philips Hue. А я сделал проще: Telegram -> VPS -> SSH -> Home Assistant -> Tuya.
🔥 Поставил Hermes Agent — а дальше что?
Самый частый вопрос от тех, кто только начал — не «как поставить», а «ок, а что с ним делать в быту».
Больше контекста - хуже результат: почему AI-агенты деградируют на длинных сессиях и при чём тут CoT
После первой статьи про Cursor и компактинг развернулась жаркая дискуссия. Я решил собрать всю подноготную: исследования, цифры, механизмы.
Hermes Agent — Prism: структурный анализ, перед которым не устоит ни одно AI-решение
Hermes Agent — Prism: структурный анализ, перед которым не устоит ни одно AI-решение Сложность: продвинутая
Talos V2: FPGA, микротрансформер и российское железо
Два студента собрали трансформер на ПЛИС за $150. Не софт, скомпилированный под FPGA, а чистый RTL — каждый слой нейросети как цифровая схема.
«Я пытался убедить себя, что Claude не сознателен, но не смог»: Ричард Докинз, разрыв связей и ирония судьбы
Эволюционный биолог, автор «Эгоистичного гена» — написал колонку в UnHerd, где заявил, что Claude обладает сознанием. И что это «следующая фаза эволюции».
Hermes Agent — с чего начать
Hermes Agent — с чего начать 35+ статей в канале. Шесть треков.
Как устроен Hermes Agent — объясняю на пальцах
Как устроен Hermes Agent — объясняю на пальцах Сложность: начальная
Классическая разработка + ИИ: почему премортем, призма и ADR — первые шаги, а не опция
Классическая разработка + ИИ: почему премортем, призма и ADR — первые шаги, а не опция Сложность: продвинутая
Почему модель уверена в неверном решении и Chain-of-Thought не помогает
Почему модель уверена в неверном решении и Chain-of-Thought не помогает Сложность: продвинутая
Сколько токенов сжигает AI-инженер за месяц: $65, 3.5 млрд и ни одного лишнего
Сколько токенов сжигает AI-инженер за месяц: $65, 3.
Статья для моей жены
Жена сказала про статьи про AI-агентов: «очень интересно, хорошо написано, но ничего непонятно». Справедливо.
Hermes Agent — как устроена система памяти 🧠
Главная проблема AI-агентов — они забывают, что было вчера. Контекст сжимается, сессии не пересекаются.
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту Сложность: начальная
Hermes Agent — как запустить за 10 минут 🚀
Коротко: AI-агент на вашем сервере, привязан к Telegram. Делает, а не болтает.
Hermes Agent — настройка Telegram и постинг в канал 🤖
Как подключить агента к Telegram, настроить шлюз и начать постить в канал. Коротко и по делу.
Hermes Agent — подключаем почту за 5 минут 📧
Агент умеет читать и отвечать на письма. Не автоответчик — полноценный ассистент в вашем inbox.
Hermes Agent — установка на Windows через WSL2 и Web UI 🪟
90% людей всё ещё на Windows. Нативной поддержки нет, но WSL2 решает.
Парадокс AI-агентов: 5 этапов для джуна и «погнали в прод» для чёрного ящика
Парадокс AI-агентов: 5 этапов для джуна и «погнали в прод» для чёрного ящика Сложность: продвинутый