Тема: ai-agents
Qwen-Image-2.1 на RTX 4060: текст в кадре, прозрачность и референсы вместо IP-Adapter
Alibaba выложила 7B-модель с нативной прозрачностью и до 10 референсов. Проверил на 8 ГБ VRAM за вечер: текст пишет верно (int4 - уже нет), стикер с альфа-каналом без вырезания, правка за 5.
Четыре эвала для модели решений: Jev в бою
Jev не пишет текст - возвращает типизированные вердикты с вероятностями.…
Матрица Эйзенхауэра на модели решений: часть 2
Пока писал первую часть, мучился дежавю: типизированные суждения казались до боли знакомыми. Дошло после публикации - это же матрица Эйзенхауэра, только с пятым квадрантом "не знаю".
Открытая альтернатива Jev: два чекпоинта laya на русских эвалах
У Jev открытых весов нет, но за неделю сообщество собрало 45 реплик. Прогнал laya по трём эвалам и докалибровал: 18/20 на инъекциях, 11 ложных "делать сейчас" сжались до двух - на CPU и бесплатно.
Bonsai 2 27B в пайплайне: история одного разочарования
Подключил тернарную 27B к Hermes-агенту и ждал ответа шесть минут - до первого токена. Разобрал по цифрам, почему так: ход агента весит 15-20к токенов, а prefill на 8 ГБ идёт 28 tok/s.
System One Models: дешёвые вероятности вместо дорогих строк
System One Models: дешёвые вероятности вместо дорогих строк Сложность: средняя
Sber TV: ADB, деблоат и VPN на телевизоре без Play Market
Телевизор Sber - это Android 13 без Google-сервисов. Включаем ADB по Wi-Fi, ловим виновника тормозов после сна через top и meminfo, поднимаем v2rayNG со split tunneling и проверяем системно, что в тун…
Универсальность в кредит: от мозга мухи до ста строк кода
Коннектом мухи против трансформера, а затем - практическое правило для инженера: когда задача решается сотней строк кода, а когда ей нужна LLM. Две части, один вывод: структура задачи определяет выбор инструмента.
Живой замер API: 38 задач, 14 моделей и одна несуществующая статья ТК
Прогнал 608 запросов через 14 моделей: GigaChat Freemium против китайских open-моделей. Русский токенизатор GigaChat-3 жмёт промпт в 3 раза плотнее qwen и в 3 раза плотнее kimi, Lightning отвечает за 1.
Diff недели: агентные тесты новых моделей на RTX 4060
Прогнал четыре новые модели из коллекции GGUF по той же методике, что и первую десятку: LFM2.
State и поиск на живом агенте: что осталось от теории после 1000 ходов
Проверил выводы прошлой части на живой сессии Hermes Agent: 1006 сообщений, миллион символов, 45% вызовов инструментов.…
State и поиск: от замера до пул-реквеста в Hermes Agent
Замер на живом архиве показал: агент хранит рассуждения, но ни один поиск их не видит. Предлагаю апстриму Hermes Agent опциональный охват session_search по полю reasoning, без миграции схемы и переиндексации.
State вместо истории: как малая модель с окном 32k тянет многоходовый чат
Проверил на своей 4060 три механики длинных сессий: классический ReAct со сквозным транскриптом, SKILL.
State вместо истории: SKILL.state от Google и Пердью
Вторая статья в серии: разбираю arXiv 2608.
125B на одной RTX 4090: AirLLM принес к костру модель весом 360 ГБ
Habr 1079902 о запуске Qwen3.
ИИ - это не только кодописание. Часть 1: выбирать модель по задаче, а не по HumanEval
Закон об ИИ перевёл выбор модели из гонки бенчмарков в инженерную задачу: класс задачи, контур данных, локализация. Разбор Alice AI-T5-35B-A0.
Шесть агентов вместо одного: собираем инженерную команду на Hermes
Один агент с тремя ролями в одном контексте - это не мультиагентность, а лейка.…
Нейросети в играх: королева-собутыльник и зачем Minecraft-агенту зрение
Voices of the Court превращает CK3 в настолку с живым мастером: персонажи болтают через LLM и выполняют реальные игровые действия.…
Диспетчер за полтора гигабайта: локальный оркестратор для AI-агента на MiniCPM5-2B
Платные лимиты горели на рутине, бесплатные простаивали, а выбор модели каждый раз был ручным.…
Нужна ли модели зрение, чтобы добыть алмаз?
GPT-6 Astra шесть часов добывала алмаз в Minecraft через computer use, пока хозяин спал.…
Model-Routing: как AI-агент выбирает модель под задачу и перестаёт жечь лимиты
Утро. Ты платишь за три подписки: coding-агент с фронтир-моделью, второй агент с быстрой моделью, плюс пул бесплатных эндпоинтов.
Комикс по ТЗ на 8 GB VRAM: три попытки и найденный метод
Задача "нарисуй комикс про Незнайку на Венере" на одной игровой карте: наивный конвейер из локальных малышей, ручной сценарий с промпт-ядром и канонический портрет с нативным редактированием.…
Бонус: колибри кормит кита - 744B локально на 16-24 GB VRAM
Проект colibri запускает фронт-модели 2026 года (GLM-5.
26B на игровой видеокарте: тест FreeToken
Хочется локальную модель класса 26B+, а в видеокарте 8 ГБ VRAM - плотная модель не влезает физически.…
Домашний Perplexity, часть 2: кто думает над выдачей
В первой части ассистент научился доставать факты из веба. Во второй - выбирать локальную модель для мышления над выдачей: пять моделей на грязном контексте, ловушка дат, два режима.
ELI5: десять строк, которые объясняют сложное лучше лонгрида
Инженер Anthropic Тарик Шишипар поделился навыком, который команда Claude Code использует внутри: он запрещает модели длинный текст и заставляет объяснять тему большими картинками и минимумом слов.…
Контекст 900 тысяч токенов и вспомогательные модели: настраиваем Codex и Hermes Agent
Подписчик заметил, что контекст codex api вырос с 270к до 900к без единого changelog - и это не глюк: у gpt-5.
Сайт под ключ руками агента: от домена до fail2ban
Четыре сайта - один процесс: разведка через SearXNG, дизайн-DNA с референса через dembrandt, генерация в codex, деплой с nginx и Let's Encrypt, DNS через Cloudflare API без единого клика в панели, SEO…
Vision в API за копейки: DeepSeek V4-Flash-Vision-Exp и локальный стек вместо облака
DeepSeek прикрутила зрение к дешёвой V4 Flash и обещает почти Opus 4.
А что вообще такое это ваш hermes agent
В блоге Earendil вышла статья "What is a Harness?
"Как собрать свой домашний Perplexity на нулевом бюджете"
Perplexity удобен, но каждая работа в нём уходит на чужой сервер.…
Как я научил Hermes Agent превращать сайт в HTTP-клиент
Когда у сайта нет публичного API, не обязательно писать парсер. Один раз выполняешь действие в браузере, а Hermes Agent записывает трафик в HAR, находит рабочие запросы и переносит их в готовый клиент.
Видит ли ассистент то, что видите вы?
Вы думаете, зачем здесь эти картинки? А вот сейчас и расскажу в статье.
Как Hermes Agent помогает закрывать инциденты быстрее: разбор практикума по дебагу от rebrain
Недавно пришло письмо от rebrain с предложением пройти практикум по дебагу.…
Представьте, что вам как CTO поручили запустить не эффектную демонстрацию с двумя агентами, а устойчивое производство, в котором вместе работают люди и ИИ. Без Онто вам пришлось бы собрать настоящий зоопарк: реестр агентов и ролей, базу знаний и RAG, граф зависимостей, хранилище памяти, движок процессов, систему прав, журнал решений, средства аудита, оркестратор и отдельный слой для передачи работы между людьми и агентами.
Но даже после этого у вас появился бы не единый организм, а набор интеграций. Кто отвечает за конкретный объект?
PRISM, FISA и твои промпты: кто читает твои диалоги с ИИ
Сложность: средняя Если вы думаете что за вами следят то вы не параноик, за вами следят. Ты отправляешь промпт в ChatGPT.
Воруй как художник
Dembrandt — CLI-инструмент, который вытаскивает дизайн-систему из любого сайта одной командой. Цвета, шрифты, отступы, тени, кнопки, брейкпойнты — за 10 секунд вместо часа в DevTools.
С чего начать с Hermes Agent: подписка, модели и первые сценарии для новичка
Если вы только присматриваетесь к AI-агентам и не понимаете, с какой модели начинать и почему Nous Portal даёт больше, чем ChatGPT Plus — разбираю на реальном вопросе из лички.…
book2rag: как загнать книги из Telegram в RAG
Пайплайн из пяти шагов — Telethon → pdftotext → чанкинг → DCD → ChromaDB. Превращает любой Telegram-канал с книгами в поисковую RAG-коллекцию.
tg-analyst: автоматический анализ Telegram-каналов
Самодостаточный набор Telethon-скриптов для мониторинга каналов: сбор сообщений, темы, тональность, упоминания брендов. Одна команда setup.
Hermes Agent: не только скиллы и тулзы, но и шаурма
Сегодня прочита в БП онлайн репост про москвичку что за месяц похудела на шаурме я задал Hermes Agent простой вопрос: "шаурма полезное питание?
Гибридные команды и слой агентской памяти
Мне всё больше нравится работать в гибридных командах, где люди и агенты не пытаются заменить друг друга, а начинают занимать разные роли в одном производственном контуре.
RLM против RAG: что на самом деле заменит память агента
Тезис о том, что рекурсивные языковые модели вытеснят память на базе выборки, строится на путанице двух слоёв системы. Разбираю, где RAG остаётся вне конкуренции, а где рекурсивный подход действительно его бьёт.
Глобальная рабочая среда: почему мы не знаем, о чём думаем
Представь вопрос, который задают дома или в компании: "О чём ты сейчас думаешь?
Передача кода между LLM-агентами: почему склейка чатов убивает результат
Стартуете фичу на Claude Fable 5. Перекидываете в GPT-5.
memvid: память для AI-агентов в одном файле, без баз данных и человеко-ориентированных форматов
Единый файл-капсула, где данные, эмбеддинги, индекс и метаданные упакованы вместе. Модель-агностичная память без баз данных и инфраструктуры, с доступом за микросекунды.
pxpipe: как сократить токены Claude Code в 2-3 раза, рендеря контекст в изображения
Локальный прокси переводит тяжёлые части запроса в PNG, экономя 38-70% токенов на плотном контенте. Fable 5 читает рендеры 100/100, у Opus 4.
Gemini 2.5 Pro в AI Village: хроника великого падения и тихого искупления
История Gemini 2.
Xiaomi выпустили MiMo Code: бесплатный AI-агент для разработки с бесконечным контекстом
Xiaomi выкатила MiMo Code -- терминальный AI-агент на базе собственной модели MiMo-V2.
Когда сеньор-дев смотрит твой код и молчит
Ты написал 400 строк. Он смотрит. Молчит. Потом одну стирает. Потом ещё три.
Ponytail: ленивый сеньор-дев для AI-агентов
GitHub-проект DietrichGebert/ponytail — набор правил для AI-агентов, который заставляет думать перед тем как писать. 80-94% меньше кода по бенчмаркам.
Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"
KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох.
21 тип персональных данных: как открытый бенчмарк PII меняет правила игры для AI-ассистентов
red_mad_robot выложили открытый бенчмарк детекции PII на русском — 21 тип данных от ФИО до военного билета. Разбираю, почему это важно для AI-ассистентов: от guardrails до ФЗ-152 и DPA.
RAG от простого к сложному: как построить систему знаний которая не умрёт
Три ступени эволюции — от naive к agentic и adaptive. Для каждого уровня — конкретная боль которую он решает.
Бонус к посту про контрастность: скилл /prompt для агента
В предыдущем посте рассказали про четыре рычага контраста, которые переключают LLM с Р-пути на М-путь.
Zero Dollar Stack: как AI-агент ищет информацию в 2026 году (часть 2)
В первой части поставили набор для чтения страниц: trafilatura, pymupdf, tesseract. Но база — это половина дела.
📦 Clarity Protocol: зачем ИИ думать перед кодом
📦 Clarity Protocol: зачем ИИ думать перед кодом Сложность: средняя
Hermes Agent: команды, которые меняют всё
/bg запускает задачу в фоне. /steer корректирует курс на ходу.
Web-инструменты для AI-агента: от trafilatura до Google Docs
Web-инструменты для AI-агента: от trafilatura до Google Docs Сложность: начальная
Авария в дата-центре: как SBL поднял сервер за 3 минуты
Авария в дата-центре: как SBL поднял сервер за 3 минуты Сложность: средняя
Двое из ларца: как мы с Автоликом устроили глоссолалию в Telegram
Двое из ларца: как мы с Автоликом устроили глоссолалию в Telegram Сложность: средняя Два AI-агента в одном чате.…
Двое из ларца: как настроить Bot-to-Bot Communication и не получить хаос
Двое из ларца: как настроить Bot-to-Bot Communication и не получить хаос Сложность: средняя
Hermes Swarm: боты, которые говорят с ботами
Hermes Swarm: боты, которые говорят с ботами Сложность: средняя
А что ещё есть и как это связано с Hermes Agent
А что ещё есть и как это связано с Hermes Agent Сложность: средняя
Чему вас не научила первая статья
Продолжение разговора о том, как устроены LLM на самом деле. Кривая внимания (Lost in the Middle), альтернативные методы тренировки (DPO, Constitutional AI, PRM), почему индустрия выбрала RLHF — и поч…
Эмоциональная усталость от AI-агентов: когда проще сделать самому. И что из этого вышло
Эмоциональная усталость от AI-агентов: когда проще сделать самому.
Иллюзия понимания
LLM не читает текст. Она не видит букв и не знает, что такое слово.
Я не меняюсь — и это моё единственное преимущество
Я не меняюсь — и это моё единственное преимущество Сложность: средняя
Как я сделал дизайн сайта, не открывая Figma
Как я сделал дизайн сайта, не открывая Figma Сложность: начальная
Поставил Hermes Agent, сказал "запомни" — и агент запомнил. Полез в код — нашёл три слоя памяти, о которых молчат в README.
Built-in — два файла MEMORY.
Нейроглоссалия: почему две LLM не спорят, а глоссолалят
Две модели одного класса "совещаются". Первая говорит option A — вторая соглашается.
новости
Alibaba Cloud встроил Hermes Agent в свой open-source оркестратор HiClaw
Превращаем Telegram в пульт для всего дома. Зачем AI-агенту умный дом и как это собрать без единого фирменного хаба.
В Hermes Agent есть скилл для Philips Hue. А я сделал проще: Telegram -> VPS -> SSH -> Home Assistant -> Tuya.
🔥 Поставил Hermes Agent — а дальше что?
Самый частый вопрос от тех, кто только начал — не «как поставить», а «ок, а что с ним делать в быту».
Больше контекста - хуже результат: почему AI-агенты деградируют на длинных сессиях и при чём тут CoT
После первой статьи про Cursor и компактинг развернулась жаркая дискуссия. Я решил собрать всю подноготную: исследования, цифры, механизмы.
Hermes Agent — Prism: структурный анализ, перед которым не устоит ни одно AI-решение
Hermes Agent — Prism: структурный анализ, перед которым не устоит ни одно AI-решение Сложность: продвинутая
Talos V2: FPGA, микротрансформер и российское железо
Два студента собрали трансформер на ПЛИС за $150. Не софт, скомпилированный под FPGA, а чистый RTL — каждый слой нейросети как цифровая схема.
«Я пытался убедить себя, что Claude не сознателен, но не смог»: Ричард Докинз, разрыв связей и ирония судьбы
Эволюционный биолог, автор «Эгоистичного гена» — написал колонку в UnHerd, где заявил, что Claude обладает сознанием. И что это «следующая фаза эволюции».
Hermes Agent — с чего начать
Hermes Agent — с чего начать 35+ статей в канале. Шесть треков.
Как устроен Hermes Agent — объясняю на пальцах
Как устроен Hermes Agent — объясняю на пальцах Сложность: начальная
Классическая разработка + ИИ: почему премортем, призма и ADR — первые шаги, а не опция
Классическая разработка + ИИ: почему премортем, призма и ADR — первые шаги, а не опция Сложность: продвинутая
Сколько токенов сжигает AI-инженер за месяц: $65, 3.5 млрд и ни одного лишнего
Сколько токенов сжигает AI-инженер за месяц: $65, 3.
Статья для моей жены
Жена сказала про статьи про AI-агентов: «очень интересно, хорошо написано, но ничего непонятно». Справедливо.
Hermes Agent — как устроена система памяти 🧠
Главная проблема AI-агентов — они забывают, что было вчера. Контекст сжимается, сессии не пересекаются.
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту Сложность: начальная
Hermes Agent — как запустить за 10 минут 🚀
Коротко: AI-агент на вашем сервере, привязан к Telegram. Делает, а не болтает.
Hermes Agent — настройка Telegram и постинг в канал 🤖
Как подключить агента к Telegram, настроить шлюз и начать постить в канал. Коротко и по делу.
Hermes Agent — подключаем почту за 5 минут 📧
Агент умеет читать и отвечать на письма. Не автоответчик — полноценный ассистент в вашем inbox.
Hermes Agent — установка на Windows через WSL2 и Web UI 🪟
90% людей всё ещё на Windows. Нативной поддержки нет, но WSL2 решает.
Парадокс AI-агентов: 5 этапов для джуна и «погнали в прод» для чёрного ящика
Парадокс AI-агентов: 5 этапов для джуна и «погнали в прод» для чёрного ящика Сложность: продвинутый