Тема: llm-api
Открытая альтернатива Jev: два чекпоинта laya на русских эвалах
У Jev открытых весов нет, но за неделю сообщество собрало 45 реплик. Прогнал laya по трём эвалам и докалибровал: 18/20 на инъекциях, 11 ложных "делать сейчас" сжались до двух - на CPU и бесплатно.
Bonsai 2 27B в пайплайне: история одного разочарования
Подключил тернарную 27B к Hermes-агенту и ждал ответа шесть минут - до первого токена. Разобрал по цифрам, почему так: ход агента весит 15-20к токенов, а prefill на 8 ГБ идёт 28 tok/s.
Живой замер API: 38 задач, 14 моделей и одна несуществующая статья ТК
Прогнал 608 запросов через 14 моделей: GigaChat Freemium против китайских open-моделей. Русский токенизатор GigaChat-3 жмёт промпт в 3 раза плотнее qwen и в 3 раза плотнее kimi, Lightning отвечает за 1.
На opencode раздают GLM-5.5? Аноним за $0.20/$0.66 за 1M токенов
Ты думаешь, что анонимная стелс-модель - это маркетинг. А на самом деле это способ вендора обкатать чекпоинт на живых агентских задачах до того, как он получит имя.
125B на одной RTX 4090: AirLLM принес к костру модель весом 360 ГБ
Habr 1079902 о запуске Qwen3.
Диспетчер за полтора гигабайта: локальный оркестратор для AI-агента на MiniCPM5-2B
Платные лимиты горели на рутине, бесплатные простаивали, а выбор модели каждый раз был ручным.…
Нужна ли модели зрение, чтобы добыть алмаз?
GPT-6 Astra шесть часов добывала алмаз в Minecraft через computer use, пока хозяин спал.…
Model-Routing: как AI-агент выбирает модель под задачу и перестаёт жечь лимиты
Утро. Ты платишь за три подписки: coding-агент с фронтир-моделью, второй агент с быстрой моделью, плюс пул бесплатных эндпоинтов.
Бонус: колибри кормит кита - 744B локально на 16-24 GB VRAM
Проект colibri запускает фронт-модели 2026 года (GLM-5.
26B на игровой видеокарте: тест FreeToken
Хочется локальную модель класса 26B+, а в видеокарте 8 ГБ VRAM - плотная модель не влезает физически.…
Контекст 900 тысяч токенов и вспомогательные модели: настраиваем Codex и Hermes Agent
Подписчик заметил, что контекст codex api вырос с 270к до 900к без единого changelog - и это не глюк: у gpt-5.
Сайт под ключ руками агента: от домена до fail2ban
Четыре сайта - один процесс: разведка через SearXNG, дизайн-DNA с референса через dembrandt, генерация в codex, деплой с nginx и Let's Encrypt, DNS через Cloudflare API без единого клика в панели, SEO…
Vision в API за копейки: DeepSeek V4-Flash-Vision-Exp и локальный стек вместо облака
DeepSeek прикрутила зрение к дешёвой V4 Flash и обещает почти Opus 4.
"Как собрать свой домашний Perplexity на нулевом бюджете"
Perplexity удобен, но каждая работа в нём уходит на чужой сервер.…
Как я научил Hermes Agent превращать сайт в HTTP-клиент
Когда у сайта нет публичного API, не обязательно писать парсер. Один раз выполняешь действие в браузере, а Hermes Agent записывает трафик в HAR, находит рабочие запросы и переносит их в готовый клиент.
Что такое "профессионально уметь пользоваться LLM"?
Что спрашивать программистов на собеседованиях, если алгоритмы спрашивать теперь бессмысленно (код пишет LLM)? Короткий список на подумать.
С чего начать с Hermes Agent: подписка, модели и первые сценарии для новичка
Если вы только присматриваетесь к AI-агентам и не понимаете, с какой модели начинать и почему Nous Portal даёт больше, чем ChatGPT Plus — разбираю на реальном вопросе из лички.…
Передача кода между LLM-агентами: почему склейка чатов убивает результат
Стартуете фичу на Claude Fable 5. Перекидываете в GPT-5.
ИИ в бизнесе - не панацея, а еще один лживый сотрудник. Заплатив за токены, готовьтесь платить инженерам - и платить много - за то, чтобы он не врал
KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох…
RAG от простого к сложному: как построить систему знаний которая не умрёт
Три ступени эволюции — от naive к agentic и adaptive. Для каждого уровня — конкретная боль которую он решает.
Zero Dollar Stack: как AI-агент ищет информацию в 2026 году (часть 2)
В первой части поставили набор для чтения страниц: trafilatura, pymupdf, tesseract. Но база — это половина дела.
Чудесную историю сегодня принесла лента Твиттера. Вольный (и местами даже волнительный, сорри за мат) пересказ от редакции канала «Лобушкин»: Microsoft запретил своим же инженерам пользоваться ИИ. Тем самым ИИ, который должен был заменить инженеров, повысить эффективность, сократить косты и вообще привести нас в сияющее технофеодальное будущее.
Проблема оказалась в одной маленькой детали: этот ИИ, сука, оказался ДОРОЖЕ людей.
Эмоциональная усталость от AI-агентов: когда проще сделать самому. И что из этого вышло
Эмоциональная усталость от AI-агентов: когда проще сделать самому.
Иллюзия понимания
LLM не читает текст. Она не видит букв и не знает, что такое слово.
новости
Alibaba Cloud встроил Hermes Agent в свой open-source оркестратор HiClaw
Talos V2: FPGA, микротрансформер и российское железо
Два студента собрали трансформер на ПЛИС за $150. Не софт, скомпилированный под FPGA, а чистый RTL — каждый слой нейросети как цифровая схема.
Сколько токенов сжигает AI-инженер за месяц: $65, 3.5 млрд и ни одного лишнего
Сколько токенов сжигает AI-инженер за месяц: $65, 3.
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту
Hermes Agent: как я перестал читать PDF и начал кидать ссылки агенту Сложность: начальная
Hermes Agent — как запустить за 10 минут 🚀
Коротко: AI-агент на вашем сервере, привязан к Telegram. Делает, а не болтает.
Hermes Agent — настройка Telegram и постинг в канал 🤖
Как подключить агента к Telegram, настроить шлюз и начать постить в канал. Коротко и по делу.
Hermes Agent — установка на Windows через WSL2 и Web UI 🪟
90% людей всё ещё на Windows. Нативной поддержки нет, но WSL2 решает.