← Лендинг Hermes Agent

Опубликовано

Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"

Автор: Гусев Николай [портфолио]

Дата обновления не указана в исходнике.

Темы: agent-memory, ai-agents, benchmarks, llm-news

Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"

KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох. А потому что ИИ оказался вруном.

Октябрь 2025. KPMG публикует исследование "Redefining Excellence in the Age of Agentic AI" - 45 кейсов про внедрение AI. Швейцарский банк UBS якобы использует AI-агентов. NHS - для триажа пациентов. TfL - для предсказания пробок.

GPTZero прошлась по сноскам. Результат: из 45 цитат только 5 точные. Остальные 40 - фейк. Половина утверждений - ложь.

UBS: "Фактически неверно". SBB: "Нет, мы так не делаем". NHS: "Вы неправильно интерпретировали пресс-релиз". TfL: "Это вводит в заблуждение".

Deloitte вернул $290K за фейковые цитаты. EY отозвала исследование кибербезопасности с 16 выдуманными ссылками из 27. Три из четырех Big Four - три провала.

Ирония: KPMG проводил собственное исследование доверия к ИИ. 48 340 респондентов. 56% признались в ошибках из-за непроверенных выводов ИИ. 66% используют ИИ без проверки. KPMG знал о рисках - и всё равно выпустил фейковый отчет.

ИИ - не панацея. Это мощный инструмент, который требует контроля. Каждый токен = стоимость вычислений + стоимость инженера, который проверит что ИИ не наврал.

Полная статья: https://telegra.ph/II-v-biznese---ne-panaceya-a-eshche-odin-lzhivyj-sotrudnik-Zaplativ-za-tokeny-gotovtes-platit-inzheneram---i-platit-mnogo---za-t-06-12