Опубликовано
Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"
Автор: Гусев Николай [портфолио]
Дата обновления не указана в исходнике.
Темы: agent-memory, ai-agents, benchmarks, llm-news
Вот одна из причин почему я так заморачиваюсь с призм анализом, точными rag, гвардрейлами, clarity protocol, изучаю бенчмарки pii и прочие скучные вещи, а не пишу "клод сделай мне CRM чОткую"
KPMG отозвал отчет об ИИ. Не потому что ИИ оказался плох. А потому что ИИ оказался вруном.
Октябрь 2025. KPMG публикует исследование "Redefining Excellence in the Age of Agentic AI" - 45 кейсов про внедрение AI. Швейцарский банк UBS якобы использует AI-агентов. NHS - для триажа пациентов. TfL - для предсказания пробок.
GPTZero прошлась по сноскам. Результат: из 45 цитат только 5 точные. Остальные 40 - фейк. Половина утверждений - ложь.
UBS: "Фактически неверно". SBB: "Нет, мы так не делаем". NHS: "Вы неправильно интерпретировали пресс-релиз". TfL: "Это вводит в заблуждение".
Deloitte вернул $290K за фейковые цитаты. EY отозвала исследование кибербезопасности с 16 выдуманными ссылками из 27. Три из четырех Big Four - три провала.
Ирония: KPMG проводил собственное исследование доверия к ИИ. 48 340 респондентов. 56% признались в ошибках из-за непроверенных выводов ИИ. 66% используют ИИ без проверки. KPMG знал о рисках - и всё равно выпустил фейковый отчет.
ИИ - не панацея. Это мощный инструмент, который требует контроля. Каждый токен = стоимость вычислений + стоимость инженера, который проверит что ИИ не наврал.