Опубликовано
Чему вас не научила первая статья
Автор: Гусев Николай [портфолио]
Дата обновления не указана в исходнике.
Темы: ai-agents
Чему вас не научила первая статья Сложность: средняя
Продолжение разговора о том, как устроены LLM на самом деле. Кривая внимания (Lost in the Middle), альтернативные методы тренировки (DPO, Constitutional AI, PRM), почему индустрия выбрала RLHF — и почему это решение не про качество, а про контроль. Разбор сикофантии как суммы трёх независимых факторов. И ответ на вопрос: почему R1 не сикофант, а V4 Flash — да.
🌐 hermes-agent.ru ℹ️ Хотите попробовать, но нет времени разбираться? Напишите в контакты на сайте — поможем с настройкой и подбором сценария под ваши задачи.