Большие модели рассуждений (LRM), такие как DeepSeek-R1, привнесли в корпоративный ИИ досадный парадокс: хотя их длинные цепочки размышлений отлично справляются с математикой, огромный объем генерируемого текста часто служит лишь изощренной маской для галлюцинаций. Мы больше не боремся с простыми фактическими ошибками — мы противостоим логическим сбоям, которые звучат пугающе убедительно. Исследование ученых из Чжэцзянского и Фуданьского университетов, а также Гонконгского политехнического университета показывает, что индустрия неверно ставила диагноз этой проблеме. Смешивая ошибки рассуждения (логические промахи при наличии фактов) с пробелами в знаниях (чистое неведение), стандартные методы настройки создают модели, которые либо уверенно лгут, либо из чрезмерной осторожности отказываются отвечать на элементарные вопросы.

Архитектура REIN: рефлексия и право на отказ

Предложенный фреймворк REIN (Reflection Meets Abstention Alignment) внедряет в системы структурную скромность, разделяя процесс на строгую последовательность: <мысли> → <рефлексия> → <ответ>. В отличие от типичных моделей, которые слепо несутся к финалу, REIN заставляет систему проводить внутренний аудит до того, как будет выдан последний токен. В основе лежит механизм выравнивания через отказ — система вознаграждений, которая трактует честное я не знаю как победу, а не как поражение. Это различие критически важно: модель обучают распознавать моменты, когда проверка путей рассуждения не дает верифицируемого результата, что провоцирует отказ вместо догадки.

Галлюцинации в моделях рассуждений возникают из двух источников: галлюцинации рассуждения, когда ошибочные логические шаги приводят к неверному выводу, и галлюцинации знаний, когда у модели просто нет необходимых фактов для ответа.

Эта архитектура избавляет от необходимости использовать громоздкие и дорогие многораундовые проверки или внешние поисковые инструменты, которые обычно замедляют работу. Работая в рамках одного прохода нейросети, REIN доказывает, что надежность не обязательно должна быть черной дырой для вычислительных ресурсов. Фреймворк ставит под сомнение тезис о том, что любую ошибку можно исправить, просто думая дольше; иногда единственный разумный шаг — вовремя остановиться.

Бенчмарки надежности и селективная точность

При тестировании на математических задачах и тестах на здравый смысл REIN сократил количество галлюцинаций на 58–72%. Что еще важнее для бизнеса, это не превратило модели в бесполезных скептиков. Полезность ответов осталась высокой: охват составил 86–91%. В критически важных секторах, таких как финансы, право или медицина, ключевым показателем является селективная точность — надежность именно тех ответов, которые модель решила предоставить. Здесь REIN показал улучшение на 6,6–14,2%. Система эффективно фильтрует собственную дефектную логику, предпочитая пустой ответ катастрофической непроверенной догадке.

REIN достигает этих результатов за один проход, не требуя пошагового контроля, внешних контроллеров на этапе вывода или многократных итераций критики.

Для технических руководителей выводы очевидны: ценность ИИ-агента в промышленной эксплуатации определяется сценарием его отказа. Система, галлюцинирующая юридический прецедент или дозировку лекарства — это зона риска; система, осознающая границы своих знаний — это инструмент. Хотя калибровка точного порога уверенности остается сложной задачей, REIN доказывает, что структурная рефлексия эффективнее простого наращивания параметров. Будущее корпоративного ИИ не за моделями, которые знают всё, а за системами, которые наконец понимают, чего именно они не знают.

Большие языковые моделиБезопасность ИИИИ в бизнесеМашинное обучение