Zero-Trust для ИИ: как читать юридические документы, не доверяя нейросети
VLM (Vision Language Model) уверенно распознаёт реквизиты со скана, но с ненулевой вероятностью выдаёт несуществующий ИНН с правильным форматом или сумму, которую никто не сверил с документом — при этом сводка показывает «качество: 100 %» даже на скане 745×1024 @ 96 DPI, с которого реквизиты в принципе нечитаемы. Это не гипотеза, а логи реального проекта по автоматизации юридических документов.
Чтобы исключить галлюцинации, автор внедрил четыре стены проверок: контрольные разряды (проверка ИНН, КПП по алгоритмам ФНС), арифметику и закон (сверка сумм с НДС, логика исполнительного производства), кросс-модальный гейт (сопоставление текста из разных частей документа) и честные статусы (модель не может поставить себе оценку выше определённого порога).
На реальных данных система ловит десятки категорий ошибок — от перепутанных реквизитов до неверного расчёта пеней. Замеры ложных срабатываний показали, что пара десятков строк арифметики заменяет наивное доверие нейросети, а человеку остаётся проверять только те поля, где автоматические проверки не сошлись.