Волна ИИПодписаться
← Назад
Инструменты

40 раундов ревью на уже отревьюенный код: Claude и GPT нашли 6 критических багов и 25 серьёзных

17.09.2026 · habr.com ↗

Код проекта skillmem прошёл стандартное ревью и был признан чистым. Затем автор запустил по нему два независимых ИИ-ревьюера — Claude и GPT — с жёсткой инструкцией: воспроизводить каждую находку командой и проверять код враждебно, раунд за раундом.

За 40 раундов модели нашли шесть дефектов уровня P1 (критические) и около двадцати пяти P2 (серьёзные) в коде, который «уже был отревьюен». Главный вывод: каждый второй фикс порождал регрессию, которую удавалось поймать только на следующем цикле проверки. Эксперимент показал, что даже многослойное ИИ-ревью не гарантирует чистоты — но без него эти баги, скорее всего, ушли бы в продакшен.

Источник: habr.com
← Все новости AI Wave