Волна ИИПодписаться
← Назад
Инструменты

Claude Code против человека: кто находит больше багов — эксперимент за 11 недель

22.09.2026 · habr.com ↗

Разработчик провёл 11-недельный эксперимент, ежедневно фиксируя каждую сессию с Claude Code: сколько часов работал агент, сколько — человек, и какова судьба каждого кандидата в дефекты. Всего набралось 277 агентских часов против 213 человеческих.

Итог: 94 подтверждённые находки, из которых 77 обнаружил Claude Code и лишь 16 — человек. Однако первый подсчёт находок оказался завышен почти вдвое — после верификации остались только реальные баги.

Автор также подсчитал стоимость часа работы агента, выяснил, в каких сценариях агент не окупился, и какие дефекты он пропустил. Эксперимент даёт практическую картину: ИИ-тестировщик эффективен по количеству, но требует учёта затрат и ограничений.

Источник: habr.com
← Все новости AI Wave