ПАВЕЛ КАЦКОВНаписать в Telegram ↗

Почему зелёные тесты не гарантируют качество AI-кода

Автор: ·
На основе личного опыта и интервью автора.

Тесты, повторяющие реализацию, могут пропустить ошибку в самой задаче. Павел Кацков предлагает проверять AI-generated продукт по требованиям и реальным пользовательским сценариям.

Проверять продукт, а не отражение кода.

Если агент написал код, а потом тесты, которые лишь повторяют устройство этого кода, зелёный отчёт может создать ложное чувство уверенности.

Для проверки результата нужен внешний ориентир — требования и пользовательские сценарии. Поэтому я использую E2E-проверки, скриншоты, отчёты «до и после» и человеческую приёмку.

Важно увидеть, что изменилось в системе и решена ли исходная задача пользователя.

Что проверять помимо unit-тестов

В моей практике для браузерных проверок используется Playwright. Ни один вид тестов не снимает необходимость осмысленной приёмки.

Обсудим вашу задачу?

Напишите, что строите, где застряли и какого результата хотите.

Telegram @m_katskov_tech ↗admin@katskov.tech