Обновить

Кто нашёл больше багов — агент или человек? Мои замеры 11 недель работы с AI-тестировщиком

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели6.6K
Всего голосов 1: ↑1 и ↓0+1
Комментарии4

Комментарии 4

Есть дока, требования, есть тесткейсы и соответ баги. Человек уже не способен прогнать ручной тест по плану или написать автомейшин? В чем тут сравнение? Произвольный сайт без документации и требований?

Сайт не произвольный, обычные рабочие задачи с ТЗ и макетами. Тест-кейсы тоже есть, агент их сам пишет по ТЗ и по ним же прогоняет.

Способен ли человек - такой вопрос не стоял, я и руками прогоняю, и автотесты пишу, в статье мои собственные часы и есть. Мерил я другое: сколько часов и находок вышло у каждого за одни и те же 11 недель. Человек при этом остался нужен - все 6 пропусков агента нашел я.

Из 77 багов были криты/блокеры или хотя бы мажоры?

Или все найденные баги попадают в глубокий бэклог, где о них потом забывают навсегда.

Спрашиваю в контексте того, что клод действительно много чего подсвечивает, но большая часть даже не оформляется в задачи.

Блокеров не было, с высоким приоритетом один - фильтр не находил ни одного подходящего объекта. Остальное мажоры и миноры: вёрстка, расхождения с макетом, пара функциональных.

В бэклог не уезжают: находки приходят во время тестирования задачи, до релиза, и чинятся там же. Разреза по severity в цифрах статьи нет, системно не записывал.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации