Самое ценное здесь не список багов, а то, что все они одного класса. Ни один не ловится компилятором и ни один не виден в отчёте о пройденных тестах. Узел есть, кнопка работает, в поток данных он не подключён.
Тот же класс никуда не девается, когда ИИ перестаёт писать с нуля и начинает править существующую систему. Только заметить становится сложнее: нет новой системы, которую можно проверить целиком, есть дифф на двадцать строк, и он выглядит нормально.
Про недоверие к автоотчётам согласен полностью. Вопрос, на который у меня пока нет хорошего ответа: как сформулировать критерий приёмки так, чтобы его можно было проверять не только руками? Сверка сырых данных с эталоном работает, пока эталон есть.
Самое ценное здесь не список багов, а то, что все они одного класса. Ни один не ловится компилятором и ни один не виден в отчёте о пройденных тестах. Узел есть, кнопка работает, в поток данных он не подключён.
Тот же класс никуда не девается, когда ИИ перестаёт писать с нуля и начинает править существующую систему. Только заметить становится сложнее: нет новой системы, которую можно проверить целиком, есть дифф на двадцать строк, и он выглядит нормально.
Про недоверие к автоотчётам согласен полностью. Вопрос, на который у меня пока нет хорошего ответа: как сформулировать критерий приёмки так, чтобы его можно было проверять не только руками? Сверка сырых данных с эталоном работает, пока эталон есть.