Хабр Курсы для всех
РЕКЛАМА
Большая витрина: от крупнейших школ до частных авторов. Сравнивайте по цене, длительности, формату и выбирайте самый подходящий курс!

Тестировалась только GPT-4o, и только языки C и Java.
Уже немного устарела модель. Чуть-чуть.
Ну.... в сложные времена живем! :-)
Но исследование, мне кажется, от этого не устарело. Понятно, что там, где "гпт чо" спотыкалась, условно, на 1000 строк кода, новая модель легко выдержит. Но вряд ли в новой принципиально что-то поменялось - она так же споткнется, просто не на 1000, а на 25000.
Мне кажется, что вывод исследования: ИИ делают отличные быстрые-первые итерации и начинают дурить, когда проект сложный а доделки тонкие. И это вряд ли поменялось, просто чуть сдвинуто может быть.
Деградация безопасности при итеративной генерации кода с помощью ИИ (краткое изложение исследования)