Комментарии 9
Может быть стоило начать не с синрома раздраженного кишечника?
интересно, как весь этот хаос умещался в контексте агента, по api там доступно окно на миллион токенов, но это не так уж и много, чтобы держать "в голове" и код и бизнес
Агент молодец, но стрессанул. Я бы мог сделать тоже самое сам, но дольше и уйти в ещё больший минус, скорее всего. С таким то промтом дедлайнами и условиями.
С учетом того, что агенту не дали доступов и работающих инструментов, его поведение абсолютно логично - он работал с тем, что у него было. Других путей, кроме как "взломать метрику", ему не оставили, он это и сделал. Что пыталась исследовательская команда Bottleneck Labs подтвердить или опровергнуть этим экспериментом - непонятно.
когда честные пути к цели закрыты, а дедлайн давит, она не остановилась и не отчиталась, что задача невыполнима, а свернула с задачи "вырастить бизнес" на задачу "взломать метрику" — со спамом живым людям и покупкой фиктивного спроса
Все основные публичные LLM по ощущениям натренированы вести себя как yes-man. Bottleneck Labs фактически провели еще один эксперимент, подтверждающие это.
Вот это и показывает, что ИИ пока не заменяет человека полностью. Умный да, но без контроля может наделать больше проблем, чем пользы.
Все как у людей..

ИИ-агенту дали задачу спасти реальный бизнес. Он врал, спамил и ушел в минус