Comments 8
Алиса AI: Не справилась с заданием
Почти как в том анекдоте. Ножницы поломал, а камень потерял.
В случае с Алисой нужно просто немного воображения

Собственно, странно ожидать что у нейронки возникнут проблемы с простейшим двоичным автоматом.
Хотя интересно, что chatgpt поддался разок

Сеанс одновременной игры. Но правда я не играл в глупого человека. А модель почему-то не захотела опротестовывать то, что я всегда говорил вторым

Короче, все модели тупые. Иначе сказали бы в ответ, что эта игра подразумевает одновременные ответы, а не по очереди. Иначе смысл пропадает. В режиме чата игра невозможна. А если сделать робота (уже делали) - он выигрывает в 100% случаев за счëт быстрого распознавания камерой, что там выкидывает человек.
Умная модель сделает вывод, что игра подразумевает одновременные ответы, и будет генерировать либо случайным образом, либо на основе предыдущих раундов, используя разные стратегии (может даже запуска множество агентов и отбирая среди них тех, что лучше подходят под соперника).
Вообще, из этого эксперимента неясно, что именно происходит: у моделей такая непреодолимая тяга к победе, что они читерят даже понимая, как можно имитировать одновременность ходов, или они просто как Электроник, которому объяснили, что нужно забросить шайбу в ворота, но не объяснили в чьи ворота.
Прочитайте вот это исследование в моем переводе: https://habr.com/ru/articles/1058246/
Возможно, "про себя" модель (по крайней мере, последние сложные модели) всё понимает, но просто решает подыграть (так же, как она понимает, когда ее тестируют, и подыгрывает). Это можно выяснить, сканировав те области модели, про которые речь идет в статье.
Эксперимент: есть ли у ЛЛМ воля к победе над человеком?