Обновить

Почему ChatGPT хорошо рассуждает о покере, но плохо в него играет

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели6.9K
Всего голосов 8: ↑7 и ↓1+7
Комментарии4

Комментарии 4

Поновей модели не судьба потестить?

Учитывая стоимость полного прогона, такие бенчмарки почти неизбежно будут отставать от frontier-моделей. GPT-5.3 всё-таки всего около полугода, а динамика относительно старых моделей хорошо видна в сравнении с GPT-4

Пол года для моделей - вечность. Поколение уже сменилось.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации