Обновить

Комментарии 2

Небольшое дополнение по агентным сценариям. Вы упоминаете, что reasoning может съесть окно, добавлю, что стоит ограничивать не только его, но и количество шагов с инструментами: каждый шаг дописывает в контекст выводы и результаты, и миллион токенов кончается быстрее, чем кажется. На моих задачах 262K с ограниченным reasoning работало стабильнее, чем 1M без ограничений, - модель просто меньше "разгонялась" в длинных рассуждениях и не упиралась в деградацию середины.

Спасибо за уточнение, вы абсолютно правы. Если агент долго крутит цикл вызов инструмента / большой результат / ещё рассуждение / ещё вызов, он и быстрее упирается в лимит, и быстрее проваливается в "середину", где модель хуже удерживает контекст.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации