Комментарии 2
Небольшое дополнение по агентным сценариям. Вы упоминаете, что reasoning может съесть окно, добавлю, что стоит ограничивать не только его, но и количество шагов с инструментами: каждый шаг дописывает в контекст выводы и результаты, и миллион токенов кончается быстрее, чем кажется. На моих задачах 262K с ограниченным reasoning работало стабильнее, чем 1M без ограничений, - модель просто меньше "разгонялась" в длинных рассуждениях и не упиралась в деградацию середины.
Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Увеличение контекста без регистрации и СМС