Comments 2
Небольшое дополнение по агентным сценариям. Вы упоминаете, что reasoning может съесть окно, добавлю, что стоит ограничивать не только его, но и количество шагов с инструментами: каждый шаг дописывает в контекст выводы и результаты, и миллион токенов кончается быстрее, чем кажется. На моих задачах 262K с ограниченным reasoning работало стабильнее, чем 1M без ограничений, - модель просто меньше "разгонялась" в длинных рассуждениях и не упиралась в деградацию середины.
Sign up to leave a comment.
Увеличение контекста без регистрации и СМС