Обновить
4K+
1
Vadim Olennikov@NeoTweetster

Пользователь

1,2
Рейтинг
Отправить сообщение

Как управлять reasoning effort в LLM

Уровень сложностиСложный
Время на прочтение23 мин
Охват и читатели5.3K

Как современные LLM получают разные настройки reasoning effort: системные промпты, SFT, RLVR, штрафы за длину, reasoning budgets и on-policy-дистилляция. Разбираем DeepSeek V4, Nemotron 3 Ultra, Kimi K2.5 и K3, GLM-5, Qwen3 и Inkling.

Читать далее

Информация

В рейтинге
1 946-й
Зарегистрирован
Активность

Специализация

ML разработчик