#inference_scaling — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #inference_scaling, aggregated by home.social.
-
[Перевод] Как управлять reasoning effort в LLM
Как современные LLM получают разные настройки reasoning effort: системные промпты, SFT, RLVR, штрафы за длину, reasoning budgets и on-policy-дистилляция. Разбираем DeepSeek V4, Nemotron 3 Ultra, Kimi K2.5 и K3, GLM-5, Qwen3 и Inkling.
https://habr.com/ru/articles/1071250/
#LLM #reasoning_models #reasoning_effort #RLVR #reinforcement_learning #inference_scaling