IT Тверь
IT Тверь
@it_tver

LLM теперь можно настраивать по уровню "думать дольше или отвечать быстрее" 🤖

LLM теперь можно настраивать по уровню "думать дольше или отвечать быстрее" 🤖

Разобрали, как современные модели получают разные режимы reasoning effort: через системные промпты, SFT, RLVR, штрафы за длину, budgets и on-policy-дистилляцию. В списке — DeepSeek V4, Nemotron 3 Ultra, Kimi K2.5 и K3, GLM-5, Qwen3 и Inkling.

Это полезно всем, кто работает с LLM: проще выбирать модель под задачу и не переплачивать за лишние токены, если нужен быстрый ответ.

IT Тверь — t.me/it_tver
Источники:
Этот пост опубликован в Telegram-канале IT Тверь. Подписаться можно по ссылке: @it_tver.
tech

Свежие посты в категории «Tech Infrastructure»

Все каналы категории →

start

Готовы запустить рекламу через сеть public.tg?

Новый оффер, продукт, GEO, кейс, событие или партнёрский запуск — соберём маршрут под задачу и отдадим медиаплан.

Telegram для медиаплана: @AFFtop_connect. Быстрый тест: $20 за канал, $1000 за пакет по сети.