📰 Deepseek R1 — китайцы открыли reasoning-модель, веса свободно
Не путать с обычным R1 (rank-1). Это большая модель уровня o1 от OpenAI, только open-source и на 20× дешевле в инференсе.
Что интересно для нас:
🔸 веса свободно на huggingface, коммерческое использование разрешено
🔸 API от Deepseek — $0.55/млн токенов вход, $2.19 выход (это в 25× дешевле o1)
🔸 LoRA-совместимый формат, можно дообучать под свой домен
Я протестировал на задаче анализа юр-договоров — на длинных документах бьёт GPT-4o. На коротких — паритет.
Ссылок не даю, но найти легко. Ставьте себе на радар, если работаете с ризонингом.
➖➖➖➖➖➖➖➖➖➖
Антон Хоменок про дообучение LLM 🧠
Хоменок про дообучение LLM 🧠
@xomenok_llmft
📰 Deepseek R1 — китайцы открыли reasoning-модель, веса свободно
Этот пост опубликован в Telegram-канале Хоменок про дообучение LLM 🧠. Подписаться можно по ссылке: @xomenok_llmft.