сеть public.tg Это один из 7160 каналов редакционной сети public.tg про CPA, арбитраж, iGaming, Nutra и AI-инструменты. Купить рекламу в этом канале · все каналы сети
Хоменок про дообучение LLM 🧠

Хоменок про дообучение LLM 🧠

LoRA, QLoRA, DPO, RLHF-lite. Как учу локальные модели под конкретные задачи и во сколько это встаёт по железу. Fine-tune моделей руками. Инсайдерский взгляд без корпоративного глянца — где реально работает, где обещают золото, а по факту сливают. Мои кейс

4 подписчиков
0 средние просмотры
0 постов / 30д
0% engagement rate
📂 Авторские блоги и инсайды арбитража
latest posts

Последние публикации

Последние 30 публикаций канала. Каждый пост открывается отдельной веб-страницей со ссылкой на оригинал в Telegram.

💡 Датасеты для fine-tuning: синтетика против реальных данных Раньше я убивал недели на разметку данных руками. Сейчас уверен: качественная синтетика через сильные модели типа DeepSeek R1 или модели OpenAI часто работает …
@xomenok_llmft
⚙️ Архитектура обучения: когда стоит уходить с QLoRA на full fine-tune Все привыкли к QLoRA, потому что это дешево и сердито. Но когда задача становится специфичной — например, узкоспециализированный сленг или сложная ло…
@xomenok_llmft
📊 Оцениваем качество модели после fine-tune: почему loss обманчив Частая ошибка новичков — смотреть только на график падения loss при обучении. Блин, это ловушка: модель может просто зазубрить датасет, а на реальных пром…
@xomenok_llmft
💼 Итоги года по fine-tuning — где я слил деньги, где заработал Год я закрываю с 14 прогонами в проде, 6 в мусоре. Расклад: Заработано: 🔴 4 корпоративных клиента, средний чек $12к = $48к 🔴 подписка на моего юр-бота: 23 кл…
@xomenok_llmft
📰 Cohere Command R+ — обновление для RAG и tool use Cohere остаётся в тени OpenAI/Anthropic, но у них добротная модель специально под RAG и агентов. Свежая версия: 🔸 контекст 128к, стабильно работает на длинных документа…
@xomenok_llmft
🎙 В эту среду в подкасте — Лена, ведущий MLE из фонтеха Разберём то, о чём в её компании говорят на всех кухнях: 🔸 почему они выкинули fine-tuning и вернулись к prompt engineering 🔸 сколько денег ушло в мусор на первых п…
@xomenok_llmft
📚 Reward model для DPO — что это и зачем Разбор для тех, кто дошёл до пред-продакшена. DPO нужны пары «хороший ответ / плохой ответ». Где брать? Три пути: 🔸 руками. Дорого, медленно, но эталон качества. 🔸 через реворд-мо…
@xomenok_llmft
🎁 Unsloth — библиотека, которая ускорила мой прогон в 2 раза Ребят, это находка. Ставится в 2 команды через pip, поддерживает Llama, Mistral, Qwen, Gemma. Что дала на моих задачах: 🔸 обучение в 1.9-2.1× быстрее 🔸 памяти …
@xomenok_llmft
📰 Deepseek R1 — китайцы открыли reasoning-модель, веса свободно Не путать с обычным R1 (rank-1). Это большая модель уровня o1 от OpenAI, только open-source и на 20× дешевле в инференсе. Что интересно для нас: 🔸 веса своб…
@xomenok_llmft
🤔 Что будет с fine-tuning через 3 года — моя ставка Мои прогнозы, спорьте в комментах: 🔴 Большие модели (500B+) станут монополистами по знанию, свои прогоны туда не полезут — слишком дорого. 🔴 Средние модели (7-70B) уйду…
@xomenok_llmft
💼 Дообучил модель для юр-компании — интересный кейс Задача: адвокатское бюро хочет модель, которая читает договор и отмечает риски по их чек-листу. Готовых нет — чек-лист внутренний, 340 пунктов. Что делал: 🔸 3 недели с …
@xomenok_llmft
🎁 Кросс-промо от Хоменка — что ещё веду Ребят, я не только про fine-tuning пишу. У меня есть каналы про смежные штуки, куда часто перетекают вопросы: 🔸 «Хоменок: RAG-системы» — где заканчивается fine-tuning, начинается R…
@xomenok_llmft
📚 Overfitting в fine-tuning — 5 сигналов, что модель тупеет Ребят, если ваша модель после дообучения: 🔴 повторяет одну и ту же фразу в разных ответах — она заучила датасет 🔴 отвечает хуже на общих вопросах, не по вашему …
@xomenok_llmft
📰 Gemini 2.0 Flash — Google открыл fine-tuning в AI Studio Что важно: 🔸 бесплатный тир: до 50 прогонов в месяц, до 4 млн токенов 🔸 платный: $0.30 за 1 млн токенов обучения, инференс идёт по обычной цене 🔸 деплоится через…
@xomenok_llmft
🎁 Как выбрать базовую модель под fine-tuning — 3 фактора Ребят, вопрос «Llama или Mistral» задают каждую неделю. Отвечаю системно. 🔸 Смотри лицензию. Llama до 700 млн MAU — ок, дальше платишь. Mistral Apache 2.0 — свобод…
@xomenok_llmft
🤔 Open-source или API — вечный холивар, решаю в 2 минуты Задаю себе 3 вопроса: 🔴 Инференс больше $500/мес по API? Иди в open-source, окупишь через 2-3 мес. 🔴 Требуется задержка меньше 200 мс? Только своя модель на своём …
@xomenok_llmft
📰 Anthropic намекнул на fine-tuning Claude Haiku в Bedrock Официально ещё не запустили, но в блог-посте пишут про программу для энтерпрайза. Судя по формулировкам: 🔸 доступ через AWS Bedrock, не напрямую через API 🔸 треб…
@xomenok_llmft
📚 GGUF-квантизация — почему без неё в проде тебе конец Обучил модель в fp16 на арендованной H100, теперь надо задеплоить на клиентский сервер с одним RTX 4070. Что делать? Ответ — GGUF-квантизация в 4-8 бит через llama.c…
@xomenok_llmft
💼 Продал fine-tune клиенту за $8к, себе оставил $6.2к — рассказываю сделку Клиент — сеть автосервисов, 40 точек. Задача: чат-бот в WhatsApp отвечает по каталогу запчастей + пишет заявку в 1С. Что делал: 🔸 месяц собирал и…
@xomenok_llmft
📰 H200 подешевела в vast.ai до $1.8/час — можно жить Год назад H100 стоил $4-5, я откладывал прогоны на выходные. Сейчас H200 — младший брат H100 с 141 ГБ памяти — идёт по $1.8 в спот-режиме. Что это даёт для fine-tuning…
@xomenok_llmft
🎁 Как чистить датасет для fine-tuning — 6 шагов, которые экономят неделю 🔸 Дедупликация по MinHash. Иначе модель заучит одинаковые куски и потеряет обобщение. 🔸 Отфильтровать всё короче 20 токенов на ответе — там обычно …
@xomenok_llmft
🤔 Сколько данных нужно для fine-tuning — честный ответ Все врут, что 100 примеров достаточно. Это работает только на простейших задачах в духе классификации. По моему опыту: 🔴 тон и стиль ответа — 500-1000 качественных п…
@xomenok_llmft
📚 DPO против SFT — чем реально отличаются На эту тему написано тонна статей, но мало кто объясняет по-человечески. 🔸 SFT (Supervised Fine-Tuning) — «вот пример хорошего ответа, копируй». Модель учит стиль и знания. 🔸 DPO…
@xomenok_llmft
📰 Llama 3.3 70B — Meta тихо обновила модель, снова бесплатно Что подвезли: 🔸 контекст 128к из коробки, без хаков через YaRN 🔸 качество на MMLU +3.5 к 3.1, обгоняет GPT-4o на JSON-режиме 🔸 та же лицензия, коммерческое исп…
@xomenok_llmft
💰 Разложил бюджет на fine-tuning для клиента — делюсь цифрами Задача была: дообучить Mistral 7B под колл-центр банка. 12к диалогов, LoRA. Расходы: 🔸 сборка датасета (junior + разметка): $1400 🔸 аренда H100 на 8 часов (va…
@xomenok_llmft
🎙 Анонс подкаста: в среду у меня Артём — CTO стартапа, обучающего Llama под юрдоки Разберём то, о чём обычно молчат: 🔸 сколько денег реально ушло на первый прогон (спойлер: в 3× больше, чем планировали) 🔸 почему пришлось…
@xomenok_llmft
📚 QLoRA — то же LoRA, только для нищих Разбор для тех, кто пропустил. QLoRA = LoRA + квантизация базовой модели в 4 бита. Что это даёт: 🔸 Llama 3 70B помещается в 48 ГБ (одна A6000 вместо двух H100) 🔸 обучение идёт на 30…
@xomenok_llmft
🎁 Лайфхак: собираю датасет для fine-tuning за час через Claude Ребят, схема такая: 🔸 беру 50 «золотых» примеров руками — это эталон 🔸 отдаю Claude Sonnet с промптом: «сгенерируй 30 вариаций каждого, меняй формулировку, с…
@xomenok_llmft
📰 Mistral выкатил Small 3 — 24B параметров, лицензия Apache 2.0 Что важно: 🔸 обгоняет Llama 3.3 70B на некоторых бенчах при 3× меньшем размере 🔸 контекст 32к, для большинства задач хватает 🔸 идеально ложится под LoRA, по…
@xomenok_llmft
🤔 Нужен ли твоему стартапу fine-tuning или ты просто выпендриваешься На самом деле большинство задач закрывается промптом и RAG. Fine-tuning имеет смысл, когда: 🔴 у тебя специфический тон/жаргон, и ChatGPT его не тянет 🔴…
@xomenok_llmft
related channels

Похожие каналы сети

Каналы с близким редакционным форматом — для расширения охвата при рекламной кампании или для подписки на смежные темы.

NFT после хайпа. NFT как инструмент маркетинга, а не спекуляции: лояльность, доступ, community. Кейсы брендов и живые проекты. Пишу не как гуру, а как практик:...

3 подписч.
1 просм/пост
33.3% ER
цена по запросу
Открыть

GA4, Яндекс.Метрика, консенты, cookieless. Что реально мерится, что теряется, как сшивать данные разных систем. GA4 без слёз. Инсайдерский взгляд без корпоратив...

3 подписч.
0 просм/пост
0% ER
цена по запросу
Открыть

AI-агенты в IDE. Cursor, Windsurf, Claude Code, Copilot. Сравнение, промты, workflow. Плюс мой setup под ежедневную работу. Пишу не как гуру, а как практик: раз...

4 подписч.
0 просм/пост
0% ER
цена по запросу
Открыть

Reddit как канал для SaaS/ecom в США: сабреддиты, автомодерация, тон общения. Кейсы органических запусков. Reddit для рынков США. Инсайдерский взгляд без корпор...

4 подписч.
1 просм/пост
25% ER
цена по запросу
Открыть

Смотреть весь каталог из 7160 каналов →

start

Готовы запустить рекламу через сеть public.tg?

Новый оффер, продукт, GEO, кейс, событие или партнёрский запуск — соберём маршрут под задачу и отдадим медиаплан.

Telegram для медиаплана: @AFFtop_connect. Быстрый тест: $20 за канал, $1000 за пакет по сети.