За £200 автор собрал локальный LLM-стенд на базе игрового ПК и серверной GPU без нормального PCIe-коннектора.
Было: RTX 4080 с 16 ГБ VRAM — хватает для игр, но не для тяжёлых моделей.
Решение: докинуть датацентровую карту через адаптер и получить суммарно 32 ГБ VRAM на двух GPU.
Результат: модель на 27B параметров запускается локально и выдаёт ~32 токена/с. ⚙️
Что это значит для тех, кто считает инфраструктуру:
- не всегда нужен дорогой апгрейд на топовую consumer-карту;
- иногда выгоднее собрать гибридный сетап из «игровой» и серверной железки;
- узкое место чаще в VRAM, а не в сырой вычислительной мощности.
Практика, а не маркетинг: если модель не влезает в память, производительность уже вторична.
Paid Ads Lab
@PaidAdsPro
За £200 автор собрал локальный LLM-стенд на базе игрового ПК и серверной GPU без нормального PCIe-коннектора.
Этот пост опубликован в Telegram-канале Paid Ads Lab. Подписаться можно по ссылке: @PaidAdsPro.