ITGLOBAL.COM: post #1088 — TG.ME

☁️Запуск LLM в закрытом контуре: оборудование под задачи

Открытые LLM достигли уровня коммерческих аналогов. Kimi K3, DeepSeek V4 Pro и GLM 5.2 конкурируют с GPT-5 и Claude — и работают на вашем оборудовании, без отправки данных во внешние API.

Одного сервера (8 GPU) уже достаточно для:

✔️ DeepSeek V4 Flash — 284B параметров, но только 13B активных
✔️ DeepSeek V4 Pro — 1.6T параметров, но только 49B активных
✔️ GLM 5.2 — 744B параметров, но только 40B активных
✔️ Mistral Large 3 — 675B параметров, но только 41B активных


Это работает благодаря архитектуре Mixture of Experts (MoE): модель активирует только нужные эксперты для каждого токена. Остальные параметры экономят память.

Kimi K3 (2.8 триллиона параметров) — исключение: это требует кластер из нескольких серверов даже с современной квантизацией.

❗️Выбор платформы под разные модели — важная задача, подробнее читайте в статье
🔥3
August 4, 2026 187 3