Методика
Расчёт ведётся за 3 года (36 месяцев) в рублях, по ценам РФ на сентябрь 2026.
CAPEX — капитальные затраты:
CAPEX = GPU×кол-во + платформа + сеть + охлаждение + 10% (установка/настройка)
OPEX — операционные затраты, ₽/мес:
OPEX = электро + ЦОД + персонал + служебные
электро = кол-во × (W/1000) × 730 ч × загрузка × тариф × 1,7
Коэффициент 1,7 учитывает полный сервер (CPU, RAM, SSD, охлаждение), а не только GPU.
TCO — total cost of ownership:
TCO/мес = CAPEX/36 + OPEX (амортизация 3 года, прямая линия)
TCO 3 года = CAPEX + Σ OPEX×12×1,05^(год−1) (инфляция 5%/год)
₽/1M = TCO/мес / (объём × 30)
Сравнение с API:
blended API = input×0,7 + output×0,3 (доля input/output 70/30)
API/мес = объём × 30 × blended
break-even = TCO/мес / (30 × blended) (M токенов/день)
окупаемость = CAPEX / (API/мес − TCO/мес) («—», если API дешевле)
ROI и NPV:
ROI 36 мес = (API×36 + доп. выгоды×36 − TCO 3 года) / TCO 3 года
NPV = −CAPEX + Σ (API + доп. выгоды − OPEX)×1,05^(t/12) / (1+WACC)^(t/12)
Допущения
- Коэффициент 1,7 для полного потребления сервера (не только GPU).
- Доля input/output токенов — 70/30.
- Инфляция OPEX — 5%/год (зарплаты, энергия).
- Амортизация GPU — 3 года, прямая линия.
- Ставка дисконта (WACC) — 20% (типичный диапазон для РФ 15–25%).
- При дефолте (6× RTX 3090, 400M токенов/день) self-hosted дешевле API: экономия ~263K ₽/мес, окупаемость ~24 мес; ниже break-even (~285M/день) выигрывает API — для смешанных нагрузок смотрите гибридную модель.
Риски
| Риск | Влияние | Митигация |
|---|---|---|
| Дефицит GPU в РФ | Рост цен на 20–50% | Закупка в 2 этапа, б/у рынок |
| Рост тарифов на электричество | +6,5% в 2026 | Двухтарифный счётчик, ночная генерация |
| Рост зарплат DevOps | +10–15%/год | Автоматизация, AI-агенты |
| Устаревание GPU (3–5 лет) | Обесценивание CAPEX | Лизинг, апгрейд по частям |
| Снижение цен API | Self-hosted теряет преимущество | Гибридная модель (API + self-hosted) |
| 152-ФЗ / комплаенс | Штрафы при утечке данных | Self-hosted как митигация |