Калькулятор ROI: полный расчёт self-hosted ИИ-инфраструктуры

Полная методика обоснования собственного GPU-кластера: CAPEX, OPEX, TCO за 3 года, break-even против API, ROI и NPV. Интерактивный калькулятор с выгрузкой отчёта в Excel.

Железо
Эксплуатация
Нагрузка и сравнение

Вердикт

Self-hosted дешевле при этом объёме

  • Экономия 262 621 ₽/мес: self-hosted 649 379 ₽ против API 912 000 ₽
  • Окупаемость: 24 мес
  • Break-even 285M/день — текущий объём уже выше
  • ROI за 36 мес: 35,4%, NPV: +6 614 469 ₽

Для большинства команд оптимальна гибридная модель: self-hosted для основной модели и ~80% объёма, API для флагманских моделей и пиковых нагрузок.

TCO

TCO, ₽/мес 649 379
TCO, 3 года 24 247 278 ₽
Себестоимость 54 ₽/1M

Сравнение с API

API, ₽/мес 912 000
Break-even 285M/день
Окупаемость 24 мес
Экономия против API +262 621 ₽/мес

ROI и NPV

ROI, 36 мес 35,4%
NPV 6 614 469 ₽
GPU 1 200 000
Платформа 4 000 000
Сеть 300 000
Охлаждение 200 000
Установка (10%) 570 000
Итого CAPEX 6 270 000
Электроэнергия 5 212
ЦОД / колокация 0
Персонал 450 000
Служебные 20 000
Итого OPEX 475 212

Чувствительность по объёму

Объём, M/деньSelf-hosted, ₽/месAPI, ₽/месВыигрывает
1649 3792 280API
10649 37922 800API
50649 379114 000API
100649 379228 000API
500649 3791 140 000Self-hosted
1000649 3792 280 000Self-hosted

Чувствительность по API-тарифу

API-тарифBlended, ₽/1MBreak-even, M/день
Claude Haiku 4.5185117M
Claude Sonnet 537258M
Claude Opus 592823M
DeepSeek V4.1 Flash76285M
DeepSeek V4 Pro208104M
ФакторAPI (аренда)Self-hosted (своё железо)
Стоимость за токенПлатите за каждый токен, растёт с объёмомФиксированная стоимость GPU, маржинальная стоимость → 0
ДанныеУходят к провайдеруОстаются в контуре компании
LatencyЗависит от сети провайдераЛокальная, < 50 мс
МасштабированиеОграничено rate limitsДобавляете GPU
Комплаенс (152-ФЗ)Риск при передаче данныхПолное соответствие
Air-gapНевозможенВозможен
  • Объём российского рынка ИИ — 316 млрд ₽ (2025, +29,7% YoY).
  • Рынок GPU-серверов для ИИ — ~60 млрд ₽ (2025, оценка Yadro).
  • Рынок аренды GPU-серверов — 17 млрд ₽ (2025) → 34 млрд ₽ (2026, +100%).
  • Острая нехватка GPU в РФ, дефицит оборудования NVIDIA; прогноз рынка ИИ к 2028 — 644 млрд ₽.

Методика: CAPEX = GPU + платформа + сеть + охлаждение + 10% установка; OPEX = электро (×1,7 — полный сервер: CPU/RAM/SSD/охлаждение) + ЦОД + персонал + служебные; TCO/мес = CAPEX/36 + OPEX (амортизация 3 года, прямая линия); break-even = TCO/мес ÷ (30 × blended API); blended = input×0,7 + output×0,3; TCO 3 года = CAPEX + OPEX×12×(1+1,05+1,05²) — инфляция 5%/год; ROI = (API×36 + доп. выгоды×36 − TCO 3 года) / TCO 3 года; NPV — месячные cash flows, дисконт (1+WACC)^(t/12), инфляция OPEX 5%/год. Дефолт (400M токенов/день) — self-hosted дешевле API: окупаемость ~24 мес; ниже break-even (~285M/день) выигрывает API — смотрите таблицу чувствительности. Цены РФ, сент 2026; источники — ниже.

Источники

  • ServerNews — Рынок ИИ РФ 316 млрд ₽
  • Klerk — Аренда GPU 17→34 млрд ₽
  • IT-World — Прогноз рынка ИИ 644 млрд ₽, дефицит GPU
  • Anthropic — Claude API: Haiku 4.5 $1/$5, Sonnet 5 $2/$10, Opus 5 $5/$25 за 1M токенов
  • AITunnel — Цены DeepSeek/Qwen в ₽
  • ProxyAPI — DeepSeek V4.1 Flash 41 ₽/1M
  • Onlinetrade — RTX 3090 250 000 ₽
  • Born-Shop — RTX 3090 170 000 ₽
  • TInvest — H100 3 974 284 ₽
  • MClouds — L40S ~800 000 ₽, платформа 3–4 млн ₽
  • Lenta.ru — Тарифы на электроэнергию Москва 2026
  • EnerOne — Промышленные тарифы РФ 2026
  • Habr Career — Зарплаты SRE: junior 178K, middle 253K, senior 320K
  • VK Cloud — Методология TCO IT-инфраструктуры
  • SimpleOne — Методология TCO

Методика

Расчёт ведётся за 3 года (36 месяцев) в рублях, по ценам РФ на сентябрь 2026.

CAPEX — капитальные затраты:

CAPEX = GPU×кол-во + платформа + сеть + охлаждение + 10% (установка/настройка)

OPEX — операционные затраты, ₽/мес:

OPEX = электро + ЦОД + персонал + служебные
электро = кол-во × (W/1000) × 730 ч × загрузка × тариф × 1,7

Коэффициент 1,7 учитывает полный сервер (CPU, RAM, SSD, охлаждение), а не только GPU.

TCO — total cost of ownership:

TCO/мес     = CAPEX/36 + OPEX                    (амортизация 3 года, прямая линия)
TCO 3 года  = CAPEX + Σ OPEX×12×1,05^(год−1)     (инфляция 5%/год)
₽/1M        = TCO/мес / (объём × 30)

Сравнение с API:

blended API  = input×0,7 + output×0,3            (доля input/output 70/30)
API/мес      = объём × 30 × blended
break-even   = TCO/мес / (30 × blended)          (M токенов/день)
окупаемость  = CAPEX / (API/мес − TCO/мес)       («—», если API дешевле)

ROI и NPV:

ROI 36 мес = (API×36 + доп. выгоды×36 − TCO 3 года) / TCO 3 года
NPV        = −CAPEX + Σ (API + доп. выгоды − OPEX)×1,05^(t/12) / (1+WACC)^(t/12)

Допущения

  • Коэффициент 1,7 для полного потребления сервера (не только GPU).
  • Доля input/output токенов — 70/30.
  • Инфляция OPEX — 5%/год (зарплаты, энергия).
  • Амортизация GPU — 3 года, прямая линия.
  • Ставка дисконта (WACC) — 20% (типичный диапазон для РФ 15–25%).
  • При дефолте (6× RTX 3090, 400M токенов/день) self-hosted дешевле API: экономия ~263K ₽/мес, окупаемость ~24 мес; ниже break-even (~285M/день) выигрывает API — для смешанных нагрузок смотрите гибридную модель.

Риски

РискВлияниеМитигация
Дефицит GPU в РФРост цен на 20–50%Закупка в 2 этапа, б/у рынок
Рост тарифов на электричество+6,5% в 2026Двухтарифный счётчик, ночная генерация
Рост зарплат DevOps+10–15%/годАвтоматизация, AI-агенты
Устаревание GPU (3–5 лет)Обесценивание CAPEXЛизинг, апгрейд по частям
Снижение цен APISelf-hosted теряет преимуществоГибридная модель (API + self-hosted)
152-ФЗ / комплаенсШтрафы при утечке данныхSelf-hosted как митигация

Готовы взять AI-инфраструктуру под свой контроль?

За 3–5 дней разберём ваш стек, замерим «до» и покажем, сколько вы переплачиваете и где риски по контролю и данным. 90 000 ₽ — и вы точно знаете, что делать.