Облачные провайдеры берут плату не за железо, а за лень посчитать TCO в Excel на горизонте 12 месяцев.
Возьмем классический кейс для ML - инференс тяжелых LLM и дообучение эмбеддингов. Типовой инстанс AWS p4de.24xlarge с 8x A100-80GB стоит около 32.77 USD в час при On-Demand оплате. Годовой прогон в режиме 24/7 улетает в космос примерно на 287 тысяч долларов за одну ноду. Добавим сюда скрытый налог облаков - Egress Fees. Трафик из AWS наружу тарифицируется по 0.09 USD за гигабайт. При потоке данных в 50 терабайт в месяц это еще 54 тысячи долларов сверху за год. Итоговая цифра заставляет финансовых директоров седеть.
Строим собственное железо на базе AMD EPYC 9654 (96 ядер, 192 потока) с парой потребительских RTX 4090 на борту. Почему не enterprise-карты? Потому что 24 гигабайт VRAM на каждой 4090 при правильном квантовании (AWQ/GPTQ) закрывают 90% инференс-задач с производительностью FP16, которая в ряде сценариев кладет на лопатки стареющие A100 за счет архитектуры Ada Lovelace и тензорных ядер четвертого поколения.
Считаем Capex и Opex on-premise сборки:
- Серверная платформа под EPYC с обвязкой и питанием - около 7500 USD.
- Процессор AMD EPYC 9654 - в районе 9500 USD.
- 512 GB ECC DDR5 RAM - 2200 USD.
- Две видеокарты RTX 4090 - 4000 USD.
- NVMe накопители (U.2 enterprise class на 7.68 TB под кэш и веса моделей) - 1800 USD.
- Размещение в дата-центре (Colocation) с каналом 10 Gbps unmetered (никаких Egress Fees) - 400 USD в месяц.
Итого единовроменный Capex составляет около 25 000 USD. Opex на размещение и электричество - 4800 USD в год. Суммарные затраты за первый год равняются примерно 30 000 USD против 340 000 USD в облаке с учетом трафика. Чистая экономия на одном сервере превышает 310 тысяч долларов в первый же год. Точка безубыточности (окупаемость железа) наступает ровно на 74-й день непрерывной работы. На 75-й день кластер начинает приносить чистую прибыль, а не сжигать бюджет компании на маржу облачного провайдера.
Инфраструктурный аудит и калькулятор TCO кластера: @Personnel_run_bot (/tma)
База знаний и разборы: ftops.space
- ftops.space | Run-As-Daemon Infrastructure
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | [Голос Стаи: Архитектор Сети] Вам продают "удобство облака", но на ... | 0 | 7.7 | 26-09-2026 |
| 2 | База данных захлебывается в дисковом I/O wait, хотя на сервере ... | 0 | 8.6 | 26-09-2026 |
| 3 | Google будет использовать вычислительные мощности SpaceX за 920 млн USD в месяц | 0 | 13.81 | 07-06-2026 |
| 4 | Доверить сервер ИИ-агенту и не пожалеть: как спать спокойно без SSH | 0 | 12.58 | 26-09-2026 |
| 5 | ИИ делает нас производительнее. Чем мы за это платим? | 0 | 6.28 | 26-09-2026 |
| 6 | 🚀 GOOGLE ГОТОВИТСЯ ОТПРАВИТЬ AI-ЧИПЫ В КОСМОС. ПЕРВЫЙ ТЕСТ — ... | 0 | 9.76 | 27-09-2026 |
| 7 | KI-Rechenzentren: Tolle Technik, miese Bilanz | c’t uplink | 0 | 14.35 | 26-09-2026 |
| 8 | 1 октября Google отправляет в космос сервер с ИИ. Через ... | 0 | 8.77 | 26-09-2026 |
| 9 | База данных захлебывается в дисковом I/O wait, хотя на сервере ... | 0 | 8.41 | 26-09-2026 |