Локально или в облаке: где дешевле содержать генеративный ИИ? — 14 января 2026 г. в 10:13:20.286
Локально или в облаке: где дешевле содержать генеративный ИИ? На первый взгляд как будто бы в облаке, но реальность быстро сбивает с облаков на землю. Гипотетический запуск на экземплярах класса AWS P5 с NVIDIA H100 может превысить 483 млн $. Поэтому лучше от гипотез двинуться к практике. 2 ёмких вывода: — короткие и нестабильные нагрузки ➡️ облако — долгая предсказуемая работа GenAI ➡️ локальная инфраструктура Почему? Достаточно сравнить совокупную стоимость владения при локальной и облачной модели. Для чистоты "эксперимента" вынесли за скобки все, что НЕ касается железа и реального потребления ресурсов. Облако показало себя отличным для старта (пилоты, эксперименты, нерегулярные задачки). Но как только нагрузка становится постоянной, счет начинает скакать как Марио в свои лучшие годы😃 И в основном только вверх. Локально — обратная логика. Высокий порог входа, но далее фиксированные капитальные затраты и сравнительно недорогая эксплуатация. На конкретных сценариях с участием ThinkSystem SR675 V3 и облачным аналогом показали экономику в действии + расписали таблицу расходов — в статье. Переходите! Сервер, сторадж & два свича

