Главная/Блог/IaaS, PaaS, SaaS и аренда GPU: за что вы платите и что делаете сами
КАК ЭТО УСТРОЕНО

IaaS, PaaS, SaaS и аренда GPU: за что вы платите и что делаете сами

Слова «облако», «платформа» и «аренда GPU» описывают не разные технологии, а разные границы ответственности: где кончается чужая работа и начинается ваша. От этой границы зависит и то, за какую единицу приходит счёт — за час сервера, за час карты, за миллион токенов или за вызов функции. Разбираем пять способов по одному признаку и показываем, где на сайте лежит цена по каждому.

Обновлено 2026-08-29 · 7 мин чтения · ЗероКвант

Сравнительная таблица

Что берётеЕдиница счётаЧто делаете самиГде у нас цена
Своё железоразовая закупка плюс электричество и людивсё: помещение, питание, охлаждение, установка, обновления, дежурствокаталог и цены на карты
IaaS — сервер или виртуальная машиначас или месяц ресурсаоперационная система, драйверы, среда, сама модель, мониторингаренда серверов, в том числе без GPU
GPUaaS — видеокарта в арендучас картыто же, что в IaaS, плюс подбор карты под размер моделисрезы по картам и наблюдаемые ставки
PaaS — платформаресурс плюс управление платформойприносите модель и данные, среду держит поставщикпубличных ставок по РФ у нас пока нет
Доступ к модели по APIмиллион токенов, вход и выход раздельнотолько запросы и обработку ответовцена миллиона токенов у восьми поставщиков
SaaS — готовый сервисрабочее место или подписканичего технического: пользуетесь программойвне нашего предмета
FaaS — функция по вызовувызов и время исполненияпишете функцию, инфраструктуры не касаетесьвне нашего предмета

Одна линейка вместо пяти терминов

Термины из отчётов — IaaS, PaaS, SaaS, FaaS — выстраиваются в один ряд, если смотреть не на то, что продаётся, а на то, сколько работы остаётся вам. На одном конце своё железо: чужой работы ноль, ваша — вся. На другом готовый сервис: вы просто пользуетесь, всё остальное чужое. Между ними промежуточные варианты, и разница между ними ровно в том, где проведена граница.

Из этой же границы вытекает единица счёта, и это практически важнее самого термина. За своё железо платят один раз и потом всю жизнь — электричеством и людьми. За инфраструктуру платят за время: час или месяц. За доступ к модели платят за объём текста, который через неё прошёл. Три разные единицы, и сравнивать их напрямую нельзя — сначала нужно привести к одной нагрузке.

Дальше по каждому варианту одно и то же: что вы берёте, что остаётся на вас, за что приходит счёт. Термины из этого разбора вынесены в словарь; здесь речь не о значении слов, а о выборе.

Своё железо: платите один раз, а делаете всё

Сервер с картами стоит у вас, данные не покидают периметр, модель не меняется, пока вы её не смените. Счёт разовый — закупка, — но за ним идёт длинный хвост: помещение, питание, охлаждение, установка, обновления, дежурный инженер. Именно этот хвост чаще всего выпадает из расчёта, и именно он решает, окупится ли вариант.

Кому это нужно на самом деле: там, где режим данных не оставляет выбора, где нагрузка ровная и круглосуточная и где важна воспроизводимость — модель обязана оставаться той же самой месяцами. Цены на карты и платформы у нас лежат в разделе наблюдаемых цен, комплектация и энергетика — в разделе ЦОД.

IaaS: инфраструктура в аренду

Вы берёте сервер или виртуальную машину и получаете голое железо с доступом. Дальше всё ваше: операционная система, драйверы, среда запуска, сама модель, мониторинг. Поставщик отвечает за то, что машина включена и подключена к сети, и ни за что выше.

Счёт идёт за время владения ресурсом, а не за работу: остановили — перестали платить, но пока машина ваша, она стоит денег независимо от того, обрабатывает она запросы или простаивает. Отсюда главный вопрос к этому варианту — фактическая загрузка. Сервер, занятый по четыре часа в сутки, обходится в шесть раз дороже расчёта «по цене часа».

Ставки российских площадок и разбор того, кто вообще публикует цену, — в разделе аренды. Отдельно про машины без видеокарты, под обвязку и агентов, — аренда без GPU.

Аренда GPU — это не аренда сервера и не доступ к модели

Это место путают чаще остального, и путаница дорогая. «Аренда GPU» продаётся как отдельная услуга, но единица там — карта, а не машина: вы платите за час конкретной видеокарты, и от её объёма памяти зависит, какая модель вообще запустится. Сервер с четырьмя слабыми картами и сервер с одной сильной стоят по-разному и решают разные задачи.

Отличие от доступа по API ещё резче. Арендовав карту, вы получаете пустую память — модель на неё нужно поставить, обновлять и обслуживать самому. Купив доступ по API, вы получаете готовые ответы и не касаетесь ни карты, ни модели. Первое считается в часах, второе в токенах, и перевести одно в другое можно только через нагрузку: сколько запросов, какой длины, с какой одновременностью.

Сколько памяти потребует ваша модель и во что это выливается в картах — считает калькулятор памяти; наблюдаемые ставки по каждой карте лежат в витрине наблюдений.

PaaS: платформа, на которую вы приносите модель

Промежуточный вариант: среду запуска, оркестрацию и обновления держит поставщик, вы приносите модель и данные. Экономия здесь не в железе, а в людях — не нужен инженер, поддерживающий стек. Плата складывается из ресурса и надбавки за управление.

⚠️ Своих наблюдений по этому варианту у нас пока нет: российские площадки редко публикуют ставку управляемой платформы отдельно от ресурса, и вывести её из общего прайса нельзя. Пустое место здесь честнее подстановки: как только ставки появятся в открытом виде, они попадут в наблюдения с датой и источником.

Доступ к модели по API: платите за объём текста

Самый низкий порог входа: ни железа, ни установки, счёт за миллион токенов. Вход и выход тарифицируются раздельно и по разным ставкам — сравнение «по одной цифре» здесь занижает расчёт, иногда вдвое.

Обратная сторона — вопрос о данных. Оплата в рублях, договор с российской компанией и место, где физически выполняется модель, — это три разные вещи, и совпадают они далеко не всегда. Для персональных данных значение имеет третье, а продаётся обычно первое.

Наблюдаемые цены у восьми поставщиков с датой у каждой ставки — цена миллиона токенов; разбор самих поставщиков и того, что у них с документами и местом обработки, — в разделе доступа к моделям.

SaaS и функции: чужая программа целиком

SaaS — готовая программа по подписке: ассистент, распознавание, помощник в переписке. Вы не касаетесь ни модели, ни инфраструктуры, платите за рабочее место или за подписку. FaaS — тот же принцип на уровне кода: вы пишете функцию, она запускается по вызову, платите за вызовы и время исполнения.

Оба варианта лежат вне нашего предмета, и это осознанно: мы считаем экономику запуска модели, а не рынок готовых программ. Названы они здесь потому, что в отчётах стоят в одном ряду с остальными, — и читателю полезно знать, что этот ряд неоднороден.

Как это ложится на выбор

Все семь строк таблицы сводятся к двум вопросам, и мы задаём их именно в таком порядке. Первый: где выполняется модель — на чужом сервисе, на арендованных картах или на своей инфраструктуре. Второй: что разрешено делать с данными — можно ли передавать их наружу, должна ли обработка быть в России, нужен ли частный периметр.

Вторая ось меняет ответ по первой, а не следует за ней: закрытый контур это ограничение, а не «более высокая ступень». Требование держать данные внутри может выполняться и на своём сервере, и на арендованном выделенном, и в частном облаке — а вот вариантов с готовым внешним сервисом оно лишает сразу.

Разбор двух осей целиком — на странице способов запуска. Если начинать удобнее не с железа, а с задачи, вход с другой стороны — задачи бизнеса: там то же самое считается от того, что нужно получить.

Вердикт

Термин говорит о границе, а не о технологии. IaaS, PaaS и SaaS отличаются тем, сколько работы остаётся вам. Из этой границы следует и единица счёта.
Три единицы счёта несравнимы напрямую. Час сервера, час карты и миллион токенов приводятся к одному числу только через вашу нагрузку: сколько запросов, какой длины, с какой одновременностью.
Аренда GPU — отдельная вещь. Не сервер и не доступ к модели: вы платите за карту, получаете пустую память, а модель ставите и обслуживаете сами.
Загрузка решает больше, чем ставка. Ресурс стоит денег, пока он ваш, а не пока он работает. Сервер, занятый четыре часа в сутки, обходится в шесть раз дороже расчёта по цене часа.
По PaaS у нас данных нет. Российские площадки редко публикуют ставку управляемой платформы отдельно от ресурса. Пустое место честнее подстановки.