IaaS, PaaS, SaaS и аренда GPU: за что вы платите и что делаете сами
Слова «облако», «платформа» и «аренда GPU» описывают не разные технологии, а разные границы ответственности: где кончается чужая работа и начинается ваша. От этой границы зависит и то, за какую единицу приходит счёт — за час сервера, за час карты, за миллион токенов или за вызов функции. Разбираем пять способов по одному признаку и показываем, где на сайте лежит цена по каждому.
Сравнительная таблица
| Что берёте | Единица счёта | Что делаете сами | Где у нас цена |
|---|---|---|---|
| Своё железо | разовая закупка плюс электричество и люди | всё: помещение, питание, охлаждение, установка, обновления, дежурство | каталог и цены на карты |
| IaaS — сервер или виртуальная машина | час или месяц ресурса | операционная система, драйверы, среда, сама модель, мониторинг | аренда серверов, в том числе без GPU |
| GPUaaS — видеокарта в аренду | час карты | то же, что в IaaS, плюс подбор карты под размер модели | срезы по картам и наблюдаемые ставки |
| PaaS — платформа | ресурс плюс управление платформой | приносите модель и данные, среду держит поставщик | публичных ставок по РФ у нас пока нет |
| Доступ к модели по API | миллион токенов, вход и выход раздельно | только запросы и обработку ответов | цена миллиона токенов у восьми поставщиков |
| SaaS — готовый сервис | рабочее место или подписка | ничего технического: пользуетесь программой | вне нашего предмета |
| FaaS — функция по вызову | вызов и время исполнения | пишете функцию, инфраструктуры не касаетесь | вне нашего предмета |
Одна линейка вместо пяти терминов
Термины из отчётов — IaaS, PaaS, SaaS, FaaS — выстраиваются в один ряд, если смотреть не на то, что продаётся, а на то, сколько работы остаётся вам. На одном конце своё железо: чужой работы ноль, ваша — вся. На другом готовый сервис: вы просто пользуетесь, всё остальное чужое. Между ними промежуточные варианты, и разница между ними ровно в том, где проведена граница.
Из этой же границы вытекает единица счёта, и это практически важнее самого термина. За своё железо платят один раз и потом всю жизнь — электричеством и людьми. За инфраструктуру платят за время: час или месяц. За доступ к модели платят за объём текста, который через неё прошёл. Три разные единицы, и сравнивать их напрямую нельзя — сначала нужно привести к одной нагрузке.
Дальше по каждому варианту одно и то же: что вы берёте, что остаётся на вас, за что приходит счёт. Термины из этого разбора вынесены в словарь; здесь речь не о значении слов, а о выборе.
Своё железо: платите один раз, а делаете всё
Сервер с картами стоит у вас, данные не покидают периметр, модель не меняется, пока вы её не смените. Счёт разовый — закупка, — но за ним идёт длинный хвост: помещение, питание, охлаждение, установка, обновления, дежурный инженер. Именно этот хвост чаще всего выпадает из расчёта, и именно он решает, окупится ли вариант.
Кому это нужно на самом деле: там, где режим данных не оставляет выбора, где нагрузка ровная и круглосуточная и где важна воспроизводимость — модель обязана оставаться той же самой месяцами. Цены на карты и платформы у нас лежат в разделе наблюдаемых цен, комплектация и энергетика — в разделе ЦОД.
IaaS: инфраструктура в аренду
Вы берёте сервер или виртуальную машину и получаете голое железо с доступом. Дальше всё ваше: операционная система, драйверы, среда запуска, сама модель, мониторинг. Поставщик отвечает за то, что машина включена и подключена к сети, и ни за что выше.
Счёт идёт за время владения ресурсом, а не за работу: остановили — перестали платить, но пока машина ваша, она стоит денег независимо от того, обрабатывает она запросы или простаивает. Отсюда главный вопрос к этому варианту — фактическая загрузка. Сервер, занятый по четыре часа в сутки, обходится в шесть раз дороже расчёта «по цене часа».
Ставки российских площадок и разбор того, кто вообще публикует цену, — в разделе аренды. Отдельно про машины без видеокарты, под обвязку и агентов, — аренда без GPU.
Аренда GPU — это не аренда сервера и не доступ к модели
Это место путают чаще остального, и путаница дорогая. «Аренда GPU» продаётся как отдельная услуга, но единица там — карта, а не машина: вы платите за час конкретной видеокарты, и от её объёма памяти зависит, какая модель вообще запустится. Сервер с четырьмя слабыми картами и сервер с одной сильной стоят по-разному и решают разные задачи.
Отличие от доступа по API ещё резче. Арендовав карту, вы получаете пустую память — модель на неё нужно поставить, обновлять и обслуживать самому. Купив доступ по API, вы получаете готовые ответы и не касаетесь ни карты, ни модели. Первое считается в часах, второе в токенах, и перевести одно в другое можно только через нагрузку: сколько запросов, какой длины, с какой одновременностью.
Сколько памяти потребует ваша модель и во что это выливается в картах — считает калькулятор памяти; наблюдаемые ставки по каждой карте лежат в витрине наблюдений.
PaaS: платформа, на которую вы приносите модель
Промежуточный вариант: среду запуска, оркестрацию и обновления держит поставщик, вы приносите модель и данные. Экономия здесь не в железе, а в людях — не нужен инженер, поддерживающий стек. Плата складывается из ресурса и надбавки за управление.
⚠️ Своих наблюдений по этому варианту у нас пока нет: российские площадки редко публикуют ставку управляемой платформы отдельно от ресурса, и вывести её из общего прайса нельзя. Пустое место здесь честнее подстановки: как только ставки появятся в открытом виде, они попадут в наблюдения с датой и источником.
Доступ к модели по API: платите за объём текста
Самый низкий порог входа: ни железа, ни установки, счёт за миллион токенов. Вход и выход тарифицируются раздельно и по разным ставкам — сравнение «по одной цифре» здесь занижает расчёт, иногда вдвое.
Обратная сторона — вопрос о данных. Оплата в рублях, договор с российской компанией и место, где физически выполняется модель, — это три разные вещи, и совпадают они далеко не всегда. Для персональных данных значение имеет третье, а продаётся обычно первое.
Наблюдаемые цены у восьми поставщиков с датой у каждой ставки — цена миллиона токенов; разбор самих поставщиков и того, что у них с документами и местом обработки, — в разделе доступа к моделям.
SaaS и функции: чужая программа целиком
SaaS — готовая программа по подписке: ассистент, распознавание, помощник в переписке. Вы не касаетесь ни модели, ни инфраструктуры, платите за рабочее место или за подписку. FaaS — тот же принцип на уровне кода: вы пишете функцию, она запускается по вызову, платите за вызовы и время исполнения.
Оба варианта лежат вне нашего предмета, и это осознанно: мы считаем экономику запуска модели, а не рынок готовых программ. Названы они здесь потому, что в отчётах стоят в одном ряду с остальными, — и читателю полезно знать, что этот ряд неоднороден.
Как это ложится на выбор
Все семь строк таблицы сводятся к двум вопросам, и мы задаём их именно в таком порядке. Первый: где выполняется модель — на чужом сервисе, на арендованных картах или на своей инфраструктуре. Второй: что разрешено делать с данными — можно ли передавать их наружу, должна ли обработка быть в России, нужен ли частный периметр.
Вторая ось меняет ответ по первой, а не следует за ней: закрытый контур это ограничение, а не «более высокая ступень». Требование держать данные внутри может выполняться и на своём сервере, и на арендованном выделенном, и в частном облаке — а вот вариантов с готовым внешним сервисом оно лишает сразу.
Разбор двух осей целиком — на странице способов запуска. Если начинать удобнее не с железа, а с задачи, вход с другой стороны — задачи бизнеса: там то же самое считается от того, что нужно получить.