Главная/Новости/NVIDIA померила Vera Rubin на агентах — и это замер вендора о своём железе
Железо

NVIDIA померила Vera Rubin на агентах — и это замер вендора о своём железе

Коротко

24 августа 2026 года NVIDIA опубликовала собственные замеры Vera Rubin NVL72 на агентных сценариях: до 30 раз больше работы на мегаватт и в 35 раз ниже стоимость токена против GB300 NVL72. Замер проведён вендором на своём оборудовании — это заявка, а не независимая проверка, и читать её стоит рядом с тем, что доезжает до российских площадок.

Почему меряют именно агентами. По данным OpenRouter, на которые ссылается NVIDIA, агентные нагрузки съедают в 15 раз больше токенов, чем обычный запрос в чат: агент ходит по источникам, вызывает под-агентов и накапливает контекст, и каждый шаг становится входом следующего. Длинный контекст перестаёт быть особенностью сценария и становится главной статьёй расхода памяти.

Что это значит здесь. Стойка предыдущего поколения в России уже сдаётся: B300 и B200 стоят в наших наблюдениях со ставкой за час и датой проверки — срез по B300. Vera Rubin в наблюдаемых прайсах пока нет ни у одной из площадок, по которым мы ведём ставки, и до появления в прайсе сравнивать смету не с чем.

Проверять «в 35 раз дешевле токен» имеет смысл там, где токен продаётся за рубли. Мы ведём ряд цен восьми поставщиков доступа к моделям — цена миллиона токенов; это единственный способ увидеть, доходит ли удешевление железа до счёта, который платит заказчик. Ряду пока десять дней, и вывод о тренде по нему мы не делаем.

Оговорка, которую вендор не делает за нас: «работа на мегаватт» — метрика дата-центра, а не предприятия. Для компании, которая ставит одну-две карты в свою стойку, решают объём памяти и цена входа, а не эффективность на мегаватт; на этом отрезке смена поколения меняет мало.

ЧТО ЭТО МЕНЯЕТ
Наши числа

У нас есть ставки аренды по картам, снятые с прайсов, у девяти площадок — и ещё у двух, полученные по запросу, — плюс цены восьми поставщиков токенов с датами: то есть проверяемый ответ на вопрос «что из этого можно арендовать здесь и почём», которого в вендорском замере нет. Счёт тот же, что на витрине аренды, второго мы не заводим.

Российский контекст

Российский срез поколений: B300 и B200 в наблюдаемых прайсах уже есть, Vera Rubin — нет. Пока карта не появилась в прайсе площадки, её эффективность на смету заказчика не влияет.

ПЕРВОИСТОЧНИКЗамер Vera Rubin NVL72 в блоге NVIDIA, 24.08.2026 →

ЧТО ДЕЛАТЬ

Смена поколения у вендора меняет вашу смету не раньше, чем новая карта появится в прайсе российской площадки — до этого считайте по тому, что реально арендуется.

Материал — экспертный разбор ЗероКвант на основе открытых данных; характеристики и суммы — ориентир, не юридическая консультация. Точный расчёт и статус — по запросу.

Ещё разборы