Мини-ПК на AMD Ryzen AI Max+ 395 (Strix Halo) — компактная станция для локального запуска LLM без облака. До 128 ГБ унифицированной памяти LPDDR5X делятся между CPU и встроенной графикой Radeon 8060S, из них до ~96 ГБ выделяются под видеопамять — этого хватает на локальный инференс моделей до ~70B в квантовании. NPU на ~50 TOPS, тихий корпус, ~120 Вт. Приватный ИИ на столе; поставка по параллельному импорту.
128 ГБ унифицированной памятилокальные LLM до ~70Bмини-ПК без ЦОД
128 ГБ
унифиц. память LPDDR5X
~96 ГБ
под видеопамять (iGPU)
~70B
LLM в квантовании
~50 TOPS
NPU (XDNA 2)
Radeon 8060S
iGPU (RDNA 3.5)
~120 Вт
энергопотребление
128 ГБ
унифиц. память LPDDR5X
~96 ГБ
под видеопамять (iGPU)
~50 TOPS
NPU (XDNA 2)
Мини-ПК AMD Ryzen AI Max+ 395 (128 ГБ) · мини-ПКRYZEN AI MAX (STRIX HALO)
Характеристики
Процессор
AMD Ryzen AI Max+ 395 (16 ядер Zen 5)
Графика
Radeon 8060S (RDNA 3.5, 40 CU)
NPU
XDNA 2, ~50 TOPS (INT8)
Память
до 128 ГБ LPDDR5X, унифицированная
Под видеопамять
до ~96 ГБ выделяемо для iGPU
Локальные модели
LLM до ~70B в 4-битном квантовании
Форм-фактор
мини-ПК (настольный)
Энергопотребление
~120 Вт
Происхождение
США (чип) / сборка (параллельный импорт)
Назначение и задачи
Приватный локальный запуск LLM и ассистентов без облака: разработка, отладка промптов, инференс моделей до ~70B в квантовании, RAG на своих данных. Большой объём унифицированной памяти важнее пиковой скорости — это ниша, где обычная видеокарта на 24 ГБ не тянет крупную модель. Как запустить — см. гайд как запустить LLM локально.
Условия поставки
Поставка под заказ через поставщиков-партнёров по параллельному импорту. Подбираем конфигурацию памяти и накопителя; поставка отдельным мини-ПК. Договор, оплата и гарантия — напрямую между вами и поставщиком; мы подбираем конфигурацию и проверяем соответствие требованиям.
СТАТУС ЛЕГАЛЬНОСТИ · 2026
Ввоз в РФ по параллельному импорту (легально в РФ).
За счёт до 128 ГБ унифицированной памяти (до ~96 ГБ под iGPU) он запускает модели до ~70B в 4-битном квантовании локально — то, что не помещается в обычную видеокарту на 24 ГБ. Скорость ниже, чем у дискретного GPU, но модель целиком в памяти.
Приватность (данные не уходят наружу), отсутствие абонентской платы и работа офлайн. Для постоянной тяжёлой нагрузки выгоднее сервер или аренда, для приватной работы с моделями — локальная станция.
Нет. Память унифицированная и медленнее HBM/GDDR дискретного GPU, поэтому скорость генерации ниже. Плюс в том, что крупная модель целиком помещается в память по цене мини-ПК.
DGX Spark — настольный ИИ-суперкомпьютер NVIDIA на Grace Blackwell с более высокой пропускной способностью и стеком CUDA; мини-ПК на Ryzen дешевле и работает на стеке ROCm/Vulkan. Выбор по бюджету и экосистеме.
Ориентировочно от $2 000 за конфигурацию 128 ГБ; поставка по параллельному импорту. Точная цена — по запросу под комплектацию.
llama.cpp, Ollama, LM Studio и совместимые — с ускорением через ROCm/Vulkan и NPU. Подскажем стек под ваши модели; подробности — в гайде по локальному запуску LLM.