Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Кентино · Сервер с пользовательским ИИ

Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5

Платформа корпоративного уровня, собранная и протестированная в ЕС.

€56.600,00Без НДС · Стоимость доставки рассчитывается при оформлении заказа
В наличии — отправка со склада в ЕС.
ISO 9001 · сертифицированное оборудованиеСклад в ЕС и гарантияБолее 7 лет опыта работы в сфере корпоративного ИИ.Проверено на работоспособность перед отправкой.
Обзор
Доставка и гарантия

Кентино AI 192 Turin2U RTXPro6000 4000TOPS

192 ГБ ECC Blackwell Flagship Pair
2x RTX Pro 6000 Server Edition | EPYC Turin SP5 | 4000 TOPS INT8

4 000
INT8 TOPS
192 ГБ
ECC VRAM
Блэквелл
fp8 нативный
2 карт
минимальный TP

Две пассивные видеокарты RTX Pro 6000 Blackwell Server Edition — по 96 ГБ ECC каждая. Меньше накладных расходов на параллельное выполнение тензорных операций, чем в конфигурациях с 4 или 8 видеокартами. Флагманская пара для центров обработки данных на платформе Gen5/DDR5 2U с реальным резервированием питания 1+1.

Сервер для обработки инференции в стоечном исполнении 2U с двумя пассивными видеокартами RTX Pro 6000 Blackwell Server Edition (96 ГБ ECC GDDR7 на карту), одним процессором AMD EPYC 9335 Turin (32 ядра/64 потока, 3.0/4.4 ГГц), 512 ГБ DDR5-4800 ECC, 5.76 ТБ NVMe Gen5 для дата-центров и резервным блоком питания 1+1 мощностью 2.7 кВт 80+ Platinum CRPS. Цена от 56 600 евро без НДС. Для 70-битного bf16 и среднего размера MoE меньшее количество больших карт превосходит большее количество маленьких — параллельная обработка тензоров с использованием двух карт имеет минимальные накладные расходы на обмен данными, и каждая карта объемом 96 ГБ содержит полную копию большинства моделей.

Та же пара жестких дисков Blackwell объемом 192 ГБ, что и в нашей сборке Rome 4U, в компактном корпусе ASRock 2U для установки в стойку, с полноценной оперативной памятью Gen5 DDR5-4800 и настоящим резервным блоком питания 1+1 мощностью 2.7 кВт Platinum CRPS. Выбирайте эту сборку, когда важна плотность размещения в стойке, когда ваши грантовые или закупочные требования предписывают современную платформу PCIe 5.0 / DDR5, или когда резервное питание является обязательным требованием, а не дополнительной опцией.

Металлоизделия

Компонент XNUMX
Графические процессоры 2x NVIDIA RTX Pro 6000 Blackwell Server Edition 96 ГБ ECC GDDR7 (пассивный режим, 600 Вт, PCIe 5.0 x16, двухслотовый)
пул видеопамяти 192 ГБ ECC (96 ГБ x 2) — каждая карта вмещает автономную карту памяти модели 70B bf16.
ЦП AMD EPYC 9335 Turin (32 ядра/64 потока, 3.0/4.4 ГГц, 210 Вт, SP5, 128 линий PCIe 5.0, Zen5c, 256 МБ L3)
Материнская плата ASRock Rack 2U4G-GENOA/M3 (SP5, 4 слота PCIe 5.0 x16 для двухпроцессорных видеокарт, 8 модулей DDR5 1DPC, OCP 3.0, IPMI AST2600)
ОЗУ системы 512 ГБ DDR5-4800 ECC RDIMM (8 x 64 ГБ, 1 DPC в полностью заполненном состоянии — конфигурация с максимальной пропускной способностью)
Загрузка / хранилище Kioxia CD8-P 3.84 ТБ Gen5 U.3 (горячий уровень, 1 DWPD, скорость чтения ~12 ГБ/с) + Kioxia CD8-P 1.92 ТБ Gen5 U.3 (уровень загрузки ОС) — всего 5.76 ТБ Gen5 NVMe для дата-центров
Источник питания Резервирование 1+1, мощность 2.7 кВт, класс защиты 80+ Platinum CRPS (2 x 1350 Вт при 230 В) — подлинное резервирование N+1; один блок питания поддерживает полную нагрузку.
Шасси Корпус высотой 2U для установки в стойку, с направленным потоком воздуха спереди назад (вентиляторы 80 мм с высоким статическим давлением). Возможность круглосуточной работы.
Охлаждение Активный радиатор процессора SP5 + 3 фронтальных кулера 80x38 мм на вдув + 1 задний кулер 80x80 мм на выдув (рассчитан на 4-кратную пассивную тепловую нагрузку видеокарты; компоновка с двумя картами обеспечивает достаточный запас по тепловому режиму).
Cеть Материнская плата Intel X710-T2L с двумя слотами PCIe 10GBASE-T и разъемом OCP 3.0 для модернизации до 25/100 GbE.

Огибающая мощности

  • Потребляемая мощность видеокарты: 2 x 600 Вт = 1200 Вт
  • Суммарная мощность системы при полной нагрузке: ~4080 Вт
  • Конфигурация блока питания: резервный блок питания 1+1, 2 блока по 1350 Вт при 230 В (всего 2 блока по 700 Вт).
  • Запас по мощности: 44.1 % при типичной нагрузке на входные данные.
  • Подлинное резервирование N+1 — один блок питания поддерживает полную нагрузку при обработке данных; отсутствует риск отказа одного блока питания.

Топология полосы движения

Сквозное соединение PCIe Gen5 x16 — как хост, так и карта изначально работают в режиме Gen5. Прямое подключение к корневому комплексу, без коммутатора PCIe. Остается один однослотовый слот PCIe 5.0 x16 + один слот PCIe 5.0 x8 (сетевая карта занимает слот x8). Нет NVLink — прямое соединение между графическими процессорами через PCIe. Пропускная способность Gen5 устраняет ограничение пропускной способности хоста Gen4, присущее 4U-версии Rome.

Что вы можете запустить

Благодаря 192 ГБ видеопамяти ECC на двух картах Blackwell с поддержкой нативных fp8/fp4, это самый простой способ получить плотный поток 70 байт при bf16 и средний MoE. Два независимых потока по 70 байт — по одному на карту — или 200 байт MoE на обоих потоках с минимальными накладными расходами на двустороннюю передачу данных.

Магистерские программы (LLM) — текст / логическое мышление / программирование

Китайская граница

  • Qwen3 / Qwen3.5 (Alibaba): Qwen3-235B-A22B Q4 (~132 ГБ) с высокой пропускной способностью (~15-25 токена/с в одном потоке на двух картах); Qwen3-Coder-480B-A35B Q2 (~160 ГБ); Qwen3.5-122B-A10B fp8 (~75 ГБ); Qwen3-32B с высокой плотностью кадров в секунду (bf16) и огромным значением KV; QwQ-32B bf16
  • ДипСик: DeepSeek-V3/R1 Q2 (~215 ГБ с небольшим выделением оперативной памяти) — Blackwell работает с fp8 в нативном режиме; DeepSeek-R2 32B bf16 — два одновременных потока (по одному на карту).
  • GLM / Z.ai: GLM-4.5 / 4.6 / 4.7 Q4 (~177 ГБ) — лучшая конфигурация на этом уровне; GLM-4.5-Air fp8 или bf16 с огромным КВ.
  • Тенсент Хунюань: Hunyuan-Large Q3 (~160 ГБ) — 389B MoE с 256k ctx; Hunyuan-A13B fp8 native (~80 ГБ) с огромным KV
  • Другое: Baidu ERNIE-4.5-424B Q3 ​​(~180 ГБ); InternVL3.5-241B-A28B Q4 (~135 ГБ); MiniMax-M1 Q3 (~180 ГБ)

Западная граница

  • Мета Лама: Llama 3.3 70B bf16 на одной карте — два независимых одновременных потока по 70B (~20-30 токенов/с на поток); Llama 4 Scout bf16 (~218 ГБ, мало места); Llama 4 Maverick Q3 (~188 ГБ)
  • Мистраль: Mistral Large 2 / Pixtral Large / Devstral 2 123B Q6 (~88 ГБ) — одна карта памяти или bf16 на обеих; Mistral Small 3 — многопотоковая передача.
  • OpenAI (открытые веса): gpt-oss-120b MXFP4 native (80 ГБ) — помещается на ОДНОЙ карте, два независимых одновременных потока.
  • NVIDIA Nemotron: Llama-3.1-Nemotron Ultra 253B Q4 (~147 ГБ); Super 49B bf16 на одной карте
  • Другое: Cohere Command R+ 104B Q6 (~85 ГБ) на одной карте; Google Gemma 3 27B bf16, несколько одновременных потоков.

Модели языка видения

InternVL3.5-241B-A28B Q4 (~135 ГБ); Qwen3-VL-235B-A22B Q4; Qwen3-VL-32B bf16 (однокарточная система); Pixtral Large 124B bf16 или Q6; Llama 3.2 90B Vision bf16 (~180 ГБ); Molmo 72B bf16 (~144 ГБ); GLM-4.6V 106B fp8; Gemma 3 27B (мультимодальная система, 2-3 одновременных потока).

Генерация изображения

FLUX.1 [dev] bf16 несколько одновременных потоков; FLUX.1 Kontext [dev]; FLUX Tools; SD 3.5 Large bf16 одновременный; HunyuanImage-2.1 bf16 (~34 ГБ) x 2-4 одновременных; HunyuanImage-3.0 base (80B MoE, 13B активный) bf16 -- помещается на одной карте; HunyuanDiT; Kolors / Kolors 2.0; AuraFlow; OmniGen v1; PixArt-Sigma.

Генерация видео

Wan 2.2 MoE dual-expert bf16 full context — помещается на одной карте, два одновременных потока генерации; Wan 2.2 TI2V-5B; HunyuanVideo 13B bf16 оба экспертного уровня; HunyuanVideo 1.5; CogVideoX-5B bf16; Open-Sora 2.0 11B bf16; Mochi-1 bf16 (~42 ГБ); LTX-Video; Pyramid Flow; SVD / SV3D / SV4D; NVIDIA Cosmos Predict 2.

Аудио / Речь / TTS

  • АСР: Whisper v3 large / turbo (~50x в реальном времени); Parakeet-TDT; Canary 1B; Qwen3-ASR; SenseVoice
  • ТТС: CosyVoice 2/3; Kokoro 82M; XTTS v2; Stable Audio Open; Step-Audio-EditX
  • В реальном времени / S2S: Кютай Моши 7Б; Степ-Аудио 2 мини/R1; Qwen2.5-Омни-7Б
  • Музыка / Звуковые эффекты: MusicGen / AudioGen / Bark; SeamlessM4T v2

Обслуживание нескольких моделей/многопользовательского режима

  • Два независимых потока 70B — по одному на каждую карту, простейшая форма изоляции арендаторов.
  • Плотная структура 70B bf16 + поддерживающий стек — LLM на карте 1, изображения/видео/аудио на карте 2
  • 200 байт MoE на обеих картах — минимальные накладные расходы на параллельное выполнение тензоров (разделение на две части).
  • fp8-native frontier — семейство DeepSeek V3, Hunyuan-Large fp8 с собственными путями Blackwell.

Целевые рабочие нагрузки

  • Плотный вывод bf16 70B — две тензорные карты, работающие параллельно с минимальными накладными расходами, или одна модель на карту для потоковой обработки.
  • 100-150 млрд. MoE на Q4-Q6 (GLM-4.5-Air, Qwen3.5-122B-A10B, Hunyuan-A13B, Llama 4 Scout)
  • Вывод границ производительности, изначально реализованный в FP8 (семейство DeepSeek V3, Hunyuan, Llama 4) — Blackwell запускает fp8 изначально.
  • Для научных вычислений требуются вычислительные мощности NVMe Gen5 и память ECC, соответствующие уровню центров обработки данных.
  • Студия генерации изображений и видео в bf16 (Wan 2.2 T2V-A14B, HunyuanVideo 13B, FLUX.1 [dev])
  • Развертывание с ограничениями по плотности размещения в стойке — форм-фактор 2U по сравнению с эквивалентом 4U Rome при том же объеме видеопамяти.
  • Технические условия закупки предусматривают использование платформы PCIe 5.0 / DDR5 или резервного блока питания.

Измеренная производительность

Опубликованные данные | Технические характеристики NVIDIA RTX Pro 6000 Blackwell Server Edition + результаты тестов сообщества

эталонный тест Результат
Производительность каждой видеокарты INT8 TOPS (техническое описание NVIDIA) 2000 ТОПОВ
Суммарный INT8 TOPS (2 карты) 2000 ТОПОВ
Пропускная способность памяти на каждую карту ~1 800 ГБ/с, 96 ГБ ECC GDDR7
Лама 3.3 70B bf16 за карту (общее сообщество) 15-25 тыс./с однопотоковая обработка, 60-90 тыс./с пакетная обработка — ожидаемое улучшение производительности за счет оптимизации пути к памяти на стороне хоста Gen5 в потоковых пакетных нагрузках по сравнению с хостом Gen4.
Преимущество Gen5 на стороне хоста (одна плата на одном и том же кремниевом чипе) Технология PCIe 5.0 x16 обеспечивает сквозную передачу данных между хостом и устройством при потоковой пакетной обработке данных; задачи, требующие высокой вычислительной мощности, демонстрируют идентичную пропускную способность с задачами, выполняемыми на плате Gen4.
Двухкарточный тензорно-параллельный модуль 70B (сообщество) Ожидаемая пропускная способность одного потока составляет примерно 30-45 токов/с.
Blackwell fp8 native DeepSeek-V3 fp8, Hunyuan-A13B fp8 работают без повышающего преобразования bf16

Опубликованные внешние данные, измерения не проводились на оборудовании Kentino. Компания Kentino опубликует собственные результаты после первой сборки для заказчика.

Не идеально подходит для

  • Высокопроизводительное многопользовательское обслуживание — 4x L40 или 6x L4 обеспечивают более эффективное распределение запросов по большему количеству карт.
  • Большой кэш KV при очень длительных контекстных операциях — переход на Kentino AI 576 Genoa RTXPro6000 12000TOPS
  • Обучение — компания Kentino не продает ткани NVLink H-класса.
  • Расчет бюджета в этом пуле видеопамяти: сборка Rome Kentino AI 192 RTXPro6000 4000TOPS в форм-факторе 4U обойдется дешевле, если приемлемо использование процессоров Gen4 на стороне хоста и не требуется резервирование блока питания.

Гарантия и сроки поставки

2 лет
гарантия на детали
1 год
гарантия на работы
14-21 дней
время выполнения заказа

Гарантия NVIDIA OEM на 3 года для RTX Pro 6000 Server Edition + 36-месячная гарантия на корпус + гарантия на интеграцию Kentino. Сборка включает в себя сборку, настройку BIOS/прошивки, настройку IPMI, установку драйверов, тестирование на работоспособность и функциональную проверку. Срок выполнения заказа 14-21 рабочих дней указан для заказов дилеров на компоненты класса Turin; уточняется при размещении заказа.

Рекомендуемые дополнения

  • Расширение до конфигурации с 4 видеокартами — корпус изначально имеет 4 отсека для видеокарт (в текущей сборке используются 2 из 4), возможность модернизации до Kentino AI 384 Turin2U RTXPro6000 8000TOPS
  • Добавьте 25 Гбит/с Ethernet или 100 Гбит/с Ethernet через слот OCP 3.0 (вариант Mellanox ConnectX-5/6 OCP).
  • В двух оставшихся отсеках U.2 можно установить дополнительные накопители Kioxia CD8-P NVMe для RAID-массивов или временного хранения данных.
  • Для повышения ресурса памяти (3 разряда в сутки) обновите накопитель до Samsung PM1743 или Kioxia CM7-V.
  • Стойка на 24U + онлайн ИБП 5 кВА

Отправка осуществляется с нашего склада в ЕС. Для тяжелых товаров может потребоваться организация доставки — свяжитесь с нами для уточнения стоимости и сроков доставки. Ограниченная гарантия сроком на 2 года с расширенной поддержкой по возврату товара; доступна расширенная гарантия.

Это не совсем то, что вам нужно?

Расскажите нам о вашей рабочей нагрузке, и мы подберем для этой платформы параметры, соответствующие вашим реальным задачам — видеокарты, память, хранилище и система охлаждения.