Kentino AI 192 Turin2U RTXPro6000 4000TOPS — 2× RTX Pro 6000 Blackwell Server Edition — 2U Turin SP5
Платформа корпоративного уровня, собранная и протестированная в ЕС.
Кентино AI 192 Turin2U RTXPro6000 4000TOPS
192 ГБ ECC Blackwell Flagship Pair
2x RTX Pro 6000 Server Edition | EPYC Turin SP5 | 4000 TOPS INT8
Две пассивные видеокарты RTX Pro 6000 Blackwell Server Edition — по 96 ГБ ECC каждая. Меньше накладных расходов на параллельное выполнение тензорных операций, чем в конфигурациях с 4 или 8 видеокартами. Флагманская пара для центров обработки данных на платформе Gen5/DDR5 2U с реальным резервированием питания 1+1.
Сервер для обработки инференции в стоечном исполнении 2U с двумя пассивными видеокартами RTX Pro 6000 Blackwell Server Edition (96 ГБ ECC GDDR7 на карту), одним процессором AMD EPYC 9335 Turin (32 ядра/64 потока, 3.0/4.4 ГГц), 512 ГБ DDR5-4800 ECC, 5.76 ТБ NVMe Gen5 для дата-центров и резервным блоком питания 1+1 мощностью 2.7 кВт 80+ Platinum CRPS. Цена от 56 600 евро без НДС. Для 70-битного bf16 и среднего размера MoE меньшее количество больших карт превосходит большее количество маленьких — параллельная обработка тензоров с использованием двух карт имеет минимальные накладные расходы на обмен данными, и каждая карта объемом 96 ГБ содержит полную копию большинства моделей.
Та же пара жестких дисков Blackwell объемом 192 ГБ, что и в нашей сборке Rome 4U, в компактном корпусе ASRock 2U для установки в стойку, с полноценной оперативной памятью Gen5 DDR5-4800 и настоящим резервным блоком питания 1+1 мощностью 2.7 кВт Platinum CRPS. Выбирайте эту сборку, когда важна плотность размещения в стойке, когда ваши грантовые или закупочные требования предписывают современную платформу PCIe 5.0 / DDR5, или когда резервное питание является обязательным требованием, а не дополнительной опцией.
Металлоизделия
| Компонент | XNUMX |
|---|---|
| Графические процессоры | 2x NVIDIA RTX Pro 6000 Blackwell Server Edition 96 ГБ ECC GDDR7 (пассивный режим, 600 Вт, PCIe 5.0 x16, двухслотовый) |
| пул видеопамяти | 192 ГБ ECC (96 ГБ x 2) — каждая карта вмещает автономную карту памяти модели 70B bf16. |
| ЦП | AMD EPYC 9335 Turin (32 ядра/64 потока, 3.0/4.4 ГГц, 210 Вт, SP5, 128 линий PCIe 5.0, Zen5c, 256 МБ L3) |
| Материнская плата | ASRock Rack 2U4G-GENOA/M3 (SP5, 4 слота PCIe 5.0 x16 для двухпроцессорных видеокарт, 8 модулей DDR5 1DPC, OCP 3.0, IPMI AST2600) |
| ОЗУ системы | 512 ГБ DDR5-4800 ECC RDIMM (8 x 64 ГБ, 1 DPC в полностью заполненном состоянии — конфигурация с максимальной пропускной способностью) |
| Загрузка / хранилище | Kioxia CD8-P 3.84 ТБ Gen5 U.3 (горячий уровень, 1 DWPD, скорость чтения ~12 ГБ/с) + Kioxia CD8-P 1.92 ТБ Gen5 U.3 (уровень загрузки ОС) — всего 5.76 ТБ Gen5 NVMe для дата-центров |
| Источник питания | Резервирование 1+1, мощность 2.7 кВт, класс защиты 80+ Platinum CRPS (2 x 1350 Вт при 230 В) — подлинное резервирование N+1; один блок питания поддерживает полную нагрузку. |
| Шасси | Корпус высотой 2U для установки в стойку, с направленным потоком воздуха спереди назад (вентиляторы 80 мм с высоким статическим давлением). Возможность круглосуточной работы. |
| Охлаждение | Активный радиатор процессора SP5 + 3 фронтальных кулера 80x38 мм на вдув + 1 задний кулер 80x80 мм на выдув (рассчитан на 4-кратную пассивную тепловую нагрузку видеокарты; компоновка с двумя картами обеспечивает достаточный запас по тепловому режиму). |
| Cеть | Материнская плата Intel X710-T2L с двумя слотами PCIe 10GBASE-T и разъемом OCP 3.0 для модернизации до 25/100 GbE. |
Огибающая мощности
- Потребляемая мощность видеокарты: 2 x 600 Вт = 1200 Вт
- Суммарная мощность системы при полной нагрузке: ~4080 Вт
- Конфигурация блока питания: резервный блок питания 1+1, 2 блока по 1350 Вт при 230 В (всего 2 блока по 700 Вт).
- Запас по мощности: 44.1 % при типичной нагрузке на входные данные.
- Подлинное резервирование N+1 — один блок питания поддерживает полную нагрузку при обработке данных; отсутствует риск отказа одного блока питания.
Топология полосы движения
Сквозное соединение PCIe Gen5 x16 — как хост, так и карта изначально работают в режиме Gen5. Прямое подключение к корневому комплексу, без коммутатора PCIe. Остается один однослотовый слот PCIe 5.0 x16 + один слот PCIe 5.0 x8 (сетевая карта занимает слот x8). Нет NVLink — прямое соединение между графическими процессорами через PCIe. Пропускная способность Gen5 устраняет ограничение пропускной способности хоста Gen4, присущее 4U-версии Rome.
Что вы можете запустить
Благодаря 192 ГБ видеопамяти ECC на двух картах Blackwell с поддержкой нативных fp8/fp4, это самый простой способ получить плотный поток 70 байт при bf16 и средний MoE. Два независимых потока по 70 байт — по одному на карту — или 200 байт MoE на обоих потоках с минимальными накладными расходами на двустороннюю передачу данных.
Магистерские программы (LLM) — текст / логическое мышление / программирование
Китайская граница
- Qwen3 / Qwen3.5 (Alibaba): Qwen3-235B-A22B Q4 (~132 ГБ) с высокой пропускной способностью (~15-25 токена/с в одном потоке на двух картах); Qwen3-Coder-480B-A35B Q2 (~160 ГБ); Qwen3.5-122B-A10B fp8 (~75 ГБ); Qwen3-32B с высокой плотностью кадров в секунду (bf16) и огромным значением KV; QwQ-32B bf16
- ДипСик: DeepSeek-V3/R1 Q2 (~215 ГБ с небольшим выделением оперативной памяти) — Blackwell работает с fp8 в нативном режиме; DeepSeek-R2 32B bf16 — два одновременных потока (по одному на карту).
- GLM / Z.ai: GLM-4.5 / 4.6 / 4.7 Q4 (~177 ГБ) — лучшая конфигурация на этом уровне; GLM-4.5-Air fp8 или bf16 с огромным КВ.
- Тенсент Хунюань: Hunyuan-Large Q3 (~160 ГБ) — 389B MoE с 256k ctx; Hunyuan-A13B fp8 native (~80 ГБ) с огромным KV
- Другое: Baidu ERNIE-4.5-424B Q3 (~180 ГБ); InternVL3.5-241B-A28B Q4 (~135 ГБ); MiniMax-M1 Q3 (~180 ГБ)
Западная граница
- Мета Лама: Llama 3.3 70B bf16 на одной карте — два независимых одновременных потока по 70B (~20-30 токенов/с на поток); Llama 4 Scout bf16 (~218 ГБ, мало места); Llama 4 Maverick Q3 (~188 ГБ)
- Мистраль: Mistral Large 2 / Pixtral Large / Devstral 2 123B Q6 (~88 ГБ) — одна карта памяти или bf16 на обеих; Mistral Small 3 — многопотоковая передача.
- OpenAI (открытые веса): gpt-oss-120b MXFP4 native (80 ГБ) — помещается на ОДНОЙ карте, два независимых одновременных потока.
- NVIDIA Nemotron: Llama-3.1-Nemotron Ultra 253B Q4 (~147 ГБ); Super 49B bf16 на одной карте
- Другое: Cohere Command R+ 104B Q6 (~85 ГБ) на одной карте; Google Gemma 3 27B bf16, несколько одновременных потоков.
Модели языка видения
InternVL3.5-241B-A28B Q4 (~135 ГБ); Qwen3-VL-235B-A22B Q4; Qwen3-VL-32B bf16 (однокарточная система); Pixtral Large 124B bf16 или Q6; Llama 3.2 90B Vision bf16 (~180 ГБ); Molmo 72B bf16 (~144 ГБ); GLM-4.6V 106B fp8; Gemma 3 27B (мультимодальная система, 2-3 одновременных потока).
Генерация изображения
FLUX.1 [dev] bf16 несколько одновременных потоков; FLUX.1 Kontext [dev]; FLUX Tools; SD 3.5 Large bf16 одновременный; HunyuanImage-2.1 bf16 (~34 ГБ) x 2-4 одновременных; HunyuanImage-3.0 base (80B MoE, 13B активный) bf16 -- помещается на одной карте; HunyuanDiT; Kolors / Kolors 2.0; AuraFlow; OmniGen v1; PixArt-Sigma.
Генерация видео
Wan 2.2 MoE dual-expert bf16 full context — помещается на одной карте, два одновременных потока генерации; Wan 2.2 TI2V-5B; HunyuanVideo 13B bf16 оба экспертного уровня; HunyuanVideo 1.5; CogVideoX-5B bf16; Open-Sora 2.0 11B bf16; Mochi-1 bf16 (~42 ГБ); LTX-Video; Pyramid Flow; SVD / SV3D / SV4D; NVIDIA Cosmos Predict 2.
Аудио / Речь / TTS
- АСР: Whisper v3 large / turbo (~50x в реальном времени); Parakeet-TDT; Canary 1B; Qwen3-ASR; SenseVoice
- ТТС: CosyVoice 2/3; Kokoro 82M; XTTS v2; Stable Audio Open; Step-Audio-EditX
- В реальном времени / S2S: Кютай Моши 7Б; Степ-Аудио 2 мини/R1; Qwen2.5-Омни-7Б
- Музыка / Звуковые эффекты: MusicGen / AudioGen / Bark; SeamlessM4T v2
Обслуживание нескольких моделей/многопользовательского режима
- Два независимых потока 70B — по одному на каждую карту, простейшая форма изоляции арендаторов.
- Плотная структура 70B bf16 + поддерживающий стек — LLM на карте 1, изображения/видео/аудио на карте 2
- 200 байт MoE на обеих картах — минимальные накладные расходы на параллельное выполнение тензоров (разделение на две части).
- fp8-native frontier — семейство DeepSeek V3, Hunyuan-Large fp8 с собственными путями Blackwell.
Целевые рабочие нагрузки
- Плотный вывод bf16 70B — две тензорные карты, работающие параллельно с минимальными накладными расходами, или одна модель на карту для потоковой обработки.
- 100-150 млрд. MoE на Q4-Q6 (GLM-4.5-Air, Qwen3.5-122B-A10B, Hunyuan-A13B, Llama 4 Scout)
- Вывод границ производительности, изначально реализованный в FP8 (семейство DeepSeek V3, Hunyuan, Llama 4) — Blackwell запускает fp8 изначально.
- Для научных вычислений требуются вычислительные мощности NVMe Gen5 и память ECC, соответствующие уровню центров обработки данных.
- Студия генерации изображений и видео в bf16 (Wan 2.2 T2V-A14B, HunyuanVideo 13B, FLUX.1 [dev])
- Развертывание с ограничениями по плотности размещения в стойке — форм-фактор 2U по сравнению с эквивалентом 4U Rome при том же объеме видеопамяти.
- Технические условия закупки предусматривают использование платформы PCIe 5.0 / DDR5 или резервного блока питания.
Измеренная производительность
Опубликованные данные | Технические характеристики NVIDIA RTX Pro 6000 Blackwell Server Edition + результаты тестов сообщества
| эталонный тест | Результат |
|---|---|
| Производительность каждой видеокарты INT8 TOPS (техническое описание NVIDIA) | 2000 ТОПОВ |
| Суммарный INT8 TOPS (2 карты) | 2000 ТОПОВ |
| Пропускная способность памяти на каждую карту | ~1 800 ГБ/с, 96 ГБ ECC GDDR7 |
| Лама 3.3 70B bf16 за карту (общее сообщество) | 15-25 тыс./с однопотоковая обработка, 60-90 тыс./с пакетная обработка — ожидаемое улучшение производительности за счет оптимизации пути к памяти на стороне хоста Gen5 в потоковых пакетных нагрузках по сравнению с хостом Gen4. |
| Преимущество Gen5 на стороне хоста (одна плата на одном и том же кремниевом чипе) | Технология PCIe 5.0 x16 обеспечивает сквозную передачу данных между хостом и устройством при потоковой пакетной обработке данных; задачи, требующие высокой вычислительной мощности, демонстрируют идентичную пропускную способность с задачами, выполняемыми на плате Gen4. |
| Двухкарточный тензорно-параллельный модуль 70B (сообщество) | Ожидаемая пропускная способность одного потока составляет примерно 30-45 токов/с. |
| Blackwell fp8 native | DeepSeek-V3 fp8, Hunyuan-A13B fp8 работают без повышающего преобразования bf16 |
Опубликованные внешние данные, измерения не проводились на оборудовании Kentino. Компания Kentino опубликует собственные результаты после первой сборки для заказчика.
Не идеально подходит для
- Высокопроизводительное многопользовательское обслуживание — 4x L40 или 6x L4 обеспечивают более эффективное распределение запросов по большему количеству карт.
- Большой кэш KV при очень длительных контекстных операциях — переход на Kentino AI 576 Genoa RTXPro6000 12000TOPS
- Обучение — компания Kentino не продает ткани NVLink H-класса.
- Расчет бюджета в этом пуле видеопамяти: сборка Rome Kentino AI 192 RTXPro6000 4000TOPS в форм-факторе 4U обойдется дешевле, если приемлемо использование процессоров Gen4 на стороне хоста и не требуется резервирование блока питания.
Гарантия и сроки поставки
Гарантия NVIDIA OEM на 3 года для RTX Pro 6000 Server Edition + 36-месячная гарантия на корпус + гарантия на интеграцию Kentino. Сборка включает в себя сборку, настройку BIOS/прошивки, настройку IPMI, установку драйверов, тестирование на работоспособность и функциональную проверку. Срок выполнения заказа 14-21 рабочих дней указан для заказов дилеров на компоненты класса Turin; уточняется при размещении заказа.
Рекомендуемые дополнения
- Расширение до конфигурации с 4 видеокартами — корпус изначально имеет 4 отсека для видеокарт (в текущей сборке используются 2 из 4), возможность модернизации до Kentino AI 384 Turin2U RTXPro6000 8000TOPS
- Добавьте 25 Гбит/с Ethernet или 100 Гбит/с Ethernet через слот OCP 3.0 (вариант Mellanox ConnectX-5/6 OCP).
- В двух оставшихся отсеках U.2 можно установить дополнительные накопители Kioxia CD8-P NVMe для RAID-массивов или временного хранения данных.
- Для повышения ресурса памяти (3 разряда в сутки) обновите накопитель до Samsung PM1743 или Kioxia CM7-V.
- Стойка на 24U + онлайн ИБП 5 кВА
Отправка осуществляется с нашего склада в ЕС. Для тяжелых товаров может потребоваться организация доставки — свяжитесь с нами для уточнения стоимости и сроков доставки. Ограниченная гарантия сроком на 2 года с расширенной поддержкой по возврату товара; доступна расширенная гарантия.
Это не совсем то, что вам нужно?
Расскажите нам о вашей рабочей нагрузке, и мы подберем для этой платформы параметры, соответствующие вашим реальным задачам — видеокарты, память, хранилище и система охлаждения.