Ко всем новостям
🇷🇺ServerNewsAI-адаптировано

Обзор сервера ASUS RS720A-E13-RS8G: DC-MHS во всей красе

Два AMD EPYC Turin, три полноценных GPU, пара высокоскоростных NIC, восемь NVMe SSD, RAID и что-нибудь ещё — всё с PCIe 5.0 и всё в 2U-шасси. Встречайте универсальный HPC/ИИ-сервер ASUS RS720A-E13-RS8G, модульный и современный! ASUS RS720A-E13-RS8G с поддержкой AMD EPYC 9005 ( Turin ) и 9004 ( Genoa / Genoa-X/Bergamo ) относится к современному поколению модульных серверов DC-MHS , которые архитектурно заметно отличаются от своих «монолитных» предшественников. Спецификации DC-MHS ориентированы на механическую, электрическую и логическую совместимость различных компонентов, отказ от устаревших и проприетарных решений, а также предоставление большего контроля над платформой конечному пользователю. В рамках OCP это подразумевает в том числе взаимозаменяемость компонентов различных вендоров, что интересно крупным игрокам. Для отдельного вендора это может означать большую гибкость в формировании и обновлении модельного ряда серверов. А для отдельного пользователя — возможность выбора и универсальность платформы. Движение в эту сторону началось не сегодня. Например, модули OCP 3.0 благополучно вытеснили LOM’ы. Теперь настал черёд внедрения DC-SCM — стандартизированных карт, которые «уносят» BMC, PFR, TPM, прошивку и т. д. с материнских плат. Строго говоря, и модули OCP 3.0 вовсе не обязательно должны быть связаны только с сетью. В таком формате выпускаются и RAID/HBA-контроллеры на замену проприетарным решениям разных вендоров. x16-слоты для райзеров тоже стандартизированные. В целом спецификации DC-MHS охватывают довольно много аспектов , но отдельно останавливаться на них не будем. ASUS RS720A-E13-RS8G, несмотря на высоту 2U и вполне стандартные габариты (485 × 88 × 822 мм), имеет довольно плотную компоновку (M-FLW) и хорошие возможности расширения. Задняя часть машины условно делится на два «этажа». На первом по бокам находятся два (1+1) БП мощностью 2000/2700/3200 Вт класса 80+ Titanium. Между ними снизу есть два слота OCP 3.0 SFF (PCIe 5.0 x16) и предустановленный модуль ASUS ASMB12-iKVM (о нём чуть ниже). Над OCP-слотами находятся два слота PCIe 5.0 x16 для однослотовых FHHL-карт. Если надумаете поставить туда RAID/HBA, то на воздуховоде предусмотрительно сделана площадка для крепления «батарейки». На втором «этаже» есть место для трёх двухслотовых FHFL-карт PCIe 5.0 x16 (до 400 Вт каждая), но райзеры несут два слота, так что можно установить и по паре x8-карт. На этих райзерах есть разъёмы питания 12VHPWR. Три левых слота для райзеров и левый же слот OCP 3.0 идут к одному процессору, оставшиеся слоты справа, а также пара коннекторов MCIO x8 (PCIe 5.0) — к другому. Сами CPU между собой объединены тремя x16-линками xGMI. В задней части платы также есть колодка для COM-порта, порт USB 3.0 Type-A и двухсимвольный сегментный индикатор Q-Code. В передней части платы, поближе к дисковой корзине, есть ещё четыре MCIO x8. Бэкплейн имеет те же четыре MCIO x8 и пару SlimSAS-разъёмов. В качестве RAID предлагается не только поддержка традиционных контроллеров от Broadcom, но и GRAID SupremeRAID — соответствующий раздел есть в BIOS. Слоты для пары NVMe SSD (PCIe 3.0 x4 каждый, но от разных CPU) типоразмера M.2 22110/2280/2260 находятся на вертикально устанавливаемой планке, которая размещается ровно посередине между двумя соседними рядами DIMM слотов по центру платы — и места занимает меньше, и обдувается лучше. Причём планку даже на закрывают довольно массивные EVAC-кулеры процессоров (TDP до 400 Вт). Слотов для памяти здесь 24 шт., по 12 на каждый CPU (1DPC), с поддержкой модулей вплоть до DDR5-6400. За охлаждение отвечают шесть двухроторных быстросъёмных вентиляторов (блок с ними тоже можно вынуть целиком). Дисковая корзина ASUS RS720A-E13-RS8G рассчитана на восемь U.2-накопителей, но есть и близкородственные модели с 12×LFF и 24×SFF. На левое ушко шасси вынесены два порта USB 3.0 Type-A, на правое — кнопки питания, сброса и ID, а также пара индикаторов. Лотки накопителей также оснащены парой индикаторов. Имеется и датчик открытия верхней крышки. Что важно (и удобно), практически все компоненты не требуют наличия отвёртки для доступа или установки. Механически шасси скроено хорошо и аккуратно, и работать с ним приятно. Да и сама материнская плата «чистая» и аккуратная — количество разъёмов, чипов и джамперов минимально. И это неудивительно, поскольку, как и было сказано выше, управляющая логика вынесена на отдельную карту ASMB12-iKVM. Вот здесь как раз и расположен BMC (ASPEED AST2600 ), разъём под TPM, слот micro SD (для хранения логов), а также, в данном случае, отдельная платка со SPI-памятью, ответственная за функцию Dual BIOS. На заднюю часть модуля вынесены 1GbE-порт RJ45 для OOB-управления, пара портов USB 3.0 Type-A, видеовыход mini-DP, а также кнопка-индикатор ID и кнопка питания. 💡 Где захостить и как запустить: рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на ServerSales в интерактивном подборщике AI-моделей или каталоге GPU-серверов.

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании ServerNews.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на ServerNews
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🇷🇺Хабр / Хостинг

Сколько ресурсов ест ИИ‑агент на сервере: замеры на двадцати агентах

Год назад я поднял первого агента на сервере и закладывал память как под обычный скрипт. Через месяц на той же машине жило двадцать, а ещё через неделю она легла целиком. Ниже — цифры, которые я снял на живых машинах, и три ошибки, каждая из которых стоила мне рабочего дня. Это не обзор хостингов. Это замеры своего хозяйства: сколько на самом деле ест агент, почему разброс в семь раз и что ломается раньше памяти. Читать далее 💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).

🌐Hugging Face Blog

**Знайте, кто когда говорил: создайте искусственный интеллект с несколькими говорящими в реальном времени с помощью NVIDIA Nemotron 3 Diarization**

Рассмотрим стенограмму встречи, разговора с клиентом или подкаста, в которой каждое предложение верно, но ни одно из них не приписано говорящему. Вы можете прочитать слова, но не можете достоверно сказать, кто взял на себя обязательство, кто высказал возражение или какой участник перебил. Поиск, сводки, действия, аналитика разговоров и память голосового агента становятся менее полезными. Диаризация говорящих определяет временные интервалы, в течение которых каждый говорящий активен, включая интервалы, когда люди переговариваются друг с другом. Эти временные метки говорящего затем можно объединить с автоматическим распознаванием речи (ASR) для создания стенограммы, приписываемой говорящему. NVIDIA Nemotron 3 Diarization is an open-weight, 100M-parameter model that ranks #1 on VoiceArena's Diarization-Bench leaderboard with a 14.72% Diarization Error Rate (DER). Supporting up to eight speakers across live and recorded conversations, it handles overlapping speech, chunked processing for flexible recording lengths, and customizable streaming latency. Рисунок 1. Nemotron 3 Diarization №1 в таблице лидеров VoiceArena Diarization-Bench. Earlier models like NVIDIA Streaming Sortformer established this approach for four-speaker diarization, including the streaming diar_streaming_sortformer_4spk-v2.1 checkpoint used as the baseline below. Nemotron 3 Diarization расширяет поддержку до восьми динамиков и повышает точность и пропускную способность, измеренную в следующих оценках. Как работает Nemotron 3 Диаризация Одна модель для оффлайн и потоковых разговоров Системы диаризации должны решать две взаимосвязанные проблемы. Во-первых, они должны распознать речь и назначить ее нужному говорящему. Second, they must preserve that assignment throughout the conversation, even after silence, interruptions, or long gaps between a speaker's turns. Потоковая передача усложняет вторую проблему. Автономная модель может проверить всю запись сразу. Потоковая система получает лишь небольшой фрагмент нового аудио и ограниченный контекст. Without an effective memory mechanism, the speaker assigned to one output channel in the current chunk can be assigned to a different channel in the next. Nemotron 3 Diarization следует подходу Sortformer, который упорядочивает выходные динамики по времени их первого появления. Первый новый голос становится первым каналом динамика, следующий новый голос становится вторым и так далее. This arrival-time ordering makes the model's generic speaker labels stable and removes the need to solve a new speaker permutation for every chunk. 💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).

🌐Data Center DynamicsAI-адаптация

Техас тормозит дата-центры: власти приостановили выдачу разрешений под аудит ERCOT

Губернатор Техаса Грег Эбботт распорядился временно заморозить выдачу новых разрешений на подключение крупных дата-центров к электросетям штата. Причиной стал масштабный аудит энергосистемы, который проводит техасский системный оператор ERCOT (Electric Reliability Council of Texas). Энергетическая инфраструктура региона испытывает экстремальные нагрузки из-за лавинообразного роста числа ЦОД, ориентированных на облачные вычисления и тяжелые AI-нагрузки. Проверка ERCOT должна оценить реальные резервы мощности и предотвратить дефицит электроэнергии в пиковые периоды. Завершение аудита и публикация отчета запланированы на декабрь текущего года. * **Причины моратория:** Дефицит свободных мощностей в сети ERCOT на фоне бурного строительства дата-центров. * **Сроки:** Заморозка разрешений действует до завершения проверки в декабре. * **Влияние на рынок:** Задержка ввода в эксплуатацию новых серверных площадок и необходимость пересмотра графиков деплоя инфраструктуры. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Энергетический кризис в ключевых хабах дата-центров тормозит масштабирование инфраструктуры и заставляет операторов пересматривать географию новых проектов.