Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

Hugging Face упростил сборку и обмен кастомными ядрами ROCm для ускорителей AMD

Инсайт ServerSales • Влияние на рынок

Новый инструмент от Hugging Face стандартизирует и упрощает разработку, тестирование и дистрибуцию кастомных GPU-ядер под ROCm и CUDA без ручной возни со сборочными зависимостями.

Hugging Face представил библиотеку для работы с кастомными ядрами (`kernels`), которая избавляет разработчиков и ML-инженеров от боли ручной сборки через CMake, борьбы с компилятором и проблемами ABI. Проект поддерживает бэкенды CUDA, ROCm, Metal и XPU, обеспечивая бесшовную интеграцию оптимизированных под конкретное железо операций прямо в PyTorch. Особый интерес в обновлении представляет поддержка производительных ядер для графических ускорителей AMD Instinct MI300X. В качестве референса разработчики выделили FP8 block-wise GEMM ядро от команды RadeonFlow (победитель AMD Developer Challenge 2025): * Формат данных: Использование низкоточной арифметики FP8 в спецификации `e4m3fnuz` (4 бита экспоненты, 3 бита мантиссы) для максимального прироста пропускной способности памяти. * Точность вычислений: Применение поблочного масштабирования (`a_scale` и `b_scale`) для нивелирования узкого динамического диапазона FP8 и сохранения точности инференса. * Практическая польза: Ускорение генерации матричных умножений без деградации качества моделей за счет грамотной работы с архитектурными особенностями AMD ROCm. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐Data Center DynamicsAI-адаптация

Интеграция чипов Cerebras в облако General Compute: ставка на беспрецедентный прирост скорости ИИ-инференса

Компания General Compute заключила многолетнее соглашение с Cerebras Systems, в рамках которого уникальные процессоры вафельного масштаба (Wafer-Scale Engine, WSE) будут развернуты в облачной инфраструктуре провайдера. Это партнерство нацелено на резкое ускорение рабочих нагрузок генеративного искусственного интеллекта и масштабного инференса крупных языковых моделей (LLM). Ключевые особенности и технические преимущества интеграции: - **Производительность чипов Cerebras:** Архитектура WSE объединяет вычислительные ядра и огромный объем кристальной памяти SRAM на одной кремниевой пластине, обеспечивая колоссальную пропускную способность памяти и скорость генерации токенов, недостижимую для стандартных кластеров на базе GPU. - **Снижение латентности:** Новая облачная платформа позволит разработчикам запускать ресурсоемкие ML-модели с минимальной задержкой, оптимизируя затраты на инфраструктуру при высоких нагрузках в продакшене. - **Масштабируемость:** Инфраструктура General Compute предоставит гибкий доступ к мощностям вафельного уровня без необходимости развертывать собственные стойки с экзотическим железом. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Появление систем вафельного масштаба Cerebras в публичных облаках дает инженерам мощную альтернативу GPU-кластерам для задач экстремального ИИ-инференса с ультранизкой задержкой.
🌐Data Center DynamicsAI-адаптация

NetworkOcean запускает плавучий дата-центр на солнечных батареях в заливе Сан-Франциско

Стартап NetworkOcean объявил о стратегическом пивоте: компания отказалась от концепции подводных дата-центров в пользу плавучих серверных ферм, полностью обеспечиваемых солнечной энергией. Новый объект развернут непосредственно в акватории залива Сан-Франциско и нацелен на решение ключевых проблем современной инфраструктуры ИИ — дефицита энергомощностей в традиционных ЦОД и дороговизны систем охлаждения. Основные технологические особенности плавучего дата-центра: * Питание исключительно за счет возобновляемой солнечной генерации, что позволяет снизить углеродный след тяжелых вычислений. * Использование природной воды для систем охлаждения, минимизирующее затраты на кондиционирование воздуха. * Подвижная архитектура, позволяющая масштабировать вычислительные мощности ближе к источникам генерации энергии. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Плавающие дата-центры на солнечной энергии открывают новый путь обхода энергетического кризиса в традиционных локациях ЦОД.
#ЦОД#Серверы#Охлаждение#Облако
🌐Data Center DynamicsAI-адаптация

Castle IT расширяет инфраструктуру: второй дата-центр во Франции

Французский провайдер колокейшн-услуг Castle IT объявил о строительстве своего второго дата-центра в коммуне Сент-Омер. Новый объект позволит компании существенно расширить клиентскую базу, предложить отказоустойчивые решения для регионального бизнеса и обеспечить более высокие стандарты размещения серверного оборудования. Проект направлен на удовлетворение растущего спроса на серверные мощности во Франции и создание геораспределенных кластеров для критически важных IT-систем. Современные инженерные системы нового ЦОДа спроектированы с учетом требований к энергоэффективности и плотности размещения стоек. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Расширение европейского рынка колокейшн дает компаниям новые возможности для геораспределенного резервирования критической инфраструктуры.