Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

Hugging Face TGI добавляет нативную поддержку чипов Intel Gaudi: конец эпохи форков

Инсайт ServerSales • Влияние на рынок

Интеграция Intel Gaudi в основной репозиторий TGI упрощает поддержку LLM на альтернативных GPU и снижает порог входа для гетерогенных дата-центров.

Разработчики Hugging Face завершили интеграцию поддержки ускорителей Intel Gaudi непосредственно в основную кодовую базу Text Generation Inference (TGI). Ранее проект tgi-gaudi развивался как отдельный форк, что создавало лишнюю головную боль при развертывании и задерживало доступ к свежим фичам. Благодаря новой мультибэкенд-архитектуре TGI, запуск инференса на оборудовании Intel теперь происходит «из коробки» без костылей и кастомных репозиториев. Главные технологические изменения и особенности релиза: * Отказ от форка: Полное слияние с мейнстрим-веткой TGI в рамках PR #3091. * Оптимизированные модели: Адаптированные под специфику чипов Gaudi конфигурации для работы как на одиночных ускорителях, так и в многочиповых (multi-card) контурах. * Простой деплой: Использование официальных Docker-образов с рантаймом habana и флагом `--runtime=habana` для быстрой инициализации. 💡 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐Data Center DynamicsAI-адаптация

Boost Run привлекает контракт на $525,6 млн от Cohere для расширения облачной GPU-инфраструктуры

Игрок облачного рынка ИИ компания Boost Run заключила масштабный контракт на сумму $525,6 млн с разработчиком корпоративных языковых моделей Cohere. В рамках сделки инфраструктурный провайдер предоставит выделенные вычислительные мощности на базе высокопроизводительных графических ускорителей для обучения и развертывания генеративных моделей. Данное соглашение подчеркивает растущий тренд на децентрализацию облачных вычислений для ИИ и конкуренцию между альтернативными провайдерами и гиперскейлерами. Для обеспечения подобных нагрузок требуются плотные серверные стойки с эффективным жидкостным или мощным воздушным охлаждением, высокой пропускной способностью сети (InfiniBand/RoCE) и гарантированным SLA. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Многомиллионные контракты на специализированные GPU-облака подтверждают дефицит и высокую востребованность выделенной серверной инфраструктуры под корпоративные ИИ-нагрузки.
🌐PhoronixAI-адаптация

Инфраструктурный сбой: Официальные ресурсы Ubuntu столкнулись с мощной DDoS-атакой

Сегодня пользователи столкнулись с недоступностью официальных ресурсов Canonical: сайт Ubuntu, зеркала загрузки ISO-образов и сопутствующие сервисы работают с перебоями из-за масштабной распределенной атаки типа «отказ в обслуживании» (DDoS). Инженеры компании оперативно задействовали механизмы защиты и ведут работы по фильтрации вредоносного трафика. Подобные инциденты в очередной раз подчеркивают критическую важность отказоустойчивости сетевой инфраструктуры, наличия геораспределенных зеркал и продвинутых систем фильтрации трафика уровня L7. Для инфраструктурных инженеров и сисадминов это хороший повод проверить актуальность локальных кэширующих прокси-серверов и внутренних зеркал репозиториев, чтобы не зависеть от доступности внешних ресурсов Canonical в критический момент развертывания. ⚙️ Выбор хостинга: Подобрать надежный сервер с фильтром по 152-ФЗ, нужным локациям и Anti-DDoS защите можно через быстрый подбор на ServerSales (/wizard).

💡 Инсайт:Масштабная DDoS-атака на экосистему Ubuntu нарушила доступ к ISO-образам и сайту, подчеркнув необходимость локальных зеркал репозиториев и продвинутой Anti-DDoS защиты.
#Безопасность#Облако#Серверы
Дайджест ServerSalesЧитать на источнике
🌐PhoronixAI-адаптация

Тестирование Ubuntu 26.10 на AMD EPYC Turin: заметный прирост производительности дисковой подсистемы

Выход промежуточных версий дистрибутивов вроде Ubuntu 26.10 редко привлекает внимание энтерпрайз-сегмента, ориентированного на LTS-релизы. Однако свежие тесты на процессорах 5-го поколения AMD EPYC (архитектура Turin) демонстрируют приятный сюрприз: новая ОС показывает ощутимый рост производительности операций ввода-вывода (I/O) по сравнению с прошлогодней Ubuntu 26.04 LTS. Основные улучшения затрагивают работу с высокопроизводительными NVMe-накопителями и оптимизацию планировщика под многоядерные архитектуры AMD. Это снижает оверхед при пиковых нагрузках на дисковую подсистему, что критично для баз данных, систем кеширования и распределенных хранилищ. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Промежуточный релиз Ubuntu 26.10 демонстрирует сильный прирост I/O на железе AMD EPYC Turin, что делает его перспективным для высоконагруженных тестовых сред.
#Серверы#AMD_EPYC
Дайджест ServerSalesЧитать на источнике