Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

Релиз Accelerate и Axolotl: нативная поддержка многомерного параллелизма (ND-Parallel) для масштабного обучения LLM

Инсайт ServerSales • Влияние на рынок

Упрощение настройки ND-параллелизма в Accelerate и Axolotl убирает главный инфраструктурный барьер при масштабировании тренировки LLM на мультинодовых кластерах.

Hugging Face обновили библиотеку Accelerate и фреймворк Axolotl, добавив удобную конфигурацию многомерного параллелизма (ND-Parallelism) через класс `ParallelismConfig`. Инструмент позволяет на лету комбинировать ключевые стратегии распределения нагрузки для обучения тяжелых языковых моделей на кластерах из десятков и сотен GPU. ### Главные технические особенности обновления: - Гибкая композиция: Настройка степеней параллелизма в несколько строк кода (`dp_shard_size`, `dp_replicate_size`, `cp_size`, `tp_size`). - Связка с FSDP v2: Нативная поддержка шардирования весов, градиентов и состояний оптимизатора (по аналогии с ZeRO-3) для моделей, которые не помещаются в память одного ускорителя. - Интеграция с Axolotl: Готовые конфигурационные файлы для быстрого старта дообучения (fine-tuning) крупных моделей вроде Llama-3.1-8B на кластерах с минимальным размером ворлда от 16 GPU (например, конфигурация `llama-3_1-8b-hsdp-tp.yaml`). - Оптимизация коммуникации: Снижение оверхеда на пересылку данных между узлами за счет грамотного подбора тензорного (TP), контекстного (CP) и дата-параллелизма (DP/HSDP). 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).

Где захостить и как запустить

Планируете развернуть Llama 3.3?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐ServeTheHomeAI-адаптация

Инвентаризация Intel Xeon 6+: анализ линейки Clearwater Forest на техпроцессе 18A и выбор оптимальных SKU

Intel переводит производство процессоров Xeon 6+ (Clearwater Forest) на передовой техпроцесс 18A и упаковку Foveros Direct 3D, выводя чипы на открытый рынок за пределы пула гиперскейлеров. Новая линейка с высокой плотностью E-ядер ориентирована на задачи с тяжелым параллелизмом, где критичны плотность вычислений и энергоэффективность. Линейка насчитывает всего четыре базовых SKU, но предлагает гибкие возможности конфигурирования через технологии энергопотребления. Главные инженерные особенности платформы Clearwater Forest: * **Единый набор функций:** вопреки старым практикам сегментации, Intel не урезает возможности младших моделей — все SKU поддерживают 2-сокетные конфигурации, 12 каналов памяти на сокет (DDR5 и MRDIMM) и 96 линий PCIe Gen5. * **Телеметрия AET:** новый инструмент Application Energy Telemetry позволяет мониторить энергопотребление ядер в разрезе конкретных приложений. * **Гибкость TDP (SST-PP):** флагманские модели (например, 288-ядерный Xeon 6990E+) поддерживают работу в двух режимах TDP. Высокий режим (до 450 Вт) дает пиковые частоты буста (до 2.8 ГГц на все ядра) для максимального throughput, тогда как пониженный профиль оптимизирует плотность киловатт на стойку в дата-центре. При проектировании плотных серверных стоек под Clearwater Forest критически важно учитывать соотношение ядер к каналам памяти и тепловыделение VRM материнских плат. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Выход Clearwater Forest на техпроцессе 18A открывает доступ к плотным x86-кластерам с 288 ядрами на сокет, заставляя инженеров заново пересчитывать требования к питанию и охлаждению серверных стоек.
🌐PhoronixAI-адаптация

Linux получает патчи для 144-ядерного ARM-процессора Fujitsu MONAKA

Разработчики начали интеграцию программных обходных путей (workarounds) в ядро Linux для нового серверного ARM-процессора Fujitsu MONAKA, анонсированного месяц назад. Чип позиционируется как мощное решение для инфраструктуры искусственного интеллекта и дата-центров, предлагающее впечатляющие 144 вычислительных ядра на базе архитектуры ARM. Процесс подготовки софта к релизу MONAKA ведется уже около двух лет — ранее патчи для поддержки процессора появлялись в компиляторе GCC и других ключевых open-source компонентах. Появление патчей для ядра Linux говорит о том, что кремний переходит в финальную стадию готовности к реальным нагрузкам и развертыванию на «железе». Основные технические особенности обновления: * Интеграция специфичных для кремния Fujitsu испровлений в подсистему ядра Linux. * Подготовка инфраструктуры под 144-ядерные ARM-чипы высокой плотности. * Фокус на оптимизацию под ИИ-нагрузки и плотные вычисления. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Подготовка ядра Linux к поддержке Fujitsu MONAKA знаменует выход нового 144-ядерного ARM-игрока на рынок серверного железа для дата-центров и ИИ.
#Серверы#ИИ_и_GPU
Дайджест ServerSalesЧитать на источнике
🇷🇺Хабр / Хостинг

Шрифты, CDN и хостинг: трансграничная передача, которую никто не замечает

Я делаю сервис, через который проходят чужие договоры, поэтому к 152-ФЗ отношусь внимательнее многих. Документы, формы, вход - всё уходит на сервер в России, это я проверял не раз. А на прошлой неделе решил проверить не сервис, а сам сайт - просто посмотреть, к каким доменам обращается браузер, когда человек открывает главную. Нашёл три иностранных компании. Ни одну из них я туда сознательно не звал. Читать далее 💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).