Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

RapidFire AI: ускорение fine-tuning через TRL в 20 раз за счет параллельного прогона конфигураций

Инсайт ServerSales • Влияние на рынок

RapidFire AI кардинально ускоряет поиск оптимальных гиперпараметров для LLM, позволяя проводить десятки параллельных экспериментов на том же парке GPU без простоя оборудования.

Разработчики представили инструмент RapidFire AI, решающий главную боль ML-инженеров при дообучении языковых моделей (LLM) — колоссальные затраты времени и GPU-ресурсов на последовательный перебор конфигураций. За счет адаптивного планирования на базе чанков (chunk-based scheduling) система позволяет запускать несколько TRL-конфигураций одновременно, в том числе на единственной видеокарте, обеспечивая до 24 раз более высокую скорость экспериментов. Главные технологические особенности RapidFire AI: * Дроп-ин обертки для TRL: Использование классов вроде `RFSFTConfig`, `RFDPOConfig` и `RFGRPOConfig` требует минимум правок в существующем коде. * Интерактивное управление (IC Ops): Дашборд на базе MLflow позволяет на лету останавливать, возобновлять, клонировать или модифицировать (с «теплым стартом» весов) зависшие или неэффективные раны без перезапуска задач. * Эффективный мульти-GPU шедулинг: Автоматическое распределение конфигураций по доступным графическим ускорителям через общую память (shared memory) с максимальной утилизацией железа. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐Data Center DynamicsAI-адаптация

Строительство гигаваттного ЦОД в Шотландии: дата-центр на базе бывшей АЭС с прямым питанием от возобновляемой энергии

Компания CX Tech подала официальную заявку на возведение масштабного кампуса дата-центров суммарной мощностью 1 ГВт на территории выведенной из эксплуатации атомной электростанции в Шотландии. Главная особенность проекта — использование технологии direct-wire (прямое подключение по выделенным линиям) к строящимся проектам возобновляемой энергетики, что позволяет обойти ограничения общей энергосети (grid congestion) и обеспечить бесперебойное «зеленое» питание для тяжелых ИИ-нагрузок и облачной инфраструктуры. Основные технические вызовы и особенности проекта: * **Энергетическая независимость:** Прямое подключение к генераторам ВИЭ снижает потери на трансформацию и передачу электроэнергии. * **Масштаб:** 1 ГВт мощности делает этот объект одним из крупнейших потенциальных хабов для размещения суперкомпьютеров и ЦОД в Европе. * **Инфраструктурная релокация:** Использование площадок бывших АЭС решает проблему доступности земельных участков с уже подведенными мощными коммуникациями и системами охлаждения. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Проекты ЦОД гигаваттного масштаба с прямым питанием от ВИЭ на базе бывших энергетических объектов задают новый тренд для обхода энергодефицита в индустрии.
🌐PhoronixAI-адаптация

Mesa очищает кодовую базу: старый драйвер Direct3D 10 UMD окончательно отправлен в архив

Проект Mesa продолжает избавляться от технического долга и редко используемых компонентов. Разработчики удалили из репозитория драйвер Direct3D 10 User-Mode Driver (d3d10umd), который появился еще в 2021 году как Gallium3D state tracker для работы в качестве Windows WDDM UMD драйвера (аналог Windows WARP с использованием LLVMpipe для софтверного рендеринга). За пять лет существования этот код практически не поддерживался и не находил реального применения в production-средах. Его удаление позволит снизить нагрузку на мейнтейнеров и упростить структуру исходного кода Mesa, сосредоточив усилия команды на более актуальных графических API и драйверах. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Удаление невостребованного кода D3D10 UMD снижает оверхед на поддержку и упрощает дальнейшую разработку графического стека Mesa.
🌐ServeTheHomeAI-адаптация

F5 BIG-IP Next для Kubernetes на DPU NVIDIA BlueField-3: разгружаем CPU в GPU-кластерах

Инфраструктурные инженеры F5 продемонстрировали работу программного стека доставки приложений и безопасности BIG-IP Next for Kubernetes (BNK), развернутого на базе SmartNIC/DPU NVIDIA BlueField-3. Решение устанавливается на периметре сети перед кластерами инференса и берет на себя маршрутизацию запросов к языковым моделям, токен-менеджмент (token governance), а также сетевую безопасность уровней L4–L7. Главная проблема классических архитектур — обработка сетевого трафика и проксирование съедают ценные процессорные ядра хостов, которые должны работать на инфраструктуру Kubernetes или отдаваться под вспомогательные задачи ИИ. Вынос логики F5 BNK на DPU BlueField-3 позволяет: * Полностью разгрузить хостовые CPU от сетевого оверхеда на границе кластера. * Эффективно управлять потоками входящих запросов к LLM (маршрутизация на уровне токенов). * Обеспечить высокую пропускную способность в плотных сетях со связностью 400Gbps/800Gbps. * Высвободить вычислительные мощности под полезную нагрузку в стойках с ускорителями NVIDIA H100. 💡 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Использование DPU NVIDIA BlueField-3 для сетевого стека F5 BNK позволяет избавиться от бутылочных горлышек на сетевом периметре ИИ-кластеров и сберечь ресурсы хостовых процессоров.