Hugging Face представила @huggingface/kernels: коллекция из 207 WebGPU-ядер для локального ИИ в браузере
Выпуск @huggingface/kernels закладывает надежный фундамент для быстрого инференса ИИ в браузере через оптимизацию низкоуровневых WebGPU-операций.
Hugging Face выкатила библиотеку `@huggingface/kernels` и масштабную коллекцию из 207 оптимизированных WebGPU-ядер для запуска локального инференса прямо в браузере. Каждое ядро поставляется как автономный версионируемый пакет на Hub с готовыми WGSL-шейдерами, тестами корректности и бенчмарками. Вместе с библиотекой запущен инструмент Fleet — браузерная система краудсорсинг-бенчмаркинга для сбора телеметрии о производительности GPU на реальном железе. Главные инженерные особенности релиза: * Портативность и контроль: WebGPU выступает единым стандартом, но производительность шейдеров сильно зависит от архитектуры GPU, размеров рабочие групп и паттернов доступа к памяти. Новая библиотека позволяет точечно оптимизировать фундамент под разные чипы. * Прозрачность контрактов: Каждое ядро снабжено подробной картой с описанием поддерживаемых типов данных, атрибутов и входных/выходных шейпов тензоров. * Краудсорсинг оптимизаций: Инструмент Fleet позволяет собирать метрики и выявлять узкие места на огромном парке потребительских устройств, что недоступно в рамках стандартных тестовых лабораторий. 💡 Как выбрать сервер: Если вам требуется развернуть полноценный серверный инференс тяжелых языковых моделей, а не клиентские сценарии в браузере, подобрать оптимальную конфигурацию с профессиональными GPU (NVIDIA H100, A100, L40S) под ваши задачи можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).
Планируете развернуть эту нейросеть?
На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.
Надежные облачные платформы и серверы в РФ
Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.
Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.
Hostkey
GPU RTX 3090 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 3090 (24 ГБ GDDR6X)
24 999 ₽/мес
Timeweb Cloud
GPU RTX A5000 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX A5000 (24 ГБ GDDR6X)
24 999 ₽/мес
Hostkey
GPU RTX 4090 24GB
CPU
16 ядер
RAM
128 ГБ
Диск
1000 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 4090 (24 ГБ GDDR6X)
32 999 ₽/мес
Ищете точную конфигурацию под ваш бюджет?
Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.