Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

Семейство языковых моделей Granite 4.1: плотные архитектуры, 512K токенов контекста и Apache 2.0

Инсайт ServerSales • Влияние на рынок

Плотные модели Granite 4.1 с поддержкой контекста до 512K токенов предлагают enterprise-качество под лицензией Apache 2.0, снижая порог входа для локального инференса.

IBM представила семейство плотных трансформеров Granite 4.1, включающее модели на 3B, 8B и 30B параметров, обученные на 15 триллионах токенов. Главный фокус разработчиков сместился с простого наращивания вычислителей на жесткую фильтрацию данных и многоэтапный пайплайн обучения. Примечательно, что модель на 8B параметров (версия Instruct) обходит по метрикам более тяжелую 32-гигабайтную смесь экспертов Granite 4.0-H-Small, демонстрируя высокую эффективность плотных (dense) архитектур. Технические особенности Granite 4.1: * Архитектура: Decoder-only трансформер с Grouped Query Attention (GQA), Rotary Position Embeddings (RoPE), функциями активации SwiGLU, RMSNorm и общими входными/выходными эмбеддингами. * Контекстное окно: Расширение до 512K токенов на финальном этапе обучения (фаза LCE). * Пайплайн обучения: Пять последовательных фаз (от базового претрейна на 10T токенов и акцента на мат/код до анжигации качественных данных и долгого контекста). * Финальная доводка: Supervised Fine-Tuning на 4.1 млн кураторских сэмплов и RL с помощью on-policy GRPO с функцией потерь DAPO. Модели распространяются под свободной лицензией Apache 2.0, что делает их отличным кандидатом для корпоративного деплоя в локальные контуры. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐Data Center DynamicsAI-адаптация

Инвестиции в высокопроизводительное будущее: двухфазное иммерсионное охлаждение для трейдинга

Современные алгоритмические торговые системы и низколатентный трейдинг предъявляют экстремальные требования к серверному железу. Плотность размещения стоек постоянно растет, а традиционные воздушные системы охлаждения уже не справляются с отводом тепла от разогнанных CPU и GPU без критического оверхеда по энергии и шума. Переход на безводное двухфазное жидкостное охлаждение позволяет удерживать стабильные тактовые частоты без троттлинга даже при пиковых нагрузках на бирже. Ключевые преимущества двухфазного охлаждения для высоконагруженных серверных стоек: - **Нулевой риск протечек:** использование диэлектрических жидкостей с низкой температурой кипения исключает короткие замыкания при разгерметизации. - **Максимальная плотность:** эффективный отвод тепла позволяет уплотнять стойки, сокращая требования к площади машинного зала ЦОД. - **Энергоэффективность:** снижение PUE (Power Usage Effectiveness) за счет отказа от мощных вентиляторных групп. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Двухфазное иммерсионное охлаждение становится критическим фактором для поддержания стабильного и низколатентного тикинга в сверхплотных серверных стойках.
🌐ServeTheHomeAI-адаптация

NVIDIA представила Open Agent Safety Platform: изоляция ИИ-агентов на уровне ядра и BlueField-4 DPU

NVIDIA выкатила платформу безопасности Open Agent Safety Platform, призванную обуздать автономных ИИ-агентов и снизить риски неконтролируемого поведения моделей вроде Claude Code, Codex или Hermes. Ключевым элементом экосистемы стал открытый рантайм **OpenShell 0.1.0**, который не заменяет существующие фреймворки, а оборачивает их выполнение в изолированные песочницы с контролем на уровне ОС. Архитектура и возможности OpenShell: - **Изоляция песочниц:** Процесс-супервайзер инспектирует исходящий HTTP, GraphQL и MCP-трафик, а файловая система и процессы жестко ограничиваются на уровне ядра Linux. - **Декларативные политики:** Правила пишутся на YAML, компилируются в OPA Rego и позволяют тонко настраивать права (например, разрешить чтение репозиториев на GitHub при полном блокировании записи). - **Защита учетных данных:** Секреты хранятся вне рабочей нагрузки агента, а сетевые вызовы блокируются на уровне ядра, если песочница не имеет соответствующих прав. - **Аппаратное ускорение через NVIDIA Sentry:** На уровне железа защита масштабируется с помощью чипов NVIDIA Sentry, работающих на базе DPU BlueField-4 в системах Vera Rubin POD и интегрированных через NVIDIA DOCA для аудита и мониторинга. Проект уже поддержали более 100 компаний из экосистемы NVIDIA, что подчеркивает растущую боль администраторов с безопасностью автономных агентов, способных часами пытаться обойти ограничения в ходе тестов. ⚙️ Выбор хостинга: Подобрать надежный сервер с фильтром по 152-ФЗ, нужным локациям и Anti-DDoS защите можно через быстрый подбор на ServerSales (/wizard).

💡 Инсайт:Платформа NVIDIA OpenShell и DPU BlueField-4 переносят безопасность автономных ИИ-агентов на уровень ядра ОС и железа, закрывая критические бреши в корпоративных инсталляциях.
🌐PhoronixAI-адаптация

NVIDIA разрабатывает Display Config Server: новый подход к управлению видеостенами на Linux и Wayland

NVIDIA анонсировала разработку Display Config Server — специализированного решения, призванного упростить настройку и управление сложными конфигурациями дисплеев (видеостенами) в Linux-средах. Основной фокус сделан на улучшении работы с протоколом Wayland, который до сих пор вызывает сложности при масштабировании контента на несколько физических панелей. Ключевые аспекты проекта: * **Унификация управления:** Инструмент нацелен на устранение фрагментации при настройке многомониторных систем, что критично для профессиональных визуализационных комплексов. * **Оптимизация под Wayland:** Переход от устаревшего X11 к Wayland требует новых механизмов обработки композитинга, и Display Config Server должен закрыть этот пробел для enterprise-сегмента. * **Фокус на стабильность:** Решение направлено на повышение надежности отрисовки в высоконагруженных графических системах, где требуется синхронизация между множеством GPU и дисплеев. 🔍 Как выбрать сервер: Если вы планируете развертывание систем визуализации или высокопроизводительных графических станций, подобрать актуальные конфигурации серверов с поддержкой профессиональных GPU NVIDIA и найти оптимальные цены от проверенных провайдеров можно в каталоге ServerSales (/catalog).

💡 Инсайт:NVIDIA делает важный шаг к стандартизации управления видеостенами на Linux, что снизит порог входа для эксплуатации сложных графических систем на базе Wayland.