Релиз Llama Guard 4 и Prompt Guard 2: мультимодальный секьюрити-фильтр и защита от джейлбрейков
Llama Guard 4 позволяет развернуть эффективную мультимодальную фильтрацию входящих промптов и исходящих ответов LLM на одной потребительской или серверной GPU с 24 ГБ VRAM, минимизируя риски джейлбрейков.
Meta* представила линейку инструментов безопасности для продакшн-контуров: мультимодальную модель Llama Guard 4 (12B) и классификаторы Llama Prompt Guard 2 (86M и 22M параметров). Новинки созданы для фильтрации токсичного контента, промпт-инъекций и джейлбрейков в текстовых и визуальных пайплайнах. Технические особенности Llama Guard 4: - Архитектура: Плотная (dense) модель на 12 млрд параметров, полученная путем прунинга MoE-модели Llama 4 Scout (оставлен только разделяемый эксперт без routed-слоев). - Аппаратные требования (VRAM): Для инференса достаточно одной видеокарты с 24 ГБ VRAM (например, NVIDIA RTX 3090/4090 или серверных A10G / L4). - Мультимодальность: Анализ до 5 изображений на один запрос + текстовый контекст (соотношение обучающих данных 3:1 в пользу текста). - Таксономия угроз: Распознавание 14 типов опасностей по классификатору MLCommons + детекция злоупотреблений код-интерпретатором, мультиязычность. Особенности Llama Prompt Guard 2: - Представлены две компактные модели на 86M и 22M параметров для быстрой бинарной классификации (безопасный запрос / атака). - Повышена устойчивость токенизатора к состязательным (adversarial) атакам и обфускации. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).
Планируете развернуть Llama 3.3?
На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.
Надежные облачные платформы и серверы в РФ
Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.
Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.
Hostkey
GPU RTX 3090 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 3090 (24 ГБ GDDR6X)
24 999 ₽/мес
Timeweb Cloud
GPU RTX A5000 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX A5000 (24 ГБ GDDR6X)
24 999 ₽/мес
Hostkey
GPU RTX 4090 24GB
CPU
16 ядер
RAM
128 ГБ
Диск
1000 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 4090 (24 ГБ GDDR6X)
32 999 ₽/мес
Ищете точную конфигурацию под ваш бюджет?
Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.