Ко всем новостям
🌐Hugging Face BlogAI-адаптировано

Google анонсировала Gemma 3: мультимодальность, контекст 128K и обход тяжелых моделей прошлого поколения

Инсайт ServerSales • Влияние на рынок

Gemma 3 стирает грань между компактными open-source весами и проприетарными тяжелыми моделями, предлагая инженерам мультимодальность и контекст 128K на потребительском и серверном железе.

Google выкатила линейку открытых весовых языковых моделей нового поколения — Gemma 3. В семейство вошли четыре модели размером 1B, 4B, 12B и 27B параметров (доступны как базовые pre-trained версии, так и instruction-tuned для диалогов). Главный прорыв релиза — полноценная мультимодальность (модели от 4B и выше понимают текст и изображения) и масштабное расширение контекста до 128K токенов (32K для младшей 1B). При этом архитектурные оптимизации позволили добиться впечатляющих бенчмарков: * Производительность: Скромная Gemma-3-4B-IT в бенчмарках обходит тяжелую Gemma-2-27B-IT, а флагманская Gemma-3-27B-IT опережает проприетарную Gemini 1.5 Pro. * Контекст и эмбеддинги: Базовая частота RoPE увеличена с 10K (в Gemma 2) до 1M, что гарантирует стабильную работу длинных контекстов без потери точности. * Гибкость деплоя: Визуальный энкодер можно не загружать в память, если вы используете модель исключительно для текстового инференса, что экономит VRAM. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).

Где захостить и как запустить

Планируете развернуть эту нейросеть?

На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.

Первоисточник материала
Новость опубликована в издании Hugging Face Blog.
Вы можете прочитать полную версию статьи и комментарии на сайте источника.
Читать на Hugging Face Blog
Проверенные провайдеры под задачи материала

Надежные облачные платформы и серверы в РФ

Весь каталог
SelectelTier III • 152-ФЗ
★ 4.9

Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.

Бонус до 3 000 ₽ на облачную платформу
Перейти в Selectel
Timeweb CloudNVMe • Anti-DDoS
★ 4.8

Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.

Скидка 20% на первый заказ VPS
Перейти в Timeweb Cloud
Рекомендуемые конфигурации по теме
В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 3090 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 3090 (24 ГБ GDDR6X)

39 ₽/час

24 999 ₽/мес

В наличииGPU
Timeweb Cloud

Timeweb Cloud

Россия★ 4.8

GPU RTX A5000 24GB

CPU

8 ядер

RAM

64 ГБ

Диск

500 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX A5000 (24 ГБ GDDR6X)

36 ₽/час

24 999 ₽/мес

В наличииGPU
Hostkey

Hostkey

Россия★ 4.3

GPU RTX 4090 24GB

CPU

16 ядер

RAM

128 ГБ

Диск

1000 ГБ NVMe

Канал

1 Гбит/с

GPU

NVIDIA RTX 4090 (24 ГБ GDDR6X)

47 ₽/час

32 999 ₽/мес

Каталог серверов ServerSales

Ищете точную конфигурацию под ваш бюджет?

Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.

Другие новости индустрии

🌐Data Center DynamicsAI-адаптация

Никель-цинковые аккумуляторы в ЦОД: гибридные ИБП и динамическое управление питанием AI-кластеров

Современные дата-центры столкнулись с взрывным ростом энергопотребления из-за плотного размещения ускорителей вроде NVIDIA H100/H200 и будущих чипов класса Blackwell. Скачки нагрузки при запуске тяжелых ML-инференс задач и массовом обучении моделей приводят к жесткой волатильности в электросетях ЦОД. Традиционные свинцово-кислотные и литий-ионные батареи в составе ИБП (UPS) решают лишь задачу аварийного бэкапа, оставаясь простаивать 99.9% времени. Новый подход предлагает использовать никель-цинковые (NiZn) аккумуляторы двойного назначения. Они способны не только перекрывать кратковременные провалы питания при отключении внешней сети, но и работать в режиме буферизации пиковых нагрузок (dynamic power support) для AI-фабрик. Среди ключевых преимуществ технологии: * **Высокая токоотдача:** Способность выдавать огромную мощность в импульсном режиме для компенсации скачков энергопотребления GPU. * **Экологичность и безопасность:** Никель-цинк пожаробезопаснее литий-ионных аналогов, что критично для плотных серверных стоек. * **Ресурс циклов:** Устойчивость к частым глубоким разрядам при сглаживании профиля энергопотребления дата-центра. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Гибридные ИБП на NiZn-аккумуляторах решают проблему пиковых нагрузок в AI-дата-центрах, объединяя функции аварийного бэкапа и динамической стабилизации электропитания GPU-кластеров.
🌐Data Center DynamicsAI-адаптация

Boost Run привлекает контракт на $525,6 млн от Cohere для расширения облачной GPU-инфраструктуры

Игрок облачного рынка ИИ компания Boost Run заключила масштабный контракт на сумму $525,6 млн с разработчиком корпоративных языковых моделей Cohere. В рамках сделки инфраструктурный провайдер предоставит выделенные вычислительные мощности на базе высокопроизводительных графических ускорителей для обучения и развертывания генеративных моделей. Данное соглашение подчеркивает растущий тренд на децентрализацию облачных вычислений для ИИ и конкуренцию между альтернативными провайдерами и гиперскейлерами. Для обеспечения подобных нагрузок требуются плотные серверные стойки с эффективным жидкостным или мощным воздушным охлаждением, высокой пропускной способностью сети (InfiniBand/RoCE) и гарантированным SLA. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:Многомиллионные контракты на специализированные GPU-облака подтверждают дефицит и высокую востребованность выделенной серверной инфраструктуры под корпоративные ИИ-нагрузки.
🌐Data Center DynamicsAI-адаптация

Оптическая иллюзия: готовы ли копакеджированная оптика (CPO) и кремниевая фотоника спасти дата-центры от сетевого кризиса

Традиционные медные линии связи и планарные печатные платы упираются в физические ограничения по пропускной способности и энергопотреблении, особенно на фоне взрывного роста кластеров под ИИ. Технология копакеджированной оптики (Co-Packaged Optics, CPO) позиционируется как радикальное решение проблемы «бутылочного горлышка» ввода-вывода (I/O). Перенос оптических трансиверов непосредственно на подложку чипа к ASIC или GPU позволяет кардинально снизить задержки, уменьшить тепловыделение и поднять плотность портов коммутации. Однако внедрение CPO в коммерческие дата-центры сдерживается рядом серьезных инженерных вызовов: * **Надежность и сервисное обслуживание:** Замена вышедшего из строя лазерного модуля или оптического компонента «на горячую» в полевых условиях становится нетривиальной задачей, требующей изменения всей архитектуры стоек. * **Стандартизация:** Отсутствие единых отраслевых стандартов на кремниевую фотонику приводит к фрагментации экосистемы и высокой стоимости раннего внедрения. * **Терморегуляция:** Интеграция оптических элементов и мощных кремниевых кристаллов в один корпус требует сложных гибридных систем охлаждения. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).

💡 Инсайт:CPO способна перевернуть архитектуру ЦОД и снизить энергопотребление сетевых интерфейсов, но массовое внедрение технологии упирается в нерешенные вопросы ремонтопригодности и стандартизации.