Главная/Новости/Внутри лаборатории, где оживает процессор Arm AGI
🇷🇺ServeTheHomeAI-адаптировано
Внутри лаборатории, где оживает процессор Arm AGI
Мы отправляемся в лабораторию Arm ATE, чтобы посмотреть, как создается новый серверный процессор Arm — процессор Arm AGI. Настало время экскурсии по лаборатории! Публикация «В лаборатории, где оживает процессор Arm AGI», впервые появилась на сайте ServeTheHome. 🔍 Как выбрать сервер: сравнить актуальные конфигурации на базе современного серверного оборудования, проверить наличие у ключевых дата-центров и подобрать решение под ваш бюджет можно в каталоге серверов ServerSales.
Подбор серверов на ServerSales
Ищете сервер под задачи из материала?
Сравните тарифы VPS/VDS и выделенных серверов от Selectel, Timeweb Cloud и Aeza с фильтрами по CPU, NVMe, защите от DDoS и 152-ФЗ.
Год назад я поднял первого агента на сервере и закладывал память как под обычный скрипт. Через месяц на той же машине жило двадцать, а ещё через неделю она легла целиком. Ниже — цифры, которые я снял на живых машинах, и три ошибки, каждая из которых стоила мне рабочего дня. Это не обзор хостингов. Это замеры своего хозяйства: сколько на самом деле ест агент, почему разброс в семь раз и что ломается раньше памяти. Читать далее
💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).
Рассмотрим стенограмму встречи, разговора с клиентом или подкаста, в которой каждое предложение верно, но ни одно из них не приписано говорящему. Вы можете прочитать слова, но не можете достоверно сказать, кто взял на себя обязательство, кто высказал возражение или какой участник перебил. Поиск, сводки, действия, аналитика разговоров и память голосового агента становятся менее полезными. Диаризация говорящих определяет временные интервалы, в течение которых каждый говорящий активен, включая интервалы, когда люди переговариваются друг с другом. Эти временные метки говорящего затем можно объединить с автоматическим распознаванием речи (ASR) для создания стенограммы, приписываемой говорящему. NVIDIA Nemotron 3 Diarization is an open-weight, 100M-parameter model that ranks #1 on VoiceArena's Diarization-Bench leaderboard with a 14.72% Diarization Error Rate (DER). Supporting up to eight speakers across live and recorded conversations, it handles overlapping speech, chunked processing for flexible recording lengths, and customizable streaming latency. Рисунок 1. Nemotron 3 Diarization №1 в таблице лидеров VoiceArena Diarization-Bench. Earlier models like NVIDIA Streaming Sortformer established this approach for four-speaker diarization, including the streaming diar_streaming_sortformer_4spk-v2.1 checkpoint used as the baseline below. Nemotron 3 Diarization расширяет поддержку до восьми динамиков и повышает точность и пропускную способность, измеренную в следующих оценках. Как работает Nemotron 3 Диаризация Одна модель для оффлайн и потоковых разговоров Системы диаризации должны решать две взаимосвязанные проблемы. Во-первых, они должны распознать речь и назначить ее нужному говорящему. Second, they must preserve that assignment throughout the conversation, even after silence, interruptions, or long gaps between a speaker's turns. Потоковая передача усложняет вторую проблему. Автономная модель может проверить всю запись сразу. Потоковая система получает лишь небольшой фрагмент нового аудио и ограниченный контекст. Without an effective memory mechanism, the speaker assigned to one output channel in the current chunk can be assigned to a different channel in the next. Nemotron 3 Diarization следует подходу Sortformer, который упорядочивает выходные динамики по времени их первого появления. Первый новый голос становится первым каналом динамика, следующий новый голос становится вторым и так далее. This arrival-time ordering makes the model's generic speaker labels stable and removes the need to solve a new speaker permutation for every chunk. 💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).
Губернатор Техаса Грег Эбботт распорядился временно заморозить выдачу новых разрешений на подключение крупных дата-центров к электросетям штата. Причиной стал масштабный аудит энергосистемы, который проводит техасский системный оператор ERCOT (Electric Reliability Council of Texas). Энергетическая инфраструктура региона испытывает экстремальные нагрузки из-за лавинообразного роста числа ЦОД, ориентированных на облачные вычисления и тяжелые AI-нагрузки. Проверка ERCOT должна оценить реальные резервы мощности и предотвратить дефицит электроэнергии в пиковые периоды. Завершение аудита и публикация отчета запланированы на декабрь текущего года. * **Причины моратория:** Дефицит свободных мощностей в сети ERCOT на фоне бурного строительства дата-центров. * **Сроки:** Заморозка разрешений действует до завершения проверки в декабре. * **Влияние на рынок:** Задержка ввода в эксплуатацию новых серверных площадок и необходимость пересмотра графиков деплоя инфраструктуры. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).
💡 Инсайт:Энергетический кризис в ключевых хабах дата-центров тормозит масштабирование инфраструктуры и заставляет операторов пересматривать географию новых проектов.