На дне инвестора компания onsemi объявила о своей новой встроенной силовой платформе для стоек искусственного интеллекта, автомобильных и промышленных приложений. Сообщение об анонсе встроенной силовой платформы onsemi впервые появилось на сайте ServeTheHome. 💡 Где захостить и как запустить: рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на ServerSales в интерактивном подборщике AI-моделей или каталоге GPU-серверов.
Где захостить и как запустить
Планируете развернуть эту нейросеть?
На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.
Год назад я поднял первого агента на сервере и закладывал память как под обычный скрипт. Через месяц на той же машине жило двадцать, а ещё через неделю она легла целиком. Ниже — цифры, которые я снял на живых машинах, и три ошибки, каждая из которых стоила мне рабочего дня. Это не обзор хостингов. Это замеры своего хозяйства: сколько на самом деле ест агент, почему разброс в семь раз и что ломается раньше памяти. Читать далее
💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).
Рассмотрим стенограмму встречи, разговора с клиентом или подкаста, в которой каждое предложение верно, но ни одно из них не приписано говорящему. Вы можете прочитать слова, но не можете достоверно сказать, кто взял на себя обязательство, кто высказал возражение или какой участник перебил. Поиск, сводки, действия, аналитика разговоров и память голосового агента становятся менее полезными. Диаризация говорящих определяет временные интервалы, в течение которых каждый говорящий активен, включая интервалы, когда люди переговариваются друг с другом. Эти временные метки говорящего затем можно объединить с автоматическим распознаванием речи (ASR) для создания стенограммы, приписываемой говорящему. NVIDIA Nemotron 3 Diarization is an open-weight, 100M-parameter model that ranks #1 on VoiceArena's Diarization-Bench leaderboard with a 14.72% Diarization Error Rate (DER). Supporting up to eight speakers across live and recorded conversations, it handles overlapping speech, chunked processing for flexible recording lengths, and customizable streaming latency. Рисунок 1. Nemotron 3 Diarization №1 в таблице лидеров VoiceArena Diarization-Bench. Earlier models like NVIDIA Streaming Sortformer established this approach for four-speaker diarization, including the streaming diar_streaming_sortformer_4spk-v2.1 checkpoint used as the baseline below. Nemotron 3 Diarization расширяет поддержку до восьми динамиков и повышает точность и пропускную способность, измеренную в следующих оценках. Как работает Nemotron 3 Диаризация Одна модель для оффлайн и потоковых разговоров Системы диаризации должны решать две взаимосвязанные проблемы. Во-первых, они должны распознать речь и назначить ее нужному говорящему. Second, they must preserve that assignment throughout the conversation, even after silence, interruptions, or long gaps between a speaker's turns. Потоковая передача усложняет вторую проблему. Автономная модель может проверить всю запись сразу. Потоковая система получает лишь небольшой фрагмент нового аудио и ограниченный контекст. Without an effective memory mechanism, the speaker assigned to one output channel in the current chunk can be assigned to a different channel in the next. Nemotron 3 Diarization следует подходу Sortformer, который упорядочивает выходные динамики по времени их первого появления. Первый новый голос становится первым каналом динамика, следующий новый голос становится вторым и так далее. This arrival-time ordering makes the model's generic speaker labels stable and removes the need to solve a new speaker permutation for every chunk. 💡 **Где захостить и как запустить:** рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на **ServerSales** в интерактивном [подборщике AI-моделей](/ai) или [каталоге GPU-серверов](/gpu).
Губернатор Техаса Грег Эбботт распорядился временно заморозить выдачу новых разрешений на подключение крупных дата-центров к электросетям штата. Причиной стал масштабный аудит энергосистемы, который проводит техасский системный оператор ERCOT (Electric Reliability Council of Texas). Энергетическая инфраструктура региона испытывает экстремальные нагрузки из-за лавинообразного роста числа ЦОД, ориентированных на облачные вычисления и тяжелые AI-нагрузки. Проверка ERCOT должна оценить реальные резервы мощности и предотвратить дефицит электроэнергии в пиковые периоды. Завершение аудита и публикация отчета запланированы на декабрь текущего года. * **Причины моратория:** Дефицит свободных мощностей в сети ERCOT на фоне бурного строительства дата-центров. * **Сроки:** Заморозка разрешений действует до завершения проверки в декабре. * **Влияние на рынок:** Задержка ввода в эксплуатацию новых серверных площадок и необходимость пересмотра графиков деплоя инфраструктуры. 🔍 Как выбрать сервер: Сравнить актуальные конфигурации серверов на базе этого оборудования и найти минимальные цены от проверенных провайдеров РФ и Европы можно в каталоге ServerSales (/catalog).
💡 Инсайт:Энергетический кризис в ключевых хабах дата-центров тормозит масштабирование инфраструктуры и заставляет операторов пересматривать географию новых проектов.