Не установлено по доступным источникам.
NVIDIA · ТРЕКЕР МОДЕЛИ
NVIDIA Nemotron-3 Nano 30B
NVIDIA Nemotron-3 Nano 30B — генеративная модель NVIDIA, показанная для развёртывания на Amazon SageMaker AI endpoints; используется в автоматизированном workflow с concurrency sweeps для измерения пропускной способности и задержки.ТЕКУЩИЙ СНИМОК2/5 РАЗДЕЛОВ С ДАННЫМИ
Главные характеристики в одном месте.
Не установлено по доступным источникам.
Не установлено по доступным источникам.
Бенчмарк (concurrency sweeps)Модель используется в автоматизированном workflow с concurrency sweeps, который измеряет пропускную способность (токенов в секунду) и задержку для определения точки насыщения endpoint’а и подбора ёмкости.
Возможность развёртыванияМожет быть развёрнута на Amazon SageMaker AI endpoints с использованием нативного контейнера vLLM.
ПРОВЕРЯЕМЫЕ ФАКТЫ
Каждое значение привязано к источнику и дате.
ВОЗМОЖНОСТИ · ПредназначениеДАННЫЕ РАЗРАБОТЧИКА
Показана для использования с генеративными AI-endpoint’ами (используется как генеративная модель в примере с concurrency sweeps).
ДОСТУПНОСТЬ · Возможность развёртыванияДАННЫЕ РАЗРАБОТЧИКА
Может быть развёрнута на Amazon SageMaker AI endpoints с использованием нативного контейнера vLLM.
БЕНЧМАРКИ · Бенчмарк (concurrency sweeps)ДАННЫЕ РАЗРАБОТЧИКА
Модель используется в автоматизированном workflow с concurrency sweeps, который измеряет пропускную способность (токенов в секунду) и задержку для определения точки насыщения endpoint’а и подбора ёмкости.
ЧТО ИЗМЕНИЛОСЬ