Tech Meridian ← К СУЩНОСТЯМ
EN

КОМПАНИЯ · ENTITY #173

NVIDIA Developer

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

25

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Плотные (Dense) vs MoE-модели: активные параметры, пропускная способность и когда выбирать каждую

Публикация NVIDIA Developer сравнивает плотные и MoE-архитектуры, демонстрируя, как 30-миллиардная модель может активировать лишь около 3 млрд параметров на токен, и обсуждает связанные компромиссы между ёмкостью и пропускной способностью; в качестве примера используется Nemotron 3.5 Lightning.

6.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

Как детерминированное выполнение Groq 3 LPX от NVIDIA обеспечивает энергоэффивную и интерактивную инференцию на Vera Rubin

Статья на NVIDIA Developer описывает, как детерминированная модель выполнения Groq 3 LPX на платформе NVIDIA Vera Rubin применяется для достижения энергоэффективной, высокоинтерактивной инференции ИИ. В материале делается акцент на детерминированном выполнении как способе повысить отзывчивость инференции и снизить потребление энергии (полные технические детали в исходной статье).

7.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

Как NVIDIA NVLink 6 обеспечивает многоуровневую отказоустойчивость для AI‑фабрик

Статья на сайте NVIDIA Developer описывает, как NVLink 6 обеспечивает многоуровневую отказоустойчивость для крупномасштабных кластеров обучения ИИ, чтобы помочь операторам поддерживать непрерывную работу GPU и повышать производительность в масштабных «фабриках» ИИ.

7.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

Масштабирование федеративного обучения на Docker, Kubernetes и Slurm с помощью NVIDIA FLARE

Статья на NVIDIA Developer описывает, как с помощью NVIDIA FLARE можно запускать и масштабировать нагрузки федеративного обучения в популярных средах оркестрации — Docker, Kubernetes и Slurm, давая рекомендации по переходу от одиночных серверов и небольшого числа клиентов к более крупным развертываниям.

5.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

Как полностековые оптимизации NIM обеспечивают 2,5× больше пользователей на Nemotron 3 Ultra

Публикация NVIDIA Developer описывает применение полностековых оптимизаций NIM для production‑сервинга модели Nemotron 3 Ultra и сообщает об увеличении числа одновременно обслуживаемых пользователей до 2,5×. В статье подчёркивается, что развертывание модели — лишь первый шаг, и для максимальной пропускной способности и масштабируемости требуются изменения на уровне всей системы.

6.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

От выхода пластин до первого токена: кодификация экспертизы цепочки поставок с Nemotron и Palantir Foundry

Статья на NVIDIA Developer описывает попытки кодифицировать опыт NVIDIA в управлении цепочкой поставок с помощью Nemotron и Palantir Foundry, с акцентом на измерение показателей в интервале «от выхода пластин до первого токена».

6.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

CUDA Toolkit 13.4 добавляет поддержку Windows на Arm и расширённый контроль за совместно используемыми GPU

CUDA Toolkit 13.4 от NVIDIA, анонсированный на сайте NVIDIA Developer, добавляет поддержку Windows на Arm и функции, предоставляющие разработчикам больший контроль над совместно используемыми GPU. Выпуск позиционируется как часть постоянной работы по улучшению функциональности и производительности для разработчиков, использующих GPU и программное обеспечение NVIDIA.

7.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA объявляет CUDA Rust с двумя подходами к написанию GPU-ядр

В сентябре 2026 года NVIDIA объявила CUDA Rust, обозначив поддержку нативного GPU‑программирования на Rust и представив два подхода к написанию GPU‑ядер наряду с существующими инструментами CUDA C++ и CUDA Python.

7.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Создание агента с памятью с помощью NVIDIA NemoClaw

Статья на NVIDIA Developer рассказывает, как создать агента с памятью с помощью NVIDIA NemoClaw, решая задачу сохранения и восстановления меняющегося корпоративного контекста (сообщения, решения, проекты, обязательства) со временем.

6.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Передовое рассуждение на краю сети: как развернуть и оптимизировать модели на NVIDIA Jetson

NVIDIA Developer опубликовал руководство «Передовое рассуждение на краю сети», в котором описывается, как развернуть и оптимизировать модели для многошагового рассуждения и агентных ИИ на устройствах NVIDIA Jetson. В статье утверждается, что недавние достижения сделали более реалистичным запуск моделей с возможностью рассуждения на краю сети, и приведены практические рекомендации по развертыванию и оптимизации.

6.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

Как переносить идентичность пользователя между федеративными Kubernetes и AI-платформами

Статья на NVIDIA Developer рассматривает проблемы и подходы к переносу идентичности пользователя и информации о доступе при переходе между центральным порталом, управляемыми наборами данных, запущенными ноутбуками и другими компонентами федеративных AI-платформ на базе Kubernetes. Речь идёт о том, как сохранение целостности идентичности обеспечивает единое управление доступом и соответствие политик в распределённых сервисах.

6.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA PAIR Virtual Inference Router расширяет доступные вычислительные мощи в локальной сети

На сайте NVIDIA Developer представлен PAIR Virtual Inference Router — инструмент, который расширяет доступные вычислительные ресурсы в локальной сети. В публикации устройство рассматривается в контексте AI-агентов, разламывающих сложные задачи на небольшие задания для субагентов.

6.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

Современный набор инструментов CUDA на практике: пошаговое руководство по оптимизации

NVIDIA Developer опубликовал пошаговое руководство, демонстрирующее современный набор инструментов CUDA для оптимизации кода, ускоряемого на GPU. В статье CUDA представлена как основа рабочих нагрузок от научных симуляций до крупномасштабного обучения ИИ и приводятся практические рекомендации по оптимизации.

6.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Со‑проектирование моделей ИИ со спекулятивной декодировкой для ускорения вывода LLM

NVIDIA Developer опубликовал третью статью в серии о со‑проектировании моделей ИИ, в которой рассматривается использование спекулятивной декодировки для ускорения вывода больших языковых моделей (LLM) при сохранении точности. В материале обсуждаются компромиссы и приёмы для более быстрого вывода в рамках со‑проектирования моделей и систем.

6.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

Создание адаптивной агентной системы кибербезопасности с NVIDIA Nemotron

Статья на NVIDIA Developer рассказывает, как создать адаптивную агентную систему кибербезопасности с использованием NVIDIA Nemotron. В ней отмечается, что агентные системы способны координировать работу и решать задачи на длительном горизонте, и указывается, что команды по безопасности начинают изучать такие подходы.

6.0

MONEY · 1 ИСТОЧН. · NVIDIA Developer

Как подобрать объём GPU для инференса ИИ и TCO, не переплачивая

NVIDIA Developer опубликовал рекомендации по подбору объёма GPU для инференса ИИ с упором на баланс между производительностью и полной стоимостью владения, чтобы не переплачивать. Статья призвана помочь организациям понять компромиссы при планировании инфраструктуры инференса и затрат.

5.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Запустите микросервисы NVIDIA BioNeMo NIM для предсказания структуры белков в Claude Science

NVIDIA Developer опубликовал инструкцию по запуску микросервисов BioNeMo NIM для предсказания структуры белков в среде Claude Science, показывая, как микросервисы моделей NVIDIA можно вызывать в агентной исследовательской рабочей среде. В статье это рассматривается в контексте agentic AI, который может читать статьи, предлагать гипотезы, вызывать модели и расставлять приоритеты для экспериментов.

6.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA TensorRT Model Connect: развертывание открытых моделей от чекпоинта до инференса двумя командами

В публикации NVIDIA Developer представлен TensorRT Model Connect — инструмент, который, как утверждается, позволяет разработчикам доводить открытые AI‑модели от чекпоинта до инференса двумя командами, упрощая шаги конвертации и предобработки, специфичные для модели. В анонсе описан рабочий процесс; полные сведения о поддерживаемых форматах, фреймворках и системных требованиях приведены в документации NVIDIA.

6.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA представляет NVLink Fusion для внедрения NVHBM в инфраструктуру следующего поколения ИИ

В публикации на NVIDIA Developer компания NVIDIA рассказывает о NVLink Fusion — технологии, призванной внедрить NVHBM в инфраструктуру ИИ следующего поколения, чтобы справиться с растущими вычислительными и памятьными требованиями более крупных моделей и сложных задач рассуждения.

7.0

RESEARCH · 1 ИСТОЧН. · NVIDIA Developer

Как обучить политику навигации для разных платформ робота с помощью AI-агентов

Статья на NVIDIA Developer рассказывает об обучении политики навигации робота, применимой к разным телам (cross-embodiment), с использованием AI-агентов; авторы выделяют навигацию как отдельную задачу от локомоции и обсуждают преобразование восприятия и движения в автономное поведение. Текст нацелен на разработчиков и исследователей в области робототехники и ИИ.

6.0

MODELS · 1 ИСТОЧН. · NVIDIA Developer

Эксперимент с Qwen3.8-Flash-Next на NVIDIA GB300 NVL72 для агентного кодирования

Alibaba выпустила веса модели Qwen3.8-Flash-Next как превью новой архитектуры Qwen4 для разработчиков. NVIDIA Developer опубликовал эксперимент по запуску Qwen3.8-Flash-Next на GB300 NVL72, направленный на оценку агентных (agentic) рабочих процессов для кодирования и совместимости с железом.

6.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

CUDA Python 1.0 — стабильные API, единая основа, полный доступ к платформе

NVIDIA выпустила CUDA Python 1.0 с стабильными API и единой основой, которая призвана предоставить Python‑разработчикам расширенный доступ к возможностям CUDA и GPU без необходимости собирать расширения на C++. Выпуск направлен на упрощение создания ускоряемых на GPU Python‑приложений на платформе NVIDIA.

7.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

Ethernet Spectrum-X от NVIDIA: Переписывание правил сетей ЦОД для масштабного ИИ

Статья на NVIDIA Developer утверждает, что бурный рост генеративного ИИ и распределённая тренировка моделей на сотнях тысяч GPU принципиально меняют конструкцию дата‑центров и представляет Spectrum‑X Ethernet как сетевое решение, призванное удовлетворить эти новые требования.

7.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA: Vera Rubin и Blackwell установили новый стандарт энергоэффективности для агентного ИИ

Согласно публикации на NVIDIA Developer, новые архитектуры компании — Vera Rubin и Blackwell — задают новый стандарт по производительности на ватт для агентного ИИ, то есть при выполнении многошаговых рабочих процессов, использовании инструментов и координации субагентов. NVIDIA подаёт эти улучшения как повышение эффективности запуска сложных AI-агентов; конкретные результаты см. в объявлении компании.

7.0

COMPANIES · 1 ИСТОЧН. · NVIDIA Developer

Максимизация производительности AI‑фабрики на ватт с NVIDIA DSX MaxLPS

Статья NVIDIA Developer отмечает, что современные AI‑фабрики всё чаще ограничены по энергопотреблению, и важным показателем становится не число GPU, а объём AI‑выхода на ватт. В ней представлен NVIDIA DSX MaxLPS как подход к повышению производительности на ватт и обсуждаются сопутствующие системные и инфраструктурные соображения.

6.0