Tech Meridian ← К СУЩНОСТЯМ
PROМОЙ MERIDIAN EN

МОДЕЛЬ · ENTITY #5214

Qwen Cloud

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

2

MODELS · 1 ИСТОЧН. · The Decoder

Alibaba выпустила Qwen-Audio-3.1 и снизила цены на аудио‑AI до 95%

Команда Qwen Alibaba выпустила Qwen‑Audio‑3.1 — набор из пяти моделей для распознавания речи (ASR), синтеза речи (TTS) и режима реального времени. В релизе: улучшенное мультиязычное и диалектное ASR, распознавание нескольких говорящих с временными метками и детекция эмоций/фоновых/машинных шумов в ASR‑Next, кроссъязычный и управляемый TTS, диффузионный TTS‑Next для одновременной генерации голоса, эффектов и фона; модель реального времени поддерживает одновременную речь и прослушивание, мгновенное прерывание и реакцию с учётом настроения. Alibaba также существенно снизила цены на аудиосервисы (TTS примерно −70%, Realtime примерно −85%, ASR до −95%) и опубликовала подробности в блоге и на Qwen Cloud.

7.0

MODELS · 1 ИСТОЧН. · The Decoder

Qwen выпускает Qwen3.8-Omni-Flash — мультимодальную модель для агентов с ценами ниже Gemini Flash

Qwen представила Qwen3.8-Omni-Flash — первую мультимодальную модель для агентов с контекстным окном в миллион токенов, которая обрабатывает аудио и видео, выполняет задачи вроде редактирования влогов и суммаризации фильмов и поддерживает взаимодействие в реальном времени через Qwen‑Live Harness. Стоимость API — $0.15 за млн входных токенов и $0.47 за млн выходных (по оценке Qwen, аудио‑ввод ниже $0.01/час, 720p видео при 1 fps ≈ $0.20/час); модель доступна через Qwen Studio, Qwen Cloud и API, а также поставляется с открытыми Qwen‑MM‑Plugins для интеграции агентов.

8.0