Tech Meridian ← К СУЩНОСТЯМ
PROМОЙ MERIDIAN EN

КОМПАНИЯ · ENTITY #8173

WhisperX

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

2

CODING · 1 ИСТОЧН. · AWS Machine Learning

Развёртывание Qwen3-TTS со стриминговым выводом на SageMaker через vLLM-Omni v1.5 для приложений реального времени

AWS опубликовала пошаговое руководство (Часть 1) по развёртыванию модели синтеза речи Qwen3-TTS на Amazon SageMaker AI с использованием Deep Learning Container vLLM-Omni v1.5. В материале показано, как по одному постоянному двухстороннему соединению (SageMaker bidirectional streaming) отправлять текст и получать аудиочасти через нативный WebSocket‑маршрут vLLM-Omni (v1/audio/speech/stream), а также приведён пример на Gradio; серия также охватит другие специализированные DLC (WhisperX, llama.cpp).

6.0

MODELS · 1 ИСТОЧН. · AWS Machine Learning

AWS упаковал WhisperX DLC для SageMaker с пометками говорящих и покомандными метками времени

AWS выпустил WhisperX Deep Learning Container (DLC) для Amazon SageMaker, который объединяет OpenAI Whisper с выравниванием на основе wav2vec2 и диаризацией говорящих для покомандных меток времени и пометок «кто говорит». GPU‑готовый контейнер соответствует контракту обслуживания SageMaker, поддерживает реальное время и асинхронные эндпоинты и выдаёт форматы json, verbose_json, srt и vtt (пример тега образа: whisperx:3.8.6-cu128-amzn2023-sagemaker).

6.0