Не установлено по доступным источникам.
GOOGLE (DEEPMIND) · ТРЕКЕР МОДЕЛИ
Gemini 3.8 Flash-Lite TTS
Gemini 3.8 Flash-Lite TTS — модель синтеза речи (генерация аудио) из семейства Gemini 3.8, анонсирована 23 сентября 2026 г. Оптимизирована для масштабной и экономичной генерации речи (дубляж, аудиоконтент, голосовые агенты), поддерживает режиссёрские указания, диалоги с двумя голосами и невербальные звуки; доступна через Google AI Studio, Gemini API и связанные платформы Google. Сгенерированные клипы содержат неслыхимый водяной знак SynthID.ТЕКУЩИЙ СНИМОК2/5 РАЗДЕЛОВ С ДАННЫМИ
Главные характеристики в одном месте.
Не установлено по доступным источникам.
Не установлено по доступным источникам.
ХРОНОЛОГИЯ РЕЛИЗОВ
Только опубликованные события с источниками.
Google DeepMind представила Gemini 4 Argon — фронтирную модель с контекстом в 1M токенов
Google DeepMind объявила о модели Gemini 4 Argon — фронтирной мультимодальной модели, заточенной под долгие последовательные рассуждения и сложные рабочие процессы. Argon сначала разворачивается у доверенных киберзащитников в рамках программы Fairwind, увеличивает предел контекста до 1 миллиона токенов, демонстрирует лидирующие результаты по ряду бенчмарков (кодирование, финансы, право, анализ видео) и будет расширенно доступен после поэтапного тестирования безопасности и взаимодействия с органами власти США; также объявлены вводные тарифы.
Google выпустила модели TTS Gemini 3.8 Flash и Flash‑Lite
Google представила две новые модели синтеза речи Gemini 3.8 — Flash TTS для выразительных, персонажно‑ориентированных голосов и Flash‑Lite TTS для масштабного и экономичного использования — доступные в Google AI Studio, через Gemini API/Enterprise, в Gemini Notebook и Google Vids. Модели предлагают большую библиотеку голосов (более 2000 готовых голосов, свыше 100 языков/диалектов), создание голосов по текстовым подсказкам, воссоздание голоса по 30‑секундному образцу с проверкой согласия, защиту через SynthID и C2PA, а также поддержку долгих и многоголосых сцен.
ПРОВЕРЯЕМЫЕ ФАКТЫ
Каждое значение привязано к источнику и дате.
Анонсирована 23 сентября 2026 г.
Модель синтеза речи (генерация аудио).
Создана для масштабной, экономичной генерации речи; оптимизирована для дубляжа, создания аудиоконтента и выразительных голосовых агентов с тонкой регулировкой тембра, темпа и выразительности.
Доступна через Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook и Google Vids (по данным Google).
Развёртывается через Gemini API и Google AI Studio; доступ через Gemini Enterprise API появится позже (по данным The Decoder).
Поддерживает более 100 языков и диалектов.
Поддерживает режиссёрские указания для каждой строки, диалоги с двумя голосами и невербальные звуки (смех, вздохи и т. п.).
Сгенерированные аудиоклипы содержат неслыхимый водяной знак SynthID для помощи в обнаружении синтезированной речи (по данным The Decoder с ссылкой на Google).
ЧТО ИЗМЕНИЛОСЬ