Tech Meridian← ВСЕ МОДЕЛИ
PROМОЙ MERIDIAN

GOOGLE (DEEPMIND) · ТРЕКЕР МОДЕЛИ

Gemini 3.8 Flash-Lite TTS

Gemini 3.8 Flash-Lite TTS — модель синтеза речи (генерация аудио) из семейства Gemini 3.8, анонсирована 23 сентября 2026 г. Оптимизирована для масштабной и экономичной генерации речи (дубляж, аудиоконтент, голосовые агенты), поддерживает режиссёрские указания, диалоги с двумя голосами и невербальные звуки; доступна через Google AI Studio, Gemini API и связанные платформы Google. Сгенерированные клипы содержат неслыхимый водяной знак SynthID.

ТЕКУЩИЙ СНИМОК2/5 РАЗДЕЛОВ С ДАННЫМИ

Главные характеристики в одном месте.

ЦЕНА

Не установлено по доступным источникам.

КОНТЕКСТ

Не установлено по доступным источникам.

МОДАЛЬНОСТИ
МодальностьМодель синтеза речи (генерация аудио).
БЕНЧМАРКИ

Не установлено по доступным источникам.

ДОСТУПНОСТЬ
Платформы / распространениеДоступна через Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook и Google Vids (по данным Google).
Статус развёртыванияРазвёртывается через Gemini API и Google AI Studio; доступ через Gemini Enterprise API появится позже (по данным The Decoder).

ХРОНОЛОГИЯ РЕЛИЗОВ

Только опубликованные события с источниками.

ИСТОЧНИКОВ 5 · ВАЖНОСТЬ 9.0

Google DeepMind представила Gemini 4 Argon — фронтирную модель с контекстом в 1M токенов

Google DeepMind объявила о модели Gemini 4 Argon — фронтирной мультимодальной модели, заточенной под долгие последовательные рассуждения и сложные рабочие процессы. Argon сначала разворачивается у доверенных киберзащитников в рамках программы Fairwind, увеличивает предел контекста до 1 миллиона токенов, демонстрирует лидирующие результаты по ряду бенчмарков (кодирование, финансы, право, анализ видео) и будет расширенно доступен после поэтапного тестирования безопасности и взаимодействия с органами власти США; также объявлены вводные тарифы.

→
ИСТОЧНИКОВ 5 · ВАЖНОСТЬ 8.0

Google выпустила модели TTS Gemini 3.8 Flash и Flash‑Lite

Google представила две новые модели синтеза речи Gemini 3.8 — Flash TTS для выразительных, персонажно‑ориентированных голосов и Flash‑Lite TTS для масштабного и экономичного использования — доступные в Google AI Studio, через Gemini API/Enterprise, в Gemini Notebook и Google Vids. Модели предлагают большую библиотеку голосов (более 2000 готовых голосов, свыше 100 языков/диалектов), создание голосов по текстовым подсказкам, воссоздание голоса по 30‑секундному образцу с проверкой согласия, защиту через SynthID и C2PA, а также поддержку долгих и многоголосых сцен.

→

ПРОВЕРЯЕМЫЕ ФАКТЫ

Каждое значение привязано к источнику и дате.

ВОЗМОЖНОСТИ · Предназначена дляДАННЫЕ РАЗРАБОТЧИКА

Создана для масштабной, экономичной генерации речи; оптимизирована для дубляжа, создания аудиоконтента и выразительных голосовых агентов с тонкой регулировкой тембра, темпа и выразительности.

ВОЗМОЖНОСТИ · Особенности диалога и невербальные звукиДАННЫЕ РАЗРАБОТЧИКА

Поддерживает режиссёрские указания для каждой строки, диалоги с двумя голосами и невербальные звуки (смех, вздохи и т. п.).

БЕЗОПАСНОСТЬ · Водяной знак / происхождениеДАННЫЕ РАЗРАБОТЧИКА

Сгенерированные аудиоклипы содержат неслыхимый водяной знак SynthID для помощи в обнаружении синтезированной речи (по данным The Decoder с ссылкой на Google).

ЧТО ИЗМЕНИЛОСЬ

Сохранённые версии паспорта, без догадок задним числом.

Паспорт создан8 фактов