Tech Meridian← ВСЕ МОДЕЛИ
PROМОЙ MERIDIAN

GOOGLE (DEEPMIND) · ТРЕКЕР МОДЕЛИ

Gemini 3.8 Flash TTS

Gemini 3.8 Flash TTS — модель синтеза речи, анонсированная Google в сентябре 2026 года. Предназначена для креативного дизайна голосов и выразительной генерации аудио — создание уникальных голосов по текстовым подсказкам, управление исполнением по строчкам, поддержка многих языков и диалоговых функций, интеграция с Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook и Google Vids.

ТЕКУЩИЙ СНИМОК1/5 РАЗДЕЛОВ С ДАННЫМИ

Главные характеристики в одном месте.

ЦЕНА

Не установлено по доступным источникам.

КОНТЕКСТ

Не установлено по доступным источникам.

МОДАЛЬНОСТИ
МодальностьМодель синтеза речи (генерация аудио).
БЕНЧМАРКИ

Не установлено по доступным источникам.

ДОСТУПНОСТЬ

Не установлено по доступным источникам.

ХРОНОЛОГИЯ РЕЛИЗОВ

Только опубликованные события с источниками.

ИСТОЧНИКОВ 5 · ВАЖНОСТЬ 9.0

Google DeepMind представила Gemini 4 Argon — фронтирную модель с контекстом в 1M токенов

Google DeepMind объявила о модели Gemini 4 Argon — фронтирной мультимодальной модели, заточенной под долгие последовательные рассуждения и сложные рабочие процессы. Argon сначала разворачивается у доверенных киберзащитников в рамках программы Fairwind, увеличивает предел контекста до 1 миллиона токенов, демонстрирует лидирующие результаты по ряду бенчмарков (кодирование, финансы, право, анализ видео) и будет расширенно доступен после поэтапного тестирования безопасности и взаимодействия с органами власти США; также объявлены вводные тарифы.

→
ИСТОЧНИКОВ 5 · ВАЖНОСТЬ 8.0

Google выпустила модели TTS Gemini 3.8 Flash и Flash‑Lite

Google представила две новые модели синтеза речи Gemini 3.8 — Flash TTS для выразительных, персонажно‑ориентированных голосов и Flash‑Lite TTS для масштабного и экономичного использования — доступные в Google AI Studio, через Gemini API/Enterprise, в Gemini Notebook и Google Vids. Модели предлагают большую библиотеку голосов (более 2000 готовых голосов, свыше 100 языков/диалектов), создание голосов по текстовым подсказкам, воссоздание голоса по 30‑секундному образцу с проверкой согласия, защиту через SynthID и C2PA, а также поддержку долгих и многоголосых сцен.

→

ПРОВЕРЯЕМЫЕ ФАКТЫ

Каждое значение привязано к источнику и дате.

ВОЗМОЖНОСТИ · Генеративный дизайн голоса по текстовым подсказкамДАННЫЕ РАЗРАБОТЧИКА

Может создавать полностью новые голоса по текстовым подсказкам с тонкой настройкой роли, акцента, актёрских подсказок, темпа, диалектных сдвигов и обратных сигналов.

ВОЗМОЖНОСТИ · Поддерживаемые языки и диалектыДАННЫЕ РАЗРАБОТЧИКА

Поддерживает более 100 языков и диалектов.

ВОЗМОЖНОСТИ · Диалоговые и выразительные функцииДАННЫЕ РАЗРАБОТЧИКА

Поддерживает режиссёрские указания для каждой строки, двухголосный диалог и невербальные звуки (например, смех, вздохи).

ВОЗМОЖНОСТИ · Клонирование голоса из коротких образцовДАННЫЕ РАЗРАБОТЧИКА

Имеется функция клонирования голоса, которая может создать профиль голоса из 30‑секундного аудиофрагмента.

ВОЗМОЖНОСТИ · Библиотека голосов и пресетыДАННЫЕ РАЗРАБОТЧИКА

Предоставляет большую библиотеку пресетов (сообщается >2 000 голосов) и возможность масштабирования от ограниченного набора к практически неограниченному числу оригинальных голосов.

ВОЗМОЖНОСТИ · Стабильность голоса при длительном аудиоДАННЫЕ РАЗРАБОТЧИКА

Google утверждает, что модель может генерировать часы аудио с минимальным «дрейфом говорящего» (голос почти не меняется со временем).

ЧТО ИЗМЕНИЛОСЬ

Сохранённые версии паспорта, без догадок задним числом.

Паспорт создан8 фактов