Google представила Gemini 3.8 Flash TTS і Gemini 3.8 Flash-Lite TTS, дві моделі синтезу мовлення.

Flash TTS створює голоси за текстовими запитами й дає докладний контроль над подачею кожної репліки. Flash-Lite TTS призначена для масового й економічного створення дубляжу, аудіоконтенту та голосових агентів.

Для копіювання голосу Google вимагає 30-секундний запис і перевіряє згоду власника голосу.

Google починає розгортання обох моделей у Gemini API та Google AI Studio.

Перевірка тверджень:

  • Google представила Gemini 3.8 Flash TTS і Gemini 3.8 Flash-Lite TTS. (підтверджено самою публікацією: доказ; «Today, we’re introducing two new text-to-speech models to the Gemini family»)
  • Gemini 3.8 Flash TTS створює голоси за текстовими запитами. (підтверджено самою публікацією: доказ; «Create entirely new voices from scratch using natural language prompts»)
  • Gemini 3.8 Flash TTS дає докладний контроль над подачею кожної репліки. (підтверджено самою публікацією: доказ; «Direct every performance line by line with granular control over acting cues, pacing, dialect shifts, and backchanneling.»)
  • Gemini 3.8 Flash-Lite TTS оптимізована для масового й економічного створення дубляжу, аудіоконтенту та голосових агентів. (підтверджено самою публікацією: доказ; «Built for high-volume, cost-efficient scale. Optimized for high-volume dubbing, audio content creation, and expressive voice agents»)
  • Для копіювання голосу потрібні 30-секундний запис і перевірка згоди власника голосу. (підтверджено самою публікацією: доказ; «Recreate consistent vocal profiles from just a 30-second audio sample of your voice or a voice you have the rights to use, backed by built-in consent verification»)
  • Google починає розгортання обох моделей у Gemini API та Google AI Studio. (підтверджено самою публікацією: доказ; «Gemini 3.8 Flash TTS is rolling out starting today: For developers : In the Gemini API and Google AI Studio»)

Першоджерела:

оцінка 75,6 зі 100 · тип: анонс