Google представила Gemini 3.8 Flash TTS і Gemini 3.8 Flash-Lite TTS, дві моделі синтезу мовлення.
Flash TTS створює голоси за текстовими запитами й дає докладний контроль над подачею кожної репліки. Flash-Lite TTS призначена для масового й економічного створення дубляжу, аудіоконтенту та голосових агентів.
Для копіювання голосу Google вимагає 30-секундний запис і перевіряє згоду власника голосу.
Google починає розгортання обох моделей у Gemini API та Google AI Studio.
Перевірка тверджень:
- Google представила Gemini 3.8 Flash TTS і Gemini 3.8 Flash-Lite TTS. (підтверджено самою публікацією: доказ; «Today, we’re introducing two new text-to-speech models to the Gemini family»)
- Gemini 3.8 Flash TTS створює голоси за текстовими запитами. (підтверджено самою публікацією: доказ; «Create entirely new voices from scratch using natural language prompts»)
- Gemini 3.8 Flash TTS дає докладний контроль над подачею кожної репліки. (підтверджено самою публікацією: доказ; «Direct every performance line by line with granular control over acting cues, pacing, dialect shifts, and backchanneling.»)
- Gemini 3.8 Flash-Lite TTS оптимізована для масового й економічного створення дубляжу, аудіоконтенту та голосових агентів. (підтверджено самою публікацією: доказ; «Built for high-volume, cost-efficient scale. Optimized for high-volume dubbing, audio content creation, and expressive voice agents»)
- Для копіювання голосу потрібні 30-секундний запис і перевірка згоди власника голосу. (підтверджено самою публікацією: доказ; «Recreate consistent vocal profiles from just a 30-second audio sample of your voice or a voice you have the rights to use, backed by built-in consent verification»)
- Google починає розгортання обох моделей у Gemini API та Google AI Studio. (підтверджено самою публікацією: доказ; «Gemini 3.8 Flash TTS is rolling out starting today: For developers : In the Gemini API and Google AI Studio»)
Першоджерела:
оцінка 75,6 зі 100 · тип: анонс