GamiWays
Cloud APICommercial

Gemini 3.8 Flash TTS

Nouveau — design de voix et acting ligne à ligne, 130 langues. Pas de TTFA publié.

unpublished
TTFA (best case)
unpublished
TTFA (typical)
Free
Price per million chars
—
ELO Score

Comparative Scores

Voice quality8/10
Latency4/10
Voice cloning7/10
Expressiveness9/10
Performance direction7/10
Sovereignty2/10
Price accessibility5/10
Multilingual10/10

Architecture

ArchitectureGemini TTS. Consignes durables dans speech_metadata ; événements vocaux inline. Live API non supporté.
ParametersN/A (cloud)
Languages130
Self-hostable No
Streaming Yes
GamiWays
Direction de jeu vocale — à tester en français

The most relevant new direction tool for Où est Ava ? character voices, provided French style instructions are tested line by line. Swiss voice replication is blocked in AI Studio. Do not use it as a speech-to-speech path.

Analysis

Gemini 3.8 Flash TTS (23 September 2026) is Google’s creative speech model: voice design, two-speaker scenes and line-level acting across 130 languages. Hume’s 24 September Overall Quality Index places it first on Hume’s own protocol. That score is not an Artificial Analysis ELO and is not entered here. No millisecond TTFA is published. Voice replication in AI Studio is unavailable in Switzerland and the EEA.

Strengths

  • Design de voix et bibliothèque étendue
  • Acting ligne à ligne et dialogue deux locuteurs
  • 130 langues, dont le français
  • Consentement et filigrane SynthID documentés
  • Même schéma d’API que Flash-Lite

Weaknesses

  • Pas de TTFA publié
  • Réplication AI Studio indisponible en Suisse et dans l’EEE
  • Pas de visèmes documentés
  • Prix au token non repris tant que la ligne officielle n’est pas relue
  • Live API non supporté

Voice Capabilities

Voice Cloning Yes

Réplication à partir d’un échantillon de 30 secondes avec enregistrement de consentement, plus design de voix en langage naturel. Dans AI Studio, la réplication n’est pas disponible en Suisse, dans l’EEE, au Royaume-Uni, en Inde, en Illinois et au Texas.

Emotion & performance directionInstruction-based direction

Performance is directed line by line: style and speaker are metadata, laughs and sighs stay in the transcript.

How: `speech_metadata.style` and `speaker`; `<laugh>`, `<sigh>`, `<short pause>` tags. Raw text is spoken verbatim.

Validate: Test each direction in French. AI Studio voice replication is unavailable in Switzerland and the EEA. No TTFA is published.

Streaming Yes

Génération audio via l’API Gemini. Aucun temps au premier audio n’est publié sur la fiche modèle. Le Live API n’est pas supporté.

Lip-sync Data No

Pas de visèmes ni de timestamps mot à mot documentés pour ce modèle.

Pricing

Price / 1M chars
Free
Price / minute
Free
Free tier
Un palier gratuit est mentionné par des relevés secondaires ; non recopié ici tant que la ligne officielle n’est pas relue.

Tarif au token, pas au caractère. La page pricing Gemini consultée le 30 septembre 2026 n’a pas restitué la ligne 3.8 TTS. Aucun $/1M caractères n’est donc inscrit.

Sovereignty & Compliance

On-premise No

Cloud Google. Gemini Enterprise annoncé comme à venir pour ce TTS.

GDPR Compliant

Data residency: Google Cloud. Réplication vocale AI Studio indisponible en Suisse et dans l’EEE.

This sheet's verification

Verified 30 September 2026

Google announcement 23 Sep 2026. Hume Overall Quality Index 24 Sep 2026 is a separate protocol.

Update note: Ajout le 30 septembre 2026. TTFA et prix au caractère laissés vides : non publiés dans les sources relues.

This date covers provider-specific prices, capabilities and notes. Comparative benchmarks follow the synchronization and methodology shown above.