GamiWays
API CloudCommercial

Gemini 3.8 Flash TTS

Nouveau — design de voix et acting ligne à ligne, 130 langues. Pas de TTFA publié.

non publié
TTFA (meilleur cas)
non publié
TTFA (typique)
Gratuit
Prix par million de chars
—
ELO Score

Scores comparatifs

Qualité vocale8/10
Latence4/10
Clonage vocal7/10
Expressivité9/10
Direction de jeu7/10
Souveraineté2/10
Accessibilité prix5/10
Multilingue10/10

Architecture

ArchitectureGemini TTS. Consignes durables dans speech_metadata ; événements vocaux inline. Live API non supporté.
ParamètresN/A (cloud)
Langues130
Auto-hébergeable No
Streaming Oui
GamiWays
Direction de jeu vocale — à tester en français

L’outil de direction le plus pertinent parmi les nouveautés pour les voix de personnages d’Où est Ava ?, à condition de tester les consignes françaises ligne à ligne. La réplication vocale suisse est bloquée dans AI Studio. Ce n’est pas une voie voix-à-voix.

Analyse

Gemini 3.8 Flash TTS (23 septembre 2026) est le modèle de synthèse créatif de Google : design de voix, scènes à deux locuteurs et acting ligne à ligne sur 130 langues. L’Overall Quality Index Hume du 24 septembre le place premier sur le protocole Hume. Ce score n’est pas un ELO Artificial Analysis et n’est pas inscrit ici. Aucun TTFA en millisecondes n’est publié. La réplication vocale dans AI Studio n’est pas disponible en Suisse ni dans l’EEE.

Points forts

  • Design de voix et bibliothèque étendue
  • Acting ligne à ligne et dialogue deux locuteurs
  • 130 langues, dont le français
  • Consentement et filigrane SynthID documentés
  • Même schéma d’API que Flash-Lite

Limitations

  • Pas de TTFA publié
  • Réplication AI Studio indisponible en Suisse et dans l’EEE
  • Pas de visèmes documentés
  • Prix au token non repris tant que la ligne officielle n’est pas relue
  • Live API non supporté

Capacités vocales

Clonage vocal Oui

Réplication à partir d’un échantillon de 30 secondes avec enregistrement de consentement, plus design de voix en langage naturel. Dans AI Studio, la réplication n’est pas disponible en Suisse, dans l’EEE, au Royaume-Uni, en Inde, en Illinois et au Texas.

Direction émotionnelle & jeuDirection par instructions

Le jeu se dirige ligne à ligne : style et locuteur sont des métadonnées, les rires et soupirs restent dans le texte.

Comment : `speech_metadata.style` et `speaker` ; balises `<laugh>`, `<sigh>`, `<short pause>`. Le texte brut est prononcé tel quel.

À tester : Tester chaque consigne en français. La réplication dans AI Studio n’est pas disponible en Suisse ni dans l’EEE. Aucun TTFA n’est publié.

Streaming Oui

Génération audio via l’API Gemini. Aucun temps au premier audio n’est publié sur la fiche modèle. Le Live API n’est pas supporté.

Données lip-sync No

Pas de visèmes ni de timestamps mot à mot documentés pour ce modèle.

Tarification

Prix / 1M chars
Gratuit
Prix / minute
Gratuit
Offre gratuite
Un palier gratuit est mentionné par des relevés secondaires ; non recopié ici tant que la ligne officielle n’est pas relue.

Tarif au token, pas au caractère. La page pricing Gemini consultée le 30 septembre 2026 n’a pas restitué la ligne 3.8 TTS. Aucun $/1M caractères n’est donc inscrit.

Souveraineté & Conformité

On-premise No

Cloud Google. Gemini Enterprise annoncé comme à venir pour ce TTS.

GDPR Conforme

Résidence des données : Google Cloud. Réplication vocale AI Studio indisponible en Suisse et dans l’EEE.

Vérification de cette fiche

Vérifiée le 30 septembre 2026

Google announcement 23 Sep 2026. Hume Overall Quality Index 24 Sep 2026 is a separate protocol.

Note de mise à jour : Ajout le 30 septembre 2026. TTFA et prix au caractère laissés vides : non publiés dans les sources relues.

Cette date concerne les prix, capacités et notes propres à cette fiche. Les benchmarks de comparaison suivent la synchronisation et la méthode indiquées dans le bloc au-dessus.