GamiWays
API CloudCommercial

Gemini 3.8 Live Extended Thinking

Dialogue live à raisonnement parallèle (15 sept. 2026). Les indices sont des chiffres Google. Pas de milliseconde publiée.

non publié
TTFA (meilleur cas)
non publié
TTFA (typique)
Gratuit
Prix par million de chars
—
ELO Score

Scores comparatifs

Qualité vocale7/10
Latence4/10
Clonage vocal1/10
Expressivité5/10
Direction de jeu3/10
Souveraineté2/10
Accessibilité prix5/10
Multilingue9/10

Architecture

ArchitectureDialogue live qui raisonne et parle en même temps, avec narration de progression. Distinct de Gemini 3.8 Flash TTS et de GPT-Live.
ParamètresN/A (cloud)
Langues97
Auto-hébergeable No
Streaming Oui
GamiWays
Dialogue live — raisonnement parallèle

Le point de comparaison pour une voix qui garde la parole pendant qu’un raisonnement avance. Les indices éditeur restent des indices éditeur. La voie n’entre pas comme voix française de cascade et n’est pas additionnée à un budget de latence.

Analyse

Gemini 3.8 Live Extended Thinking (15 septembre 2026) continue de parler pendant qu’il raisonne. Google annonce la 1re place de l’indice Speech to Speech d’Artificial Analysis à 82,6, 68,6 % sur τ-Voice, 35,1 % sur le τ-Voice-banking de Sierra, et 97,7 % sur Big Bench Audio. Ce sont des chiffres d’éditeur, pas l’ELO d’août du portail. Le décompte de 97 langues du même billet est écrit pour Gemini 3.8 Live, pas repris comme une mesure séparée d’Extended Thinking. Aucune milliseconde ni aucun tarif ne sont publiés. L’audio porte SynthID.

Points forts

  • Parle et raisonne en parallèle, avec narration de progression
  • Indice Speech to Speech 82,6, 1re place annoncée (chiffre Google)
  • τ-Voice 68,6 % et τ-Voice-banking 35,1 % (chiffres Google)
  • Big Bench Audio 97,7 % (chiffre Google)
  • Outils en arrière-plan sans couper la conversation
  • SynthID sur l’audio généré

Limitations

  • Pas un TTS de cascade : TTFA et ELO du portail non inscrits
  • Les 97 langues sont celles publiées pour Gemini 3.8 Live, pas une mesure séparée
  • Tarif non publié
  • Comparaison EVA-Bench qualitative, sans pourcentage dans le billet
  • Résidence suisse non établie

Capacités vocales

Clonage vocal No

Clonage non documenté dans le billet.

Direction émotionnelle & jeuContrôle limité

Le modèle parle pendant qu’il raisonne et raconte l’avancement d’une tâche. Ce n’est pas une direction de réplique.

Comment : Amorces verbales et narration de progression, pendant des appels de fonctions asynchrones.

À tester : Les indices 82,6, τ-Voice et Big Bench Audio sont des chiffres Google. Ils ne décrivent pas le jeu d’un personnage.

Streaming Oui

Le modèle parle pendant qu’il raisonne, avec des amorces (« Let me check that… ») et une narration des tâches en arrière-plan. Aucune milliseconde n’est publiée.

Données lip-sync No

Pas de visèmes documentés.

Tarification

Prix / 1M chars
Gratuit
Prix / minute
Gratuit
Offre gratuite
Non publié dans le billet.

Prix dit compétitif, sans grille dans le billet du 15 septembre 2026. Aucun $/min n’est inscrit.

Souveraineté & Conformité

On-premise No

Cloud Google. Aperçu privé entreprise, puis Workspace.

GDPR Conforme

Résidence des données : Google Cloud. Résidence suisse non documentée dans le billet.

Vérification de cette fiche

Vérifiée le 3 octobre 2026

Google blog, 15 Sep 2026 (updated 17 Sep): Speech to Speech 82.6, τ-Voice 68.6%, τ-Voice-banking 35.1%, Big Bench Audio 97.7%. Not the portal ELO.

Note de mise à jour : Ajout le 3 octobre 2026. Les indices restent des chiffres Google. TTFA et tarif non inscrits. Le 97 langues est celui de Gemini 3.8 Live dans le même billet.

Cette date concerne les prix, capacités et notes propres à cette fiche. Les benchmarks de comparaison suivent la synchronisation et la méthode indiquées dans le bloc au-dessus.