Gemini 3.8 Live Extended Thinking
Dialogue live à raisonnement parallèle (15 sept. 2026). Les indices sont des chiffres Google. Pas de milliseconde publiée.
Scores comparatifs
Architecture
Le point de comparaison pour une voix qui garde la parole pendant qu’un raisonnement avance. Les indices éditeur restent des indices éditeur. La voie n’entre pas comme voix française de cascade et n’est pas additionnée à un budget de latence.
Analyse
Gemini 3.8 Live Extended Thinking (15 septembre 2026) continue de parler pendant qu’il raisonne. Google annonce la 1re place de l’indice Speech to Speech d’Artificial Analysis à 82,6, 68,6 % sur τ-Voice, 35,1 % sur le τ-Voice-banking de Sierra, et 97,7 % sur Big Bench Audio. Ce sont des chiffres d’éditeur, pas l’ELO d’août du portail. Le décompte de 97 langues du même billet est écrit pour Gemini 3.8 Live, pas repris comme une mesure séparée d’Extended Thinking. Aucune milliseconde ni aucun tarif ne sont publiés. L’audio porte SynthID.
Points forts
- Parle et raisonne en parallèle, avec narration de progression
- Indice Speech to Speech 82,6, 1re place annoncée (chiffre Google)
- τ-Voice 68,6 % et τ-Voice-banking 35,1 % (chiffres Google)
- Big Bench Audio 97,7 % (chiffre Google)
- Outils en arrière-plan sans couper la conversation
- SynthID sur l’audio généré
Limitations
- Pas un TTS de cascade : TTFA et ELO du portail non inscrits
- Les 97 langues sont celles publiées pour Gemini 3.8 Live, pas une mesure séparée
- Tarif non publié
- Comparaison EVA-Bench qualitative, sans pourcentage dans le billet
- Résidence suisse non établie
Capacités vocales
Clonage non documenté dans le billet.
Le modèle parle pendant qu’il raisonne et raconte l’avancement d’une tâche. Ce n’est pas une direction de réplique.
Comment : Amorces verbales et narration de progression, pendant des appels de fonctions asynchrones.
À tester : Les indices 82,6, τ-Voice et Big Bench Audio sont des chiffres Google. Ils ne décrivent pas le jeu d’un personnage.
Le modèle parle pendant qu’il raisonne, avec des amorces (« Let me check that… ») et une narration des tâches en arrière-plan. Aucune milliseconde n’est publiée.
Pas de visèmes documentés.
Tarification
Prix dit compétitif, sans grille dans le billet du 15 septembre 2026. Aucun $/min n’est inscrit.
Souveraineté & Conformité
Cloud Google. Aperçu privé entreprise, puis Workspace.
Résidence des données : Google Cloud. Résidence suisse non documentée dans le billet.
Vérification de cette fiche
Google blog, 15 Sep 2026 (updated 17 Sep): Speech to Speech 82.6, τ-Voice 68.6%, τ-Voice-banking 35.1%, Big Bench Audio 97.7%. Not the portal ELO.
Note de mise à jour : Ajout le 3 octobre 2026. Les indices restent des chiffres Google. TTFA et tarif non inscrits. Le 97 langues est celui de Gemini 3.8 Live dans le même billet.
Cette date concerne les prix, capacités et notes propres à cette fiche. Les benchmarks de comparaison suivent la synchronisation et la méthode indiquées dans le bloc au-dessus.