GamiWays
Cloud APICommercial

Gemini 3.8 Live

Dialogue live (15 sept. 2026) — 97 langues, outils en arrière-plan. Pas un TTS de cascade. Pas de milliseconde publiée.

unpublished
TTFA (best case)
unpublished
TTFA (typical)
Free
Price per million chars
—
ELO Score

Comparative Scores

Voice quality6/10
Latency4/10
Voice cloning1/10
Expressiveness5/10
Performance direction3/10
Sovereignty2/10
Price accessibility5/10
Multilingual9/10

Architecture

ArchitectureDialogue live audio, ancrage visuel, appels d’outils en arrière-plan. Distinct de Gemini 3.8 Flash TTS.
ParametersN/A (cloud)
Languages97
Self-hostable No
Streaming Yes
GamiWays
Dialogue live — hors cascade TTS

An architecture comparison for fluid dialogue and background tools. It does not replace a directed French TTS in a cascade. No millisecond figure is published, so it stays out of latency sums.

Analysis

Gemini 3.8 Live (15 September 2026, post updated 17 September) is a live dialogue model, not Gemini 3.8 Flash TTS. Google describes near-real-time visual grounding, mid-conversation switches across 97 languages, and tool calls that continue in the background. It places second in the Speech Agent Arena. No millisecond latency and no price are published. All generated audio carries a SynthID watermark. Developers get it in the Gemini API and AI Studio; Search Live is the public surface; Gemini Enterprise is a private preview.

Strengths

  • 97 langues, bascule en cours de conversation
  • Outils et API en arrière-plan sans couper la voix
  • Ancrage visuel quasi temps réel
  • 2e au Speech Agent Arena (chiffre Google)
  • SynthID sur l’audio généré
  • API Gemini et AI Studio dès le 15 septembre 2026

Weaknesses

  • Pas une synthèse de cascade : pas de TTFA, pas d’ELO du portail
  • Tarif non publié
  • Clonage et visèmes non documentés
  • Les scores d’arène sont des chiffres Google, pas une mesure de scène française
  • Résidence suisse non établie

Voice Capabilities

Voice Cloning No

Clonage non documenté dans le billet du 15 septembre 2026.

Emotion & performance directionLimited control

Conversation continues during tool calls. No line-level performance direction is documented.

How: Live dialogue, visual grounding and background tool calls. This is not Flash TTS `speech_metadata`.

Validate: Read it as a dialogue path, not a character-direction engine. No millisecond figure is published.

Streaming Yes

Conversation continue, interruptions, bascule entre 97 langues. Les outils partent en arrière-plan pendant que la voix continue. Aucune milliseconde n’est publiée.

Lip-sync Data No

Pas de visèmes documentés.

Pricing

Price / 1M chars
Free
Price / minute
Free
Free tier
Non publié dans le billet.

Le billet du 15 septembre 2026 parle d’un prix compétitif sans publier de tarif. Aucun $/min n’est inscrit.

Sovereignty & Compliance

On-premise No

Cloud Google. Entreprise en aperçu privé.

GDPR Compliant

Data residency: Google Cloud. Résidence suisse non documentée dans le billet.

This sheet's verification

Verified 3 October 2026

Google blog, 15 Sep 2026 (updated 17 Sep). Speech Agent Arena rank is a vendor figure, not an Artificial Analysis ELO.

Update note: Ajout le 3 octobre 2026 depuis le billet Gemini 3.8 Live. TTFA, ELO et tarif laissés vides.

This date covers provider-specific prices, capabilities and notes. Comparative benchmarks follow the synchronization and methodology shown above.