GamiWays

Le prototype actuel

La faisabilité est établie. La version publique ne l’est pas encore.

Ce qui fonctionne

État du prototype AVA au 28 septembre 2026 — pas une promesse de version publique.

La faisabilité est établie : voix, mémoire, personnages, cinématiques, Game Master, transitions et observation. Ce n’est pas encore une version publique finalisée. Déjà en place : interface et parcours web ; conversation vocale ; transcription, génération et synthèse ; Max et Emma à des états distincts ; contexte et mémoire isolés ; passage entre personnages intégré, encore à valider sur des sessions complètes ; cinématiques déclenchables ; Game Master relationnel ; synchronisation Notion ; back-office de comparaison et de configuration ; coûts, erreurs et temps de réaction ; plusieurs services vidéo intégrés pour test, dont des intentions de jeu vocales par tour lorsque le service de voix les prend en charge.

Ce qui reste à établir

  • Qualité artistique sur la durée
  • Ava et Léo complets
  • Fluidité de quatre points de vue
  • Expressivité et stabilité des voix
  • Incarnation vidéo des quatre personnages
  • Pertinence et dosage des cinématiques
  • Stabilité d’exploitation
  • Durée optimale, à préciser par les tests
  • Effet réel sur le public

Game Master

Réalisateur invisible : fonction visée, mécanisme en place, dosage encore à calibrer.

Fonction artistique visée : un réalisateur invisible. Il oriente la relation — rythme, confiance, moment d’une image — sans se montrer.

Mécanisme en place : un Game Master relationnel, déclenché après le tour de parole. Il n’est pas une validation bloquante obligatoire avant chaque réplique.

À calibrer : le dosage des relances, le moment des cinématiques et la manière dont la relation évolue sur une session complète.

Max en visioconférence — « Hallo… à qui ai-je affaire ? »
Dashboard admin — répartition STT / RAG / Max LLM / TTS par tour, blocages et cible 2 s.

Latence — enjeu narratif

La latence conditionne la crédibilité du personnage. Fourchettes documentées et services du prototype — mesures PostHog en cours de fiabilisation ci-dessous.

Les mesures ci-dessous décrivent le comportement technique du prototype. Elles ne constituent pas une promesse de performance publique. La latence est aussi un enjeu de mise en scène : une pause peut être perçue comme une hésitation, une émotion ou un dysfonctionnement. Le schéma qui précède le panneau PostHog est un budget de conception, pas une performance atteinte.

Budget de latence — ordres de grandeur

Budgets de conception cumulés (hors STT, hors avatar) : ~2.8 s. Budget de conception visé côté expérience : ~2 s — ce n’est pas une performance atteinte. Référence marché d’une cascade voix minimale : ~500 ms dans le meilleur cas documenté, pas une mesure de ce prototype.

Sources : pipeline Notion Où est Ava ? (prototypeDiagrams), benchmarks portail (sttData, pipelineData, WhatWeHaveDiagram).

Parcourez chaque maillon. Les durées indiquées sont des budgets de conception. Les mesures réelles sont dans le panneau PostHog, en dessous. Elles ne constituent pas une promesse de performance publique.

STT + orchestrateur AVA

Transcription vocale en streaming WebSocket + VAD — premier maillon mesurable du tour audio.

Services utilisés

  • →Orchestrateur du prototype AVA
  • →Deepgram (transcription)
  • →Autres services STT en comparaison

Fourchette / budget

Marché : ~75–200 ms (Deepgram Nova, streaming P90 / typique)

Enjeu narratif

Une transcription lente retarde tout le pipeline ; l'utilisateur entend déjà le silence avant que le personnage ne « réfléchisse ».

Touchez un élément pour afficher le détail ci-dessous.

Chargement des métriques PostHog…

Analytics & sessions

Métriques PostHog — latence, parcours et qualité des sessions en conditions réelles.

Suivi technique PostHog

Page de suivi pour observer les performances, objectiver les améliorations et corréler latence et qualité d'expérience.

Ouvrir les signaux techniques