Architecture et technologies
L’expérience, la voix, les personnages, l’orchestration, les sources, les médias et l’observation restent des responsabilités distinctes.
Six responsabilités portent l’expérience : l’interface ; la chaîne vocale ; les personnages et leur contexte ; le Game Master ; les sources et la mémoire ; l’observation et l’exploitation.
Le prototype spécifique AVA et le Core générique sont deux développements distincts menés en parallèle. Ils partagent méthodes, observations et apprentissages, sans constituer à ce stade une implémentation unique.
Architecture d’exécution du prototype
De la parole à la restitution : le chemin qui doit répondre maintenant, puis ce qui prépare et mesure le tour suivant.
Une expérience web, une application d’édition et d’orchestration, des services IA et des contenus reliés par des flux clairement séparés.
Expérience web
Services IA · écoute
Édition & orchestration
Mémoire narrative
Orchestration
Services IA · réponse
Autour du chemin audible
Déclenchées vers l’expérience, séparément de l’avatar.
Latence et traces, sans retarder la réponse.
Focus du schéma
Moteur de conversation
Ce moteur organise le tour en direct. Il demande le contexte utile, appelle le modèle de réponse et transmet uniquement le texte final à la restitution.
Stack logicielle
17 composants reliés — logos, rôles, flux vocal et liens entre outils.
Trois couches reliées : où l'on écrit (Notion), comment l'expérience est orchestrée (API, RAG, GM), quels services externes écoutent et parlent (Deepgram, OpenRouter, TTS…). Cliquez un composant pour le détail et ses liens.
Outils de création / édition
Application / orchestration
Application / orchestration
Orchestrateur du prototype AVA
Chef d'orchestre technique — enchaîne STT, RAG, GM, LLM, TTS par tour
Ce n’est pas le Core générique. C’est l’orchestrateur spécifique du prototype AVA (edge functions Supabase dans ava-proto1) : réécriture de requête, retrieval isolé par personnage, génération, validation, synthèse phrase par phrase. Sur le chemin temps réel, le Game Master pré-tour a été retiré ; le Game Master relationnel tourne après le tour, sans validation bloquante avant chaque réplique. Le Core générique est un développement parallèle, pas cette implémentation.
Ce que fait ce composant
- Edge functions : proxy-llm, proxy-stt, proxy-tts, query-rag, rewrite-query…
- Agrège latences par segment pour l'admin et PostHog.
- Persiste sessions, conversation_log, voice_turn_events.
Dans le flux d'un tour
Tour entrant : STT → rewrite-query → RAG → Max LLM → validateur → TTS → GM post-turn (async)
Liens avec les autres composants
La couche en une phrase
Couche visible par la personne et par l’équipe : l’expérience dans le navigateur, l’orchestrateur du prototype AVA, le back-office de contrôle, et la mémoire isolée par personnage.
Aller plus loin
Infrastructure / services
Touchez un élément pour afficher le détail ci-dessous.
Trois couches reliées : où l'on écrit (Notion), comment l'expérience est orchestrée (API, RAG, GM), quels services externes écoutent et parlent (Deepgram, OpenRouter, TTS…). Cliquez un composant pour le détail et ses liens.
Outils de création / édition
Application / orchestration
Infrastructure / services
Application / orchestration
Orchestrateur du prototype AVA
Chef d'orchestre technique — enchaîne STT, RAG, GM, LLM, TTS par tour
Ce n’est pas le Core générique. C’est l’orchestrateur spécifique du prototype AVA (edge functions Supabase dans ava-proto1) : réécriture de requête, retrieval isolé par personnage, génération, validation, synthèse phrase par phrase. Sur le chemin temps réel, le Game Master pré-tour a été retiré ; le Game Master relationnel tourne après le tour, sans validation bloquante avant chaque réplique. Le Core générique est un développement parallèle, pas cette implémentation.
Ce que fait ce composant
- Edge functions : proxy-llm, proxy-stt, proxy-tts, query-rag, rewrite-query…
- Agrège latences par segment pour l'admin et PostHog.
- Persiste sessions, conversation_log, voice_turn_events.
Dans le flux d'un tour
Tour entrant : STT → rewrite-query → RAG → Max LLM → validateur → TTS → GM post-turn (async)
Liens avec les autres composants
La couche en une phrase
Couche visible par la personne et par l’équipe : l’expérience dans le navigateur, l’orchestrateur du prototype AVA, le back-office de contrôle, et la mémoire isolée par personnage.
Aller plus loin
Game Master & RAG narratif
Trois angles — pourquoi un GM, son rôle concret, et les risques du RAG fictionnel.
Un personnage IA ne peut pas seulement être un LLM « bien prompté ». Il doit respecter ce qu'il sait, ce qu'il ignore, ce qu'il cache, son état émotionnel et le rythme de l'expérience. Le Game Master agit comme un réalisateur invisible.
La difficulté n'est pas seulement de faire parler Max. La difficulté est de l'empêcher d'en savoir trop, de répondre trop bien, ou de sortir de son monde.
Les enjeux techniques principaux
Sept tensions structurantes — parcourez la liste pour le détail de chaque enjeu.
Sept tensions qui structurent le développement — parcourez chaque enjeu pour voir les leviers d'action.
Latence
Enjeu critique — cible < 1.5s bout-en-bout
Leviers d'action
- STT rapide (< 300ms)
- LLM réactif (streaming)
- TTS fluide (TTFA < 400ms)
- Feedback visuel pendant l'attente
Touchez un élément pour afficher le détail ci-dessous.
Sept tensions qui structurent le développement — parcourez chaque enjeu pour voir les leviers d'action.
Latence
Enjeu critique — cible < 1.5s bout-en-bout
Leviers d'action
- STT rapide (< 300ms)
- LLM réactif (streaming)
- TTS fluide (TTFA < 400ms)
- Feedback visuel pendant l'attente