GamiWays
STT+RAG+LLM+TTS

Simulateur de coûts — Pipeline Vocal

Estimez le coût mensuel réel de votre pipeline vocal (STT + RAG + LLM + TTS) en tenant compte des plans d'abonnement, des minutes incluses, des topups et des limites de streams parallèles.

Démarrer avec un preset

Volume d'utilisation

Définissez le nombre d'utilisateurs et la durée de session — le total de minutes est calculé automatiquement. Les streams parallèles définissent la capacité simultanée et peuvent déclencher des alertes de plan.

Utilisateurs / mois250
1050010k
Durée moyenne / session10 min
2 min30 min120 min
Streams parallèles simultanés10 streams
1 stream50 streams1000 streams
Utilisateurs/mois
250
Durée moy./session
10 min
Total minutes/mois
2.5k
250 × 10 min
Streams parallèles
10
capacité simultanée
Formule : Coût variable mensuel = (coût/min STT + RAG + LLM + TTS) × 250 utilisateurs × 10 min/session = 2,500 min/mois. Les streams parallèles (10) définissent la capacité simultanée et peuvent imposer un plan d'abonnement spécifique.

1 — Reconnaissance vocale (STT)

2 — Base de connaissances (RAG)

Coût fixe mensuel : $25/mo (base vectorielle) — indépendant du volume

3 — Modèle de langage (LLM)

Hypothèse : 2 tours/min, ~2 000 tokens d'entrée + ~150 tokens de sortie par tour.

4 — Synthèse vocale (TTS)

Résultats de la simulation

Coût total / mois (variable)
$455
250 util. × 10 min + $25 RAG
Coût optimal / mois (plans inclus)
$455
Meilleur plan STT + TTS + LLM
Coût / utilisateur
$1.72
10 min × $0.172/min
Latence pipeline estimée
625ms
STT + RAG + LLM + TTS
Plan optimal recommandé pour votre volume(2,500 min/mois)
STT — Deepgram Nova-3
Pay As You Go
dépassement $0.00430/min
$11/mo
LLM — Gemini 2.0 Flash
Pay As You Go
dépassement $0.00052/min
$1/mo

Le plan « Gratuit (Google AI Studio) » inclut 0 min mais ne permet pas de dépassement. Votre volume (2,500 min/mois) dépasse ce seuil de 2,500 min — plan « Pay As You Go » sélectionné automatiquement.

TTS — Eleven v4 / v4 Turbo
Scale
$299/mo + dépassement $0.170/min
$418/mo

Le plan « Gratuit » coûterait $896.40/mois avec dépassement. Le plan « Scale » ($299/mois + 1,800 min incluses) revient à $418.00/mois — économie de $478.40/mois.

Répartition des coûts variables
TTS 97%
ComposantProvider$/min (plan optimal)Plan sélectionné$/util. (plan)Total/mois
STTDeepgram Nova-3$0.00430Pay As You Go$0.043$11
RAGVoyage AI + Supabase pgvector$0.00000Gratuit + Supabase Gratuit$0.00000$0.00+$25
LLMGemini 2.0 Flash$0.00052Pay As You Go$0.00520$1
TTSEleven v4 / v4 Turbo$0.167$0.200Scale$299/mo$1.67$418
Total (plans optimaux)$1.72$455
TOTAL OPTIMAL (meilleurs plans)—$455
Décomposition de la latence pipeline (estimée)
75ms
STT
50ms
RAG
300ms
LLM TTFT
200ms
TTS TTFA
Total estimé :625ms⚠ Acceptable mais optimisable

Comparaison des presets sur votre volume

Coût mensuel estimé pour 250 utilisateurs × 10 min/session = 2,500 min/mois. 10 streams parallèles.

PresetSTTRAGLLMTTS$/util.Total/moisLatenceEUStreams
Storygami — Optimal
$11$0.00+$25$1$500$2.05$537625ms∞
Storygami — Budget
$4$0.00+$25$1$31$0.147$62542ms∞
Edugami — Optimal
$5$0.00+$25$1$50$0.225$81769ms∞
Stack Souverain EU
$26$0.00+$25$1$108$0.542$160686ms60
Auto-hébergé (Open-Source)
$0.00$0.00$0.00$2$0.00700$2650ms∞
Comparatif STT complet
15 moteurs, benchmarks WER
Comparatif TTS complet
25 moteurs, ELO, expressivité
Pipeline V2V interactif
Diagramme latence & composants