Smallest.ai Lightning V3.1
Full voice pipeline (TTS + STT + LLM + S2S) — sub-100ms, 15+ languages
Scores comparatifs
Architecture
Très pertinent pour GamiWays comme alternative de pipeline voix complète. Hydra S2S (full-duplex natif) répond directement au besoin GamiWays Phase B pour la conversation avec gestion des interruptions. Electron LLM permet une pipeline entièrement intégrée chez un seul fournisseur. Recommandé pour : évaluation Phase B (Hydra S2S), pipeline production économique, déploiements HIPAA.
Analyse
Smallest.ai est une plateforme voice AI temps réel full-stack proposant quatre modèles intégrés : Lightning TTS (sub-100ms, 217 voix, 12 langues, 44,1 kHz, ~$25/1M chars), Pulse STT (38 langues, diarisation, détection émotion, ~$0,005/min), Electron LLM (sub-3B, sub-300ms TTFT, 70 langues, compatible OpenAI), et Hydra Speech-to-Speech (full-duplex natif, sub-300ms, accès anticipé). Conformité SOC 2, RGPD, HIPAA, ISO 27001. On-premises disponible sur Enterprise.
Points forts
- Pipeline complète : TTS + STT + LLM + S2S en une seule plateforme
- Latence Lightning TTS sub-100ms
- Hydra : full-duplex natif S2S (accès anticipé)
- Pulse STT : 38 langues + détection émotion
- Electron LLM : sub-3B, compatible OpenAI
- Conformité SOC 2, RGPD, HIPAA, ISO 27001
- Option on-premises enterprise
Limitations
- Pas de score ELO sur Artificial Analysis
- Hydra S2S encore en accès anticipé (liste d'attente)
- Electron LLM non accessible en pay-as-you-go
- Clonage vocal : plan Enterprise uniquement pour production
- Pas de timestamps lip-sync
- Entreprise US (conformité RGPD via contractuel)
Capacités vocales
Instant voice cloning in under 10 seconds. No professional equipment required. Enterprise plan only for production use.
Le débit et l’identité vocale sont pilotables ; aucun contrôle émotionnel TTS explicite n’est documenté.
Comment : `speed`, `voice_id`, `model`, `language`, timestamps de mots.
À tester : Pertinent pour réactivité et synchronisation, à associer à une autre couche si l’intention de jeu est centrale.
WebSocket streaming for Lightning TTS and Pulse STT Realtime. Hydra S2S: full-duplex WebSocket (early access, sub-300ms).
No lip-sync timestamps documented for Lightning TTS.
Tarification
Lightning TTS: ~$0.025/1000 chars (~$25/1M chars). Pulse STT: ~$0.005/min (standard), ~$0.008/min (realtime). Electron LLM: Enterprise only. Hydra S2S: Early access.
Souveraineté & Conformité
On-premises deployment available on Enterprise plan. HIPAA Zero Data Retention add-on ($1000/mo on PAYG, included on Enterprise).
Résidence des données : SOC 2 Type 2, GDPR, HIPAA, ISO 27001 compliant. Headquarters: San Francisco, CA.
Pipeline voix complète
Smallest.ai propose une stack voix intégrée en 4 modèles, permettant de remplacer une pipeline assemblée (STT externe + LLM externe + TTS externe) par un seul fournisseur.
Certifications & conformité
Vérification de cette fiche
Smallest.ai docs v4.0.0 (June 2026) — Lightning: ~200ms TTFB, 217 voices, 12 languages. Hydra: sub-300ms full-duplex.
Note de mise à jour : AA Speech Arena sync 2026-08-18: ELO 1024 (rank N/A — Free tier). Name: Lightning v3.1.
Cette date concerne les prix, capacités et notes propres à cette fiche. Les benchmarks de comparaison suivent la synchronisation et la méthode indiquées dans le bloc au-dessus.
Benchmarks ELO / indices : Artificial Analysis · Dernière sync API : 18 août 2026