TTS neuronal conçu en Europe.
Premier chunk audio en moins de 150 ms. Voix naturelles en français et plus de 40 langues. Synthèse en streaming pour les produits temps réel. Hébergé en UE, sans exposition au CLOUD Act américain.
Voix naturelles, latence réelle, données en Europe.
Premier chunk en moins de 150 ms
La synthèse vocale en streaming livre le premier chunk audio en moins de 150 ms, permettant un rythme conversationnel naturel pour les produits temps réel.
Voix neurales en plus de 40 langues
Synthèse vocale au son naturel avec une prosodie adaptée aux langues européennes. Français, allemand, espagnol, italien, portugais, néerlandais, et plus encore.
Clonage vocal disponible
Créez une voix neurale personnalisée à partir de seulement 60 secondes d'audio. Disponible sur les contrats entreprise. Préservation de voix en feuille de route pour fin 2026.
Hébergé en UE, aucun audio transatlantique
La synthèse s'exécute entièrement dans les centres de données européens (OVHcloud, Scaleway). Aucun audio ne quitte l'UE. RGPD natif par conception.
Un endpoint, streaming ou batch.
curl https://api.voxist.com/v1/synthesize \
-H "Authorization: Bearer $VOXIST_API_KEY" \
-F text="Votre colis arrive demain." \
-F voice=fr_neural_1 \
-F format=wavL'endpoint /v1/synthesize prend en charge la sortie en streaming et par lots, avec plusieurs formats de sortie. Disponible en SaaS européen, cloud privé ou sur site.