Synthèse vocale neurale

TTS neuronal conçu en Europe.

Premier chunk audio en moins de 150 ms. Voix naturelles en français et plus de 40 langues. Synthèse en streaming pour les produits temps réel. Hébergé en UE, sans exposition au CLOUD Act américain.

Production en UEPremier chunk <150 msVoix neuralesHébergé en UEClonage vocal disponible
Capacités

Voix naturelles, latence réelle, données en Europe.

Premier chunk en moins de 150 ms

La synthèse vocale en streaming livre le premier chunk audio en moins de 150 ms, permettant un rythme conversationnel naturel pour les produits temps réel.

Voix neurales en plus de 40 langues

Synthèse vocale au son naturel avec une prosodie adaptée aux langues européennes. Français, allemand, espagnol, italien, portugais, néerlandais, et plus encore.

Clonage vocal disponible

Créez une voix neurale personnalisée à partir de seulement 60 secondes d'audio. Disponible sur les contrats entreprise. Préservation de voix en feuille de route pour fin 2026.

Hébergé en UE, aucun audio transatlantique

La synthèse s'exécute entièrement dans les centres de données européens (OVHcloud, Scaleway). Aucun audio ne quitte l'UE. RGPD natif par conception.

Intégration

Un endpoint, streaming ou batch.

curl https://api.voxist.com/v1/synthesize \
  -H "Authorization: Bearer $VOXIST_API_KEY" \
  -F text="Votre colis arrive demain." \
  -F voice=fr_neural_1 \
  -F format=wav

L'endpoint /v1/synthesize prend en charge la sortie en streaming et par lots, avec plusieurs formats de sortie. Disponible en SaaS européen, cloud privé ou sur site.