TTS neurale progettato in Europa.
Primo chunk audio in meno di 150 ms. Voci naturali in francese e oltre 40 lingue. Sintesi in streaming per prodotti in tempo reale. Ospitato nell'UE, senza esposizione al CLOUD Act statunitense.
Voci naturali, latenza reale, dati in Europa.
Primo chunk in meno di 150 ms
La sintesi vocale in streaming fornisce il primo chunk audio in meno di 150 ms, consentendo un ritmo conversazionale naturale per i prodotti in tempo reale.
Voci neurali in oltre 40 lingue
Sintesi vocale dal suono naturale con una prosodia ottimizzata per le lingue europee. Francese, tedesco, spagnolo, italiano, portoghese, olandese e altre ancora.
Clonazione vocale disponibile
Crea una voce neurale personalizzata a partire da appena 60 secondi di audio. Disponibile sui contratti enterprise. Preservazione vocale prevista nella roadmap per la fine del 2026.
Ospitato nell'UE, nessun audio transatlantico
La sintesi viene eseguita interamente all'interno dei data center europei (OVHcloud, Scaleway). Nessun audio lascia l'UE. Conforme al GDPR fin dalla progettazione.
Un solo endpoint, streaming o batch.
curl https://api.voxist.com/v1/synthesize \
-H "Authorization: Bearer $VOXIST_API_KEY" \
-F text="Votre colis arrive demain." \
-F voice=fr_neural_1 \
-F format=wavL'endpoint /v1/synthesize supporta l'output in streaming e in batch, con più formati di output. Disponibile come SaaS europeo, cloud privato o on-premise.