Neuronales TTS, entwickelt in Europa.
Erster Audio-Chunk in unter 150 ms. Natürliche Stimmen in Französisch und über 40 Sprachen. Streaming-Synthese für Echtzeitprodukte. In der EU gehostet, keine Exposition gegenüber dem US CLOUD Act.
Natürliche Stimmen, echte Latenz, Daten in Europa.
Erster Chunk in unter 150 ms
Streaming-TTS liefert den ersten Audio-Chunk in unter 150 ms und ermöglicht so ein natürliches Gesprächstempo für Echtzeitprodukte.
Neuronale Stimmen in über 40 Sprachen
Natürlich klingende Sprachsynthese mit einer auf europäische Sprachen abgestimmten Prosodie. Französisch, Deutsch, Spanisch, Italienisch, Portugiesisch, Niederländisch und mehr.
Voice-Cloning verfügbar
Erstellen Sie eine individuelle neuronale Stimme aus nur 60 Sekunden Audio. Verfügbar in Enterprise-Verträgen. Stimmkonservierung in der Roadmap für Ende 2026 vorgesehen.
In der EU gehostet, kein transatlantisches Audio
Die Synthese läuft vollständig in europäischen Rechenzentren (OVHcloud, Scaleway). Kein Audio verlässt die EU. DSGVO-konform durch Design.
Ein Endpunkt, Streaming oder Batch.
curl https://api.voxist.com/v1/synthesize \
-H "Authorization: Bearer $VOXIST_API_KEY" \
-F text="Votre colis arrive demain." \
-F voice=fr_neural_1 \
-F format=wavDer Endpunkt /v1/synthesize unterstützt Streaming- und Batch-Ausgabe mit mehreren Ausgabeformaten. Verfügbar als europäisches SaaS, Private Cloud oder On-Premise.