Neuronale Sprachsynthese

Neuronales TTS, entwickelt in Europa.

Erster Audio-Chunk in unter 150 ms. Natürliche Stimmen in Französisch und über 40 Sprachen. Streaming-Synthese für Echtzeitprodukte. In der EU gehostet, keine Exposition gegenüber dem US CLOUD Act.

EU-ProduktionsqualitätErster Chunk <150 msNeuronale StimmenIn der EU gehostetVoice-Cloning verfügbar
Funktionen

Natürliche Stimmen, echte Latenz, Daten in Europa.

Erster Chunk in unter 150 ms

Streaming-TTS liefert den ersten Audio-Chunk in unter 150 ms und ermöglicht so ein natürliches Gesprächstempo für Echtzeitprodukte.

Neuronale Stimmen in über 40 Sprachen

Natürlich klingende Sprachsynthese mit einer auf europäische Sprachen abgestimmten Prosodie. Französisch, Deutsch, Spanisch, Italienisch, Portugiesisch, Niederländisch und mehr.

Voice-Cloning verfügbar

Erstellen Sie eine individuelle neuronale Stimme aus nur 60 Sekunden Audio. Verfügbar in Enterprise-Verträgen. Stimmkonservierung in der Roadmap für Ende 2026 vorgesehen.

In der EU gehostet, kein transatlantisches Audio

Die Synthese läuft vollständig in europäischen Rechenzentren (OVHcloud, Scaleway). Kein Audio verlässt die EU. DSGVO-konform durch Design.

Integration

Ein Endpunkt, Streaming oder Batch.

curl https://api.voxist.com/v1/synthesize \
  -H "Authorization: Bearer $VOXIST_API_KEY" \
  -F text="Votre colis arrive demain." \
  -F voice=fr_neural_1 \
  -F format=wav

Der Endpunkt /v1/synthesize unterstützt Streaming- und Batch-Ausgabe mit mehreren Ausgabeformaten. Verfügbar als europäisches SaaS, Private Cloud oder On-Premise.