Unterstützt von Combinator

KI-Stimmen
aus Europa

Natürliche Stimmen in 39 Sprachen – entwickelt und gehostet in Europa, vollständig DSGVO-konform.

EU Sovereign Cloud ist für Kunden in der EU/im EWR in jedem Tarif enthalten, ohne Enterprise-Vertrag.

Guten Tag, Ihr Termin ist am 15.03.2025 um 14:30 Uhr. Die Praxis liegt in der Hauptstraße 42a. Bei Fragen erreichen Sie uns unter 030928739954 oder info@praxis.de.

Echte Modellausgabe · erstes Audio in <50 ms

Stimmen

Stimmen, die menschlich klingen

Echte aufgenommene Stimmen – direkt streamen oder die eigene klonen.

Lea Huber
Konversation

Lea Huber

Hell und hilfsbereit. Immer zur Stelle.

Antonia Meier
Konversation

Antonia Meier

Besonnen und warm. Bleibt auch unter Druck ruhig.

Celine Weber
Konversation

Celine Weber

Locker und klar. Macht Komplexes einfach.

Jonas Brandt
Konversation

Jonas Brandt

Schnell und klar. Kommt direkt auf den Punkt.

Gustav
Geschichten

Gustav

Tief und ruhig. Leise Autorität, der man vertraut.

Kostenlos starten – keine Kreditkarte nötig.

Edge Cases

Auf reale Edge Cases trainiert

Straßennamen, Postleitzahlen, Telefonnummern und E-Mail-Adressen sind kein Problem mehr.

Echte Modellausgabekugel-3

Lange Zahlen, perfekt vorgelesen.

Ihre Überweisung auf IBAN DE89 3704 0044 0532 0130 00 ist bestätigt. Referenz 4 8 1 5 1 8 2 3 4 2.

Zifferngenau bei IBANs, Telefonnummern und Policen-IDs.

Testen Sie es mit Ihren schwierigsten Texten

Zahlen, Daten, Adressen und Beträge – jedes Mal korrekt ausgesprochen.

Sprachen

Sprechen Sie die Sprache Ihrer Kunden

39 Sprachen, native Aussprache, Akzente und Dialekte.

Karte der unterstützten SprachenEnglishGermanFrenchSpanishItalianPortugueseDutchPolishCzechSlovakHungarianRomanianBulgarianUkrainianSwedishDanishNorwegianFinnishCroatianSlovenianSerbianGreekTurkishArabicAmerican EnglishLatin American SpanishBrazilian PortugueseCanadian French
  • Englisch
  • Deutsch
  • Französisch
  • Spanisch
  • Italienisch
  • Portugiesisch
  • Niederländisch

Zahlen & Fakten

Schnellste Zeit bis zum ersten Audio

Mediane Zeit bis zum ersten Audio im Vergleich der führenden Streaming-Sprachmodelle.

Gemessen über WebSocket-Streaming · inkl. Netzwerk-Roundtrip, ohne Verbindungsaufbau · niedriger ist besser

Bereit, diese Zahlen für sich arbeiten zu lassen?

Sprachausgabe in Echtzeit, in der EU gehostet und skalierbar mit Ihrem Produkt.

Für Entwickler

Drei Zeilen bis zur Produktion

Drop-in für Pipecat, LiveKit oder jede Pipeline, die Sie bereits betreiben.

from kugelaudio import KugelAudio
client = KugelAudio(api_key="sk-...")
client.connect() # prewarm the connection
audio = client.tts.generate(
text="Guten Tag, hier ist Lena von Kugel.",
model_id="kugel-3",
voice_id=1704,
language="de",
)
audio.save("output.wav")
PipecatLiveKit

Datensouveränität

Ihre Daten bleiben in Europa

Entwickelt, trainiert und gehostet in der EU.

EU-Server

Gehostet in Europa

DSGVO

Konform

Kein Training

Nie auf Ihren Inhalten

Kunden in der EU/im EWR

Sovereign Cloud

Hosting ausschließlich durch EU-Unternehmen. AWS, Google Cloud, Microsoft Azure und Lambda werden im Sovereign-Cloud-Vertrag gar nicht eingesetzt. Kein Anbieter mit US-Mutter verarbeitet Ihr Audio, Ihren Text oder Ihre Voice References; damit greift auch keine Anordnung nach dem US CLOUD Act.

Für Kunden in der EU/im EWR verfügbar

Enterprise

On-Premise

Maximale Sicherheit auf eigener Hardware. Die Modelle laufen in Ihrem Rechenzentrum, hinter Ihrer Firewall: Audio, Text und Voice References verlassen Ihre Infrastruktur nie.

Gleiches SDK und gleiche API wie beim gehosteten Dienst; Integrationen bleiben unverändert.

Preise

Preise für die Text-to-Speech-API

Preis pro Audiominute, sekundengenau abgerechnet.

Enterprise

On-Premise & dedizierte Bereitstellung

  • Höhere individuelle Parallelitätslimits
  • On-Premise-Hosting
  • 24/7 Support
  • Persönlicher Account Manager
  • Niedrigere Preise bei Nutzungszusage

kugel-2-turbo

Schnelles, günstiges Text-to-Speech-Modell

€0.035/ Min.

zzgl. USt. · €0.04165 inkl. 19 % USt.

  • ~40–50 ms TTFA*
  • ~€42.42 / 1 Mio. Zeichen**
  • Garantiertes EU-Hosting
  • EU Sovereign Cloud enthalten (EU/EWR)
  • Integrierter Normalizer
  • Voice Cloning
  • Geschwindigkeitssteuerung
  • Break-Tokens
  • Wortgenaue Timestamps
  • Wörterbücher
API-Zugang erhalten

kugel-3

Premium-Text-to-Speech-Modell mit höchster Natürlichkeit

€0.07/ Min.

zzgl. USt. · €0.0833 inkl. 19 % USt.

  • ~60–80 ms TTFA*
  • ~€84.85 / 1 Mio. Zeichen**
  • Garantiertes EU-Hosting
  • EU Sovereign Cloud enthalten (EU/EWR)
  • Integrierter Normalizer
  • Voice Cloning
  • Geschwindigkeitssteuerung
  • Break-Tokens
  • Wortgenaue Timestamps
  • Wörterbücher
  • IPA-Notation
API-Zugang erhalten

Verbraucher in anderen EU-Ländern zahlen den dort geltenden Umsatzsteuersatz; er wird vor der Zahlung angezeigt.

* Inference-TTFA, serverseitig gemessen. Mehr in den Latenz-Docs

** Zeichenkosten basieren auf der Annahme von etwa 825 Zeichen pro Minute.