Unterstützt von Combinator

Voice AI
Made in Europe

Natürliche Stimmen in über 26 Sprachen – entwickelt und gehostet in Europa, vollständig DSGVO-konform.

Guten Tag, Ihr Termin ist am 15.03.2025 um 14:30 Uhr. Die Praxis liegt in der Hauptstraße 42a. Bei Fragen erreichen Sie uns unter 030928739954 oder info@praxis.de.

Echte Modellausgabe · erstes Audio in <50 ms

Stimmen

Stimmen, die menschlich klingen

Echte aufgenommene Stimmen – direkt streamen oder die eigene klonen.

Noah
Konversation

Noah

Schnell und klar. Kommt direkt auf den Punkt.

Olivia
Konversation

Olivia

Besonnen und warm. Bleibt auch unter Druck ruhig.

Gustav
Geschichten

Gustav

Tief und ruhig. Leise Autorität, der man vertraut.

Samantha
Konversation

Samantha

Hell und hilfsbereit. Immer zur Stelle.

Nick
Konversation

Nick

Locker und klar. Macht Komplexes einfach.

Kostenlos starten – keine Kreditkarte nötig.

Edge Cases

Auf reale Edge Cases trainiert

Straßennamen, Postleitzahlen, Telefonnummern und E-Mail-Adressen sind kein Problem mehr.

Echte Modellausgabekugel-3

Lange Zahlen, perfekt vorgelesen.

Ihre Überweisung auf IBAN DE89 3704 0044 0532 0130 00 ist bestätigt. Referenz 4 8 1 5 1 8 2 3 4 2.

Zifferngenau bei IBANs, Telefonnummern und Policen-IDs.

Testen Sie es mit Ihren schwierigsten Texten

Zahlen, Daten, Adressen und Beträge – jedes Mal korrekt ausgesprochen.

Sprachen

Sprechen Sie die Sprache Ihrer Kunden

26 Sprachen, native Aussprache, Akzente und Dialekte.

Karte der unterstützten SprachenEnglishGermanFrenchSpanishItalianPortugueseDutchPolishCzechSlovakHungarianRomanianBulgarianUkrainianSwedishDanishNorwegianFinnishCroatianSlovenianSerbianGreekTurkishArabicAmerican EnglishLatin American SpanishBrazilian PortugueseCanadian French
  • Englisch
  • Deutsch
  • Französisch
  • Spanisch
  • Italienisch
  • Portugiesisch
  • Niederländisch

Zahlen & Fakten

Schnellste Zeit bis zum ersten Audio

Mediane Zeit bis zum ersten Audio im Vergleich der führenden Streaming-Sprachmodelle.

Gemessen über WebSocket-Streaming · inkl. Netzwerk-Roundtrip, ohne Verbindungsaufbau · niedriger ist besser

Bereit, diese Zahlen für sich arbeiten zu lassen?

Sprachausgabe in Echtzeit, in der EU gehostet und skalierbar mit Ihrem Produkt.

Für Entwickler

Drei Zeilen bis zur Produktion

Drop-in für Pipecat, LiveKit oder jede Pipeline, die Sie bereits betreiben.

from kugelaudio import KugelAudio
client = KugelAudio(api_key="sk-...")
client.connect() # prewarm the connection
audio = client.tts.generate(
text="Guten Tag, hier ist Lena von Kugel.",
model_id="kugel-3",
voice_id=1704,
)
audio.save("output.wav")
PipecatLiveKit

Datensouveränität

Ihre Daten bleiben in Europa

Entwickelt, trainiert und gehostet in der EU – außerhalb der Reichweite des US Cloud Act.

On-Premise

Gleiches SDK, Ihre Infrastruktur

EU-Server

Gehostet in Europa

DSGVO

Konform

Kein US Cloud Act

Ausschließlich EU-Jurisdiktion

On-Premise oder dedizierte Kapazität nötig?

Sprechen Sie mit unserem Team über Enterprise-Pläne und EU-Hosting.

Jetzt starten

Preise

Preise für die Text-to-Speech-API

Abgerechnet pro generierter Audiominute.

Enterprise

On-Premise & dedizierte Bereitstellung

  • Höhere individuelle Parallelitätslimits
  • On-Premise-Hosting
  • EU-Datenresidenz
  • 24/7 Support
  • Persönlicher Account Manager
  • Niedrigere Preise bei Nutzungszusage

kugel-2-turbo

Schnelles, günstiges Text-to-Speech-Modell

0.0375/ Min.

  • ~40–50 ms TTFA*
  • ~€26.79 / 1M Text-Tokens**
  • Integrierter Normalizer
  • Voice Cloning
  • Geschwindigkeitssteuerung
  • Break-Tokens
  • Wortgenaue Timestamps
  • Wörterbücher
API-Zugang erhalten

kugel-3

Premium-Text-to-Speech-Modell mit höchster Natürlichkeit

0.075/ Min.

  • ~60–80 ms TTFA*
  • ~€53.57 / 1M Text-Tokens**
  • Integrierter Normalizer
  • Voice Cloning
  • Geschwindigkeitssteuerung
  • Break-Tokens
  • Wortgenaue Timestamps
  • Wörterbücher
  • IPA-Notation
API-Zugang erhalten

* Inference-TTFA, serverseitig gemessen. Mehr in den Latenz-Docs

** Token-Kosten basieren auf einer Umrechnung von ca. 1,400 Tokens pro Minute.