Supportato da Combinator

Voice AI
Made in Europe

Voci naturali in oltre 26 lingue, sviluppate e ospitate in Europa, pienamente conformi al GDPR.

Buongiorno, il suo appuntamento è il 15/03/2025 alle 14:30. Lo studio si trova in Via del Ponte 42a. Per domande, ci contatti al 0612345678 o info@studio.it.

Output reale del modello · primo audio in <50 ms

Voci

Voci che suonano umane

Voci registrate reali, pronte per lo streaming — o clona la tua.

Olivia
Conversazionale

Olivia

Composta e calorosa. Resta calma sotto pressione.

Nick
Conversazionale

Nick

Rilassato e chiaro. Rende semplici le cose complesse.

Noah
ConversazionaleInglese

Noah

Rapido e chiaro. Va dritto al punto.

Gustav
RaccontoInglese

Gustav

Profondo e costante. Un'autorevolezza tranquilla che ispira fiducia.

Samantha
ConversazionaleInglese

Samantha

Brillante e disponibile. Sempre pronta ad aiutarti.

Inizia gratis, senza carta di credito.

Casi limite

Addestrato sui casi limite reali

Nomi di strade, codici postali, numeri di telefono e indirizzi e-mail non sono più un problema.

Output reale del modellokugel-3

Numeri lunghi, letti alla perfezione.

Il suo bonifico verso l'IBAN DE89 3704 0044 0532 0130 00 è confermato. Riferimento 4 8 1 5 1 8 2 3 4 2

IBAN, numeri di telefono e codici polizza, cifra per cifra.

Mettilo alla prova con i testi più difficili

Numeri, date, indirizzi e importi: pronunciati correttamente, ogni volta.

Lingue

Parla la lingua dei tuoi clienti

26 lingue, pronuncia nativa, accenti e dialetti.

Mappa delle lingue supportateEnglishGermanFrenchSpanishItalianPortugueseDutchPolishCzechSlovakHungarianRomanianBulgarianUkrainianSwedishDanishNorwegianFinnishCroatianSlovenianSerbianGreekTurkishArabicAmerican EnglishLatin American SpanishBrazilian PortugueseCanadian French
  • Inglese
  • Tedesco
  • Francese
  • Spagnolo
  • Italiano
  • Portoghese
  • Olandese

In cifre

Il tempo al primo audio più rapido

Tempo mediano al primo audio tra i principali modelli vocali in streaming.

Misurato in streaming WebSocket · round-trip di rete incluso, connessione esclusa · più basso è meglio

Pronto a mettere al lavoro questi numeri?

Voce in tempo reale, ospitata nell'UE, che cresce con il tuo prodotto.

Sviluppatori

Tre righe e sei in produzione

Integrazione immediata con Pipecat, LiveKit o qualsiasi pipeline tu stia già usando.

from kugelaudio import KugelAudio
client = KugelAudio(api_key="sk-...")
client.connect() # prewarm the connection
audio = client.tts.generate(
text="Buongiorno, sono Lena di Kugel.",
model_id="kugel-3",
voice_id=1131,
)
audio.save("output.wav")
PipecatLiveKit

Sovranità dei dati

I tuoi dati restano in Europa

Sviluppata, addestrata e ospitata nell'UE — fuori dalla portata del Cloud Act statunitense.

On-Premise

Stesso SDK, la tua infrastruttura

Server UE

Ospitati in Europa

GDPR

Conforme

Niente Cloud Act USA

Solo giurisdizione UE

Ti serve on-premise o capacità dedicata?

Parla con il nostro team dei piani Enterprise e dell'hosting nell'UE.

Inizia

Prezzi

Tariffe API text-to-speech

Prezzo per minuto di audio generato.

Enterprise

Deployment on-premise e dedicato

  • Limiti di concorrenza personalizzati più alti
  • Hosting on-premise
  • Residenza dei dati nell'UE
  • Supporto 24/7
  • Account manager dedicato
  • Tariffe ridotte con utilizzo concordato

kugel-2-turbo

Modello di sintesi vocale rapido ed economico

0.0375/ min

  • ~40–50 ms TTFA*
  • ~€26.79 / 1M token di testo**
  • Normalizzatore integrato
  • Clonazione vocale
  • Controllo della velocità
  • Token di pausa
  • Timestamp a livello di parola
  • Dizionari
Ottieni l'accesso API

kugel-3

Modello di sintesi vocale premium con la massima naturalezza

0.075/ min

  • ~60–80 ms TTFA*
  • ~€53.57 / 1M token di testo**
  • Normalizzatore integrato
  • Clonazione vocale
  • Controllo della velocità
  • Token di pausa
  • Timestamp a livello di parola
  • Dizionari
  • Notazioni IPA
Ottieni l'accesso API

* TTFA di inferenza, misurato lato server. Maggiori dettagli nella documentazione sulla latenza

** I costi in token si basano su una conversione approssimativa di 1,400 token al minuto.