Text to Speech

Text to Speech auf Englisch

Im Studio aufgenommene englische Stimmen, gebaut für Voice Agents, die antworten müssen, während der Anrufer noch in der Leitung ist. Hören Sie, wie sie Zahlen, Abkürzungen und Markennamen behandeln.

Anhören

5 englische Stimmen

Das sind unsere Studioproben: dieselben Stimmen, die die API ausliefert, kein Marketingschnitt.

  • Noah

    Native Aufnahme

  • Olivia

    Native Aufnahme

  • Gustav

    Native Aufnahme

  • Samantha

    Native Aufnahme

  • Nick

    Native Aufnahme

Details

Worauf wir bei dieser Sprache achten

  • Für Unterbrechungen gebaut

    Die meisten Voice Agents starten auf Englisch, und ein Agent lebt von der Pause vor dem ersten Ton. Kugel 3 streamt Audio, während der Text noch eintrifft, sodass die erste Silbe den Server verlässt, lange bevor der Satz fertig ist.

  • Abkürzungen, Zahlen und Beträge

    Auftragsnummern, Beträge und Abkürzungen kommen in keiner Demo vor und in jeder Produktion. Unsere Normalisierung entscheidet vor der Synthese, wo Buchstaben einzeln und wo ein Wort gelesen wird.

  • Markennamen, wie Sie sie sprechen

    Jedes Unternehmen hat eine Handvoll Wörter, an denen generische Sprachausgabe scheitert. Einmal ins Aussprachewörterbuch eingetragen, spricht jede englische Stimme Ihres Accounts sie identisch aus.

Häufige Fragen

Häufige Fragen zu englischer Sprachausgabe

Wie viele englische Stimmen sind auf dieser Seite?

Es sind 5. Jede ist ein eigener Sprecher und nicht dieselbe Stimme mit verschobener Tonhöhe, und dasselbe Modell Kugel 3 spricht auch die übrigen 25 unterstützten Sprachen.

Ist das schnell genug für einen Live-Voice-Agent?

Ja. Die API streamt über WebSocket und liefert Audio, bevor der Text vollständig ist. Genau das verhindert, dass ein Telefonat wie ein Funkgerät klingt. Sie lässt sich direkt in Pipecat und LiveKit einsetzen.

Darf ich das kommerziell einsetzen?

Ja. In den bezahlten Tarifen ist die kommerzielle Nutzung enthalten, und es gibt ein kostenloses Kontingent zum Testen. Abgerechnet wird nach erzeugter Audiozeit, ohne Lizenzgebühr pro Stimme.

Text to Speech

Weitere Sprachen mit nativen Stimmen

Für diese Sprachen haben wir eigene Stimmen aufgenommen. Kugel 3 spricht insgesamt 26.

Diese Stimme in Ihr Produkt bringen

Eine API für Streaming-Sprachausgabe, ein Aussprachewörterbuch für Ihr eigenes Vokabular und Betrieb in der EU oder in Ihrem eigenen Rechenzentrum.