Apoiado por Combinator

Voice AI
Feita na Europa

Vozes naturais em mais de 26 idiomas, desenvolvidas e alojadas na Europa, em total conformidade com o RGPD.

Boa tarde, a sua consulta é no dia 15/03/2025 às 14h30. O consultório fica na Rua da Ponte 42a. Para dúvidas, contacte-nos pelo 211234567 ou info@consultorio.pt.

Saída real do modelo · primeiro áudio em <50 ms

Vozes

Vozes que soam humanas

Vozes reais gravadas, prontas para streaming — ou clone a sua própria.

Olivia
Conversacional

Olivia

Serena e calorosa. Mantém a calma sob pressão.

Samantha
Conversacional

Samantha

Luminosa e prestável. Sempre pronta a ajudar.

Noah
ConversacionalInglês

Noah

Rápido e claro. Vai direto ao assunto.

Gustav
HistóriaInglês

Gustav

Profundo e firme. Autoridade tranquila que inspira confiança.

Nick
ConversacionalInglês

Nick

Descontraído e claro. Torna simples o que é complexo.

Comece grátis — sem cartão de crédito.

Casos limite

Treinado em casos limite reais

Nomes de ruas, códigos postais, números de telefone e endereços de e-mail já não são problema.

Saída real do modelokugel-3

Números longos, lidos na perfeição.

A sua transferência para o IBAN DE89 3704 0044 0532 0130 00 está confirmada. Referência 4 8 1 5 1 8 2 3 4 2

IBAN, números de telefone e identificadores, dígito a dígito.

Teste com os seus textos mais difíceis

Números, datas, moradas e valores, pronunciados corretamente, sempre.

Idiomas

Fale a língua dos seus clientes

26 idiomas, pronúncia nativa, sotaques e dialetos.

Mapa dos idiomas suportadosEnglishGermanFrenchSpanishItalianPortugueseDutchPolishCzechSlovakHungarianRomanianBulgarianUkrainianSwedishDanishNorwegianFinnishCroatianSlovenianSerbianGreekTurkishArabicAmerican EnglishLatin American SpanishBrazilian PortugueseCanadian French
  • Inglês
  • Alemão
  • Francês
  • Espanhol
  • Italiano
  • Português
  • Neerlandês

Em números

O tempo até o primeiro áudio mais rápido

Tempo mediano até o primeiro áudio entre os principais modelos de voz em streaming.

Medido por streaming WebSocket · ida e volta de rede incluída, estabelecimento de conexão excluído · menor é melhor

Pronto para pôr estes números a trabalhar?

Voz em tempo real, alojada na UE, que escala com o seu produto.

Programadores

Três linhas até à produção

Integração direta com Pipecat, LiveKit ou qualquer pipeline que já utilize.

from kugelaudio import KugelAudio
client = KugelAudio(api_key="sk-...")
client.connect() # prewarm the connection
audio = client.tts.generate(
text="Bom dia, aqui é a Lena da Kugel.",
model_id="kugel-3",
voice_id=1142,
)
audio.save("output.wav")
PipecatLiveKit

Soberania de Dados

Os seus dados ficam na Europa

Desenvolvido, treinado e alojado na UE — fora do alcance do Cloud Act dos EUA.

On-Premise

Mesmo SDK, a sua infraestrutura

Servidores na UE

Alojados na Europa

RGPD

Em conformidade

Sem US Cloud Act

Apenas jurisdição da UE

Precisa de on-premise ou capacidade dedicada?

Fale com a nossa equipa sobre planos Enterprise e alojamento na UE.

Começar

Preços

Tarifas da API de texto para fala

Preço por minuto de áudio gerado.

Enterprise

Implementação on-premise e dedicada

  • Limites de concorrência personalizados mais elevados
  • Alojamento on-premise
  • Residência de dados na UE
  • Suporte 24/7
  • Gestor de conta dedicado
  • Tarifas mais baixas com utilização contratada

kugel-2-turbo

Modelo de texto para voz rápido e económico

0.0375/ min

  • ~40–50 ms TTFA*
  • ~€26.79 / 1M tokens de texto**
  • Normalizador integrado
  • Clonagem de voz
  • Controlo de velocidade
  • Tokens de pausa
  • Timestamps ao nível da palavra
  • Dicionários
Obter acesso à API

kugel-3

Modelo de texto para voz premium com naturalidade máxima

0.075/ min

  • ~60–80 ms TTFA*
  • ~€53.57 / 1M tokens de texto**
  • Normalizador integrado
  • Clonagem de voz
  • Controlo de velocidade
  • Tokens de pausa
  • Timestamps ao nível da palavra
  • Dicionários
  • Notações IPA
Obter acesso à API

* TTFA de inferência, medido no servidor. Mais na documentação de latência

** Os custos por token usam uma conversão aproximada de 1,400 tokens por minuto.