Przejdź do interaktywnej prezentacji
Strona główna

Usuń szumy.
Zostaw głos.

Usuwanie szumów i wyodrębnianie głównego mówcy w czasie rzeczywistym: wszystkie inne głosy są wycinane, więc zostaje tylko Twój rozmówca.

Głośne miejsca.
Czyste rozmowy.

Ludzie dzwonią z kawiarni, biur coworkingowych i ruchliwych ulic. Clarity pomaga Twojemu agentowi głosowemu skupić się na osobie po drugiej stronie linii.

Clarity robi dwie rzeczy, w czasie rzeczywistym. Usuwa szumy tła. I wyodrębnia głównego mówcę: wszystkie inne głosy, od gwaru w kawiarni po osobę przy sąsiednim biurku, są wycinane, więc przebija się tylko Twój rozmówca.

Twój agent głosowy rozumie wtedy rozmówcę, a nie otoczenie: rozpoznawanie mowy, wykrywanie końca wypowiedzi i model, który za tym stoi, pracują na jednym czystym głosie.

Słyszysz różnicę?
Wypróbuj Clarity na własnym nagraniu.

Stworzone do prawdziwych rozmów.

Twój agent głosowy słyszy tylko rozmówcę.

Clarity usuwa szumy tła i gwar, zanim usłyszy je Twój agent głosowy, dzięki czemu wykrywanie końca wypowiedzi i rozpoznawanie mowy reagują wyłącznie na rozmówcę.

Poddane próbie.
W starciu z najlepszymi.

Jakość wyodrębniania mówcy

Libri2Mix · DNSMOS, wyżej znaczy lepiej

MetrykaClarity 1240 msStarTSE[1]560 ms
Jakość mowy SIG3.56 (najlepszy)3.54
Jakość tła BAK4.03 (najlepszy)3.75
Jakość ogólna OVRL3.27 (najlepszy)3.12

Usuwanie szumów

DNS 2020 Challenge · DNSMOS, wyżej znaczy lepiej

MetrykaClarity 1240 msBez przetwarzaniaOryginalne nagranieAI Acoustics15 msDeepFilterNet310 msGTCRN16 ms
Jakość mowy SIG3.62 (najlepszy)3.393.463.513.34
Jakość tła BAK4.11 (najlepszy)2.623.604.11 (najlepszy)3.98
Jakość ogólna OVRL3.37 (najlepszy)2.482.983.253.05

Warto wiedzieć.

Czym jest Clarity?

Clarity to model poprawy jakości mowy, który wykonuje dwa zadania w czasie rzeczywistym. Usuwa szumy tła i wyodrębnia głównego mówcę: wszystkie inne głosy, takie jak gwar w kawiarni czy pobliscy współpracownicy, są wycinane, więc zostaje tylko ten jeden ważny głos. Ktokolwiek słucha, człowiek czy agent głosowy, słyszy wyraźną mowę.

Skąd wie, który głos zostawić?

Wyodrębnianie głównego mówcy korzysta z krótkiego nagrania referencyjnego osoby, za którą ma podążać, i wycina wszystkie inne głosy. Bez nagrania referencyjnego zostawia najgłośniejszego mówcę.

Czy pomaga mojemu agentowi głosowemu rozumieć rozmówców?

Tak. Rozpoznawanie mowy, wykrywanie końca wypowiedzi i model językowy stojący za Twoim agentem mogą pracować tylko na dźwięku, który dostają, więc Clarity daje im jeden czysty głos: Twojego rozmówcy. Osoby w tle przestają trafiać do transkrypcji i uruchamiać wykrywania końca wypowiedzi, a agent odpowiada rozmówcy, a nie otoczeniu.

Czy czeka, aż rozmówca skończy?

Nie. Clarity przetwarza dźwięk w ciągłym strumieniu, na bieżąco. Jest stworzone do rozmów na żywo, a nie do czekania na gotowe nagranie.

Czy mogę usłyszeć to na własnym nagraniu?

Tak. Zarejestruj się i przepuść własne nagrania przez Clarity w panelu, za darmo do 30 października. W sprawie wdrożenia we własnej infrastrukturze lub większego wdrożenia skontaktuj się z nami i przynieś przykłady ze środowisk Twoich rozmówców.

Usłysz to na własnych rozmowach.
Zacznij od Clarity.