Řetězec zpracování
Vše začíná jedním zvukovým signálem a končí na zařízení každého posluchače, souběžně pro každý jazyk:
- 1
Zvuk ze scény
Jeden signál z vašeho mixážního pultu - libovolný počet mikrofonů, panelů a přehrávaných zdrojů, smíchaný vaším zvukařem přesně jako dnes.
- 2
Rozpoznávání řeči
Streamované rozpoznávání pracující s frázemi počká, až se fráze ustálí, takže do překladu jdou celé, hotové věty místo útržků.
- 3
AI překlad
Překlad zohledňující kontext si drží průběžný kontext vystoupení a respektuje slovníček a terminologii vaší akce.
- 4
Neuronový hlas
Přirozený neuronový hlas mluví v každém cílovém jazyce souběžně - jeden kanál na jazyk.
- 5
Doručení
Zvuk a živé titulky se dostanou ke každému posluchači přes WebRTC - telefony v sále, vzdálené prohlížeče, obrazovky v prostoru i produkční nástroje.
Celkové zpoždění je obvykle asi 5 sekund od vyslovené fráze k tlumočenému hlasu. Platforma ho měří nepřetržitě: po každé relaci dostanete zprávu o latenci pro každý jazyk (medián a p99), takže kvalitu potvrzují data, ne dojmy.
Enginy a hlasy
Interpretwise na pozadí provozuje několik enginů pro rozpoznávání řeči, překlad i syntézu hlasu a pro každou jazykovou dvojici vybírá nejlepší kombinaci, s automatickým přepnutím mezi enginy i uprostřed relace. Hlasy jsou ve dvou úrovních:
- Hlasy Premium - Nejpřirozenější volba, doporučená pro obsah ze scény.
- Hlasy Standard - Rozsáhlý katalog pokrývající celou jazykovou nabídku za nižší sazbu.
Lidé v procesu
Jedna akce může kombinovat AI tlumočení a profesionální tlumočníky kanál po kanálu: například AI pro šest jazyků a živého tlumočníka pro sedmý. Tlumočníci pracují odkudkoli přes konzoli v prohlížeči - bez instalace, chráněnou přístupovým kódem pro danou akci.
Co zažijí účastníci
Účastníci naskenují QR kód, vyberou si jazyk a poslouchají na vlastním telefonu - s živými titulky ve stejném jazyce. Žádná aplikace, žádný účet, žádná sluchátka k rozdávání. Celou cestu účastníka popisuje Publikum bez sluchátek.

