ไปป์ไลน์การทำงาน
ทุกอย่างเริ่มจากสัญญาณเสียงเส้นเดียว และไปจบที่อุปกรณ์ของผู้ฟังทุกคน โดยทำงานขนานกันในทุกภาษา:
- 1
เสียงจากเวที
สัญญาณเส้นเดียวจากมิกเซอร์ของคุณ - ไมโครโฟน วงเสวนา และแหล่งเสียงประกอบกี่ตัวก็ได้ ผสมโดยช่างเสียงของคุณเหมือนที่ทำอยู่ทุกวันนี้
- 2
การรู้จำเสียงพูด
การรู้จำเสียงแบบสตรีมมิงที่เข้าใจหน่วยวลี จะรอให้วลีนิ่งก่อน ระบบแปลจึงได้รับประโยคที่สมบูรณ์และแน่นอน ไม่ใช่เศษคำ
- 3
การแปลด้วย AI
การแปลที่เข้าใจบริบทจะจดจำเนื้อหาที่พูดไปแล้วอย่างต่อเนื่อง และยึดตามอภิธานศัพท์และคำศัพท์เฉพาะของงานคุณ
- 4
เสียงนิวรัล
เสียงนิวรัลที่เป็นธรรมชาติพูดทุกภาษาเป้าหมายไปพร้อมกัน หนึ่งช่องต่อหนึ่งภาษา
- 5
การส่งสัญญาณ
เสียงและคำบรรยายสดส่งถึงผู้ฟังทุกคนผ่าน WebRTC - ทั้งมือถือในห้อง เบราว์เซอร์ของผู้ฟังระยะไกล จอในสถานที่จัดงาน และเครื่องมือของทีมโปรดักชัน
ความหน่วงตั้งแต่ต้นจนจบ โดยทั่วไปอยู่ที่ราว 5 วินาที นับจากประโยคที่พูดจนถึงเสียงแปล แพลตฟอร์มวัดค่านี้ตลอดเวลา: หลังจบทุกเซสชันคุณจะได้รับรายงานความหน่วงแยกตามภาษา (ค่ามัธยฐานและ p99) คุณภาพจึงพิสูจน์ได้ด้วยข้อมูล ไม่ใช่ความรู้สึก
เอนจินและเสียงพากย์
เบื้องหลัง Interpretwise ใช้เอนจินรู้จำเสียง แปลภาษา และสังเคราะห์เสียงหลายตัว แล้วเลือกชุดที่ดีที่สุดสำหรับแต่ละคู่ภาษา พร้อมสลับไปใช้เอนจินสำรองอัตโนมัติระหว่างเซสชัน เสียงพากย์มีสองระดับ:
- เสียงพรีเมียม - ตัวเลือกที่เป็นธรรมชาติที่สุด แนะนำสำหรับเนื้อหาบนเวที
- เสียงมาตรฐาน - คลังเสียงขนาดใหญ่ที่ครอบคลุมทุกภาษา ในอัตราที่ถูกกว่า
ล่ามมนุษย์ในกระบวนการ
งานเดียวกันสามารถผสมล่าม AI กับล่ามมืออาชีพได้เป็นรายช่อง เช่น ใช้ AI หกภาษา และให้ล่ามมนุษย์ดูแลภาษาที่เจ็ด ล่ามทำงานจากที่ไหนก็ได้ผ่านคอนโซลบนเบราว์เซอร์ - ไม่ต้องติดตั้งอะไร และมีรหัสเข้าใช้งานเฉพาะของแต่ละงานป้องกันไว้
ประสบการณ์ของผู้เข้าร่วมงาน
ผู้เข้าร่วมงานสแกน QR code เลือกภาษา แล้วฟังจากมือถือของตัวเอง - พร้อมคำบรรยายสดในภาษาเดียวกัน ไม่ต้องโหลดแอป ไม่ต้องมีบัญชี ไม่ต้องแจกหูฟัง ดูขั้นตอนของผู้เข้าร่วมงานแบบเต็มได้ที่ผู้ฟังที่ไม่ต้องใช้หูฟัง

