让语音或文本几乎同步完成跨语言转换。
像跨国视频会里坐了个嘴替:你这边话音刚落,它那边立刻接上,场子几乎不会冷。
常用于会议、出国沟通和跨语种客服,关键是边听边译、尽量不断档。
Speech-to-text它常先把说话内容转成文字,再进入翻译环节。
TTSTTS 能把译文重新读出来,形成接近同传的体验。
LLM大模型可改善译文流畅度,并处理上下文语气。
Multimodal它常同时处理语音、文本与上下文信息。