Qwen3.5-LiveTranslate:所听即所见,所译即所达
DashScope Demo Qwen3.5-LiveTranslate-Flash 是 Qwen 家族最新的同声传译模型,基于 Qwen3.5-Omni 构建。它提供实时、多模态翻译能力,不仅能够听懂并翻译语音,还能看见并理解视觉上下文,从而产出更准确的译文。与前代模型 Qwen3-LiveTranslate 相比,Qwen3.5-LiveTranslate-Flash 在语言覆盖范围、翻译延迟、声音克隆和术语处理等方面均有重大升级,非常适用于跨国会议、直播本地化、在线课堂和商务谈判等场景。 核心亮点 # 多语种覆盖升级:能听懂和翻译60种语言,其中29种可以实现语音输出。 输入音频和输出文本语种从 18 个大幅提升至 60 个,输出音频语向从 10 个提升至 29 个,覆盖更多国家与区域的语言互译组合,满足跨境会议、直播出海、在线课堂、商务谈判等多语同传需求。 超低延迟:可读单元技术驱动,更快出字、更快出声。 引入全新的可读单元(Readable Unit)实时翻译技术,在保证译文可读性与语义一致性的同时实现更激进的流式输出。端到端字均延迟降低到 2.8 秒,适用于直播、连麦、发布