全新一代同声传译大模型 qwen3.8-livetranslate,在翻译准确性、响应延迟、说话人区分能力以及语音合成自然度四大关键指标上实现整体跃升。
该模型创新采用音频与文本交替嵌入的 Interleave 架构,将流式语音理解、文本生成与语音合成统一建模为单一因果序列,单字平均延迟由前代的2.8秒显著降低至2.3秒。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

本次升级聚焦三大核心能力突破:实时说话人分离技术可精准判定多人交替发言中每句话的归属,并在译文语音中持续保留原始说话人的声纹特征;原文与译文同步逐帧呈现,实现双语内容毫秒级对齐,兼顾即时 comprehension 与源语回溯验证;长程上下文消歧机制通过跨轮次语义关联,有效缓解专有名词误译及代词指代不清等常见问题。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。

模型底层采用 Hybrid MoE 架构的 Thinker–Talker 双引擎协同设计:Thinker 模块专注语言理解与高质量翻译,Talker 模块则负责生成高度还原原说话人音色的译文语音。在涵盖14种语言方向、含多说话人长时对话的权威评测集 Omnilingua-MSpeaker 上,Qwen3.8-LiveTranslate 在翻译忠实度、语言流畅性、表达简洁性及说话人分离错误率等维度全面超越当前主流实时同传方案。
目前,该模型已支持60种语言互译,相关 API 已正式上线千问 AI 开放平台。研发团队透露,后续将重点攻坚端到端全链路时延的极致优化、跨会议场景的长期上下文记忆能力,以及更广泛语种的覆盖拓展。










