【php中文网资讯】谷歌正式推出全新实时语音翻译模型——gemini 3.5 live translate。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
该模型支持自动识别超过70种语言,翻译过程中可精准复现原说话人的语调、语速及音高特征。与传统语音翻译系统需等待整句说完再处理不同,Gemini 3.5 Live Translate采用流式处理机制,边接收语音输入、边生成译文,在保障上下文连贯性的同时大幅压缩响应延迟,端到端延迟控制在数秒以内。
现阶段,该模型正分阶段集成至谷歌生态产品体系中。开发者可通过Gemini Live API及Google AI Studio访问公开预览版;企业客户自本月起可在Google Meet中启用专属私有预览功能;普通用户则可在安卓与iOS平台的谷歌翻译App中直接体验相关能力。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
Gemini 3.5 Live Translate还具备混合语言自动识别能力,并拥有较强的环境噪声鲁棒性,适用于嘈杂场景。其适用范围涵盖跨国电话、多语种会议、在线教育课堂、直播解说等多种实时交互场景,可提供高质量的即时口译服务。










