gemini提供四种实时翻译路径:一、google meet中启用ai同声传译;二、gemini应用启动双语对话翻译;三、chrome扩展叠加双语字幕;四、离线预加载语音模型保障基础翻译。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在参与跨国视频通话时遇到语言障碍,Gemini 实时翻译能力可提供语音到语音、语音到文本的即时转换支持。以下是实现该能力的具体路径:
一、在 Google Meet 中启用 Gemini AI 同声传译
该功能直接集成于 Meet 视频会议平台,利用 Gemini 模型实时解析发言者语音,并生成目标语言语音输出,同时保留原始语调、情感与音色特征。
1、确保您的 Google Workspace 账户已订阅 Meet Pro 或 Ultra 计划。
2、进入 Meet 会议前,点击“设置”图标,选择“字幕与翻译”,开启“Gemini 实时同传”开关。
3、在会议中点击底部工具栏的“翻译”按钮,为当前发言人指定源语言,为参会者设定目标语言(如英语→日语)。
4、系统自动识别说话人身份,当不同语言用户交替发言时,无需手动切换麦克风或语言选项,翻译持续同步进行。
二、通过 Gemini 应用启动双语对话翻译界面
该模式适用于本地面对面交流或远程视频通话中需共享屏幕/手机画面的场景,提供左右分屏实时文本对照,支持70余种语言互译。
1、在 Android 或 iOS 设备上打开最新版 Gemini 应用(需系统为 Android 8.0 或 iOS 15 及以上)。
2、点击右上角“≡”菜单,进入“实时翻译”功能页。
3、左侧设置为您的母语(如“中文”),右侧设置为目标语言(如“德语”),确认两栏语言不可相同。
4、点击“开始对话”,将设备摄像头对准发言者;您回应时,应用自动检测语音来源方向并切换翻译通道。
三、使用 Chrome 浏览器扩展叠加实时字幕
当您通过浏览器参与 Zoom、Teams 或自建 WebRTC 视频会议时,该方案可在网页层注入 Gemini 翻译能力,生成悬浮式双语字幕。
1、在 Chrome 网上应用店安装官方扩展“Gemini for Chrome”,并使用已登录 Google 账户的浏览器启用。
2、点击浏览器右上角扩展图标,选择“启用语音翻译面板”,面板将固定于当前网页右下角。
3、进入视频会议页面后,点击面板内麦克风按钮,在弹出窗口中授权浏览器访问麦克风,并指定音频输入语言与输出语言。
4、字幕将在面板中以上下双行格式实时滚动显示,上行为原文,下行为译文,延迟控制在800毫秒以内。
四、离线启用预加载语音模型保障基础翻译可用性
在无网络或弱网环境下,Gemini 移动端支持调用本地部署的轻量化语音识别与文本翻译模型,维持基本语音转文字能力。
1、打开 Gemini 应用,进入“设置”→“语言与翻译”→“离线语言包”。
2、勾选常用语言对(如中文↔英语、中文↔西班牙语),点击“下载”等待完成。
3、断开 Wi-Fi 与移动数据后,进入“实时翻译”界面,系统自动切换至离线模式,仅显示文字翻译结果,不触发语音合成输出。
4、若需语音反馈,可提前将关键短语保存为快捷短语库,离线状态下点击即可播放预录语音。











