灵光开眼的语音双向问答功能需先开启app中【眼睛】图标进入模式、授权麦克风并完成物体识别,再长按右下角麦克风提问,支持即时追问与多轮对话,答偏时可重听、换说法或聚焦局部提升准确率。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

当你用手机摄像头对准博物馆展柜里的青铜器,却听不清讲解员声音时,灵光开眼的语音双向问答功能就能实时接住你的疑问并给出清晰回应——它不是单向播报,而是像真人一样能听、能答、能追问。
开启语音双向问答的前置准备
打开灵光App,点击主界面右下角的【眼睛】图标进入灵光开眼模式。这一步必须做,其他入口无法触发语音双向能力。
确保手机麦克风权限已开启,且系统未启用“静音模式”或“勿扰模式”。【若麦克风被禁用,后续所有语音提问将无声无息失败】
对准目标物体或场景,等待画面左上角出现蓝色识别框并显示“已识别:植物/文物/文字…”等提示词——只有识别成功后,语音问答通道才真正激活。
开始一次完整的语音双向问答
第一步:轻点屏幕右下角麦克风图标(不是键盘输入框旁的小话筒),长按1秒后松开,听到“滴”声即进入收音状态;
第二步:直接说出问题,例如:“这个鼎上的纹饰叫什么?”,语速正常即可,无需刻意放慢或加重字音;
第三步:松开手指,灵光会立刻停止收音→自动识别语音→调用多模态理解模型分析画面+语音→生成带图解的答案;
第四步:答案以语音+图文形式同步呈现,此时你可立即追问,比如接着说:“那它在商代有什么用途?”,不用再点麦克风——只要前次回答结束3秒内开口,系统默认延续对话上下文。
遇到听不清或答偏了怎么办
方法一:点击答案卡片右上角的重听按钮,可反复播放语音回复;
方法二:在语音回复结束后,直接说“换个说法”或“再详细点”,灵光会基于同一问题重新组织更口语化或更专业的解释;
方法三:如果连续两次识别失败,把手机稍微靠近目标物,同时用手指轻点画面中你想聚焦的局部区域——这会强制模型把注意力锚定在该区域,大幅提升语音问答的准确率。











