☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

豆包手机助手消费者版本正式上线。相较此前的技术预览版,此次版本更聚焦系统稳定性、日常实用性,并重点打磨人机交互体验。
语音唤醒+专属AI键,支持多模态触发
根据官方披露信息,豆包手机助手全面支持语音指令、物理AI按键等多种唤醒方式,适配通勤、办公、居家等多元使用场景。其中,定制化AI按键集成指纹识别模块,完成生物特征验证后即可直连助手执行任务,无需重复解锁屏幕;语音唤醒能力亦完成升级,针对远距离收音、设备内部噪声干扰及地铁站/商场等高噪环境进行了专项优化。
全新上线的“屏幕问答”功能,让用户摆脱截图、跳转等繁琐前置动作,直接基于当前显示界面发起连续交互。例如,用户用相机对准客厅实景,说出“按这个装修风格,推荐一款长度不超过1.2米、价格在1000元以内的储物柜”,豆包即可解析画面语义与约束条件,在主流电商App中精准筛选匹配商品。
本地数据智能检索能力同步增强,支持对相册、短信、便签等私有内容进行语义化查询——如询问“我的港澳通行证还有多久到期”,助手可自动定位证件照片或相关短信记录并提取有效期信息。录音功能亦完成迭代,深度整合飞书妙记技术,用户可自然追问“昨天客户访谈中提到的三个改进建议是什么”,助手将即时调取并结构化呈现对应语音片段内容。此外,用户还可通过语音指令、“三指上滑”手势,或长按AI键+音量键组合,一键保存当前屏幕画面,生成可供后续本地检索的视觉记忆节点。
Doubao-Seedream-5.0-lite是字节跳动发布的最新图像创作模型。该模型首次搭载联网检索功能,能融合实时网络信息,提升生图时效性。同时,模型的聪明度进一步升级,能够精准解析复杂指令和视觉内容。此外,模型在世界知识广度、参考一致性及专业场景生成质量上均有增强,可更好地满足企业级视觉创作需求。
GUI自动化操作进入Beta阶段,启动30天生态规则公示
本次发布的消费者版中,“操作手机”核心能力将以Beta形式开放。为推动建立健康、可持续的AI手机应用生态,豆包团队正式发布《屏幕自动化操作声明协议》(Screen Automation Expression Protocol, SAEP),并同步开启为期30天的公众意见征询期。
依据该协议,第三方App开发者可自主声明其应用内AI自动化操作的允许范围,包括完全开放、限定场景启用或明确拒绝;豆包手机助手将严格遵循开发者设定策略,对主动声明禁用自动化操作的应用,不执行任何屏幕读取、事件注入等行为。在数据层面,所有操作均恪守“最小必要”原则,全程由用户主导授权与控制,并依托分层Agent防护机制,对不同敏感等级的操作行为实施动态权限分级管理。
首款搭载豆包手机助手消费者版的终端设备为努比亚NaviX Ultra,目前已在全渠道开启预约,将于9月16日正式开售。










