谷歌今日对其人工智能生态系统实施重大更新,正式将原生“计算机操作”功能深度整合进 gemini 3.5 flash 模型,全面替代此前处于实验阶段的 gemini 2.5 测试架构。这一变革标志着人工智能正加速由传统意义上的“对话助手”,跃升为具备真实交互与执行能力的“数字协作者”,推动 ai 代理(agent)从理论构想迈向规模化落地应用。
借助 Gemini API,开发者 now 可直接调用 Gemini 3.5 Flash 内置的视觉理解与界面操控能力,快速构建智能代理系统。这些代理无需依赖繁复的手动编码或底层自动化脚本,而是以类人方式——通过实时解析屏幕截图等视觉输入,自主识别界面元素、理解上下文逻辑,并流畅完成各类桌面级任务操作。
该能力在办公流程自动化、软件质量保障、多平台数据采集等典型场景中展现出显著优势:例如自动访问网页、逐项填写冗长表单、精准点击 UI 控件,以及高效完成跨桌面、移动端与浏览器环境下的重复性信息提取与处理工作。为助力生态共建,谷歌已在 Browserbase 平台上线实时体验区,开发者可即刻接入并实测 Gemini 企业级代理平台的核心功能。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

采用三层架构开发,前台集成了产品在线展示,用户注册、在线调查、在线投稿后台有类别管理\图书管理\订单管理\会员管理\配送范围管理\邮件列表\广告管理\友情链接管理等后台添加图书时自动生成缩略图和文字水印主要参考了petshop的设计架构、使用了Asp.net2.0中很多MemberShip、master等新功能后台管理地址/web/admin/ 超级管理员账号密码均为aspx1特别提示:该系统需要
针对赋予 AI 直接操控鼠标与键盘所引发的安全隐忧——尤其是间接指令注入等新型攻击路径,谷歌明确表示已通过专项对抗训练持续强化模型鲁棒性。与此同时,公司同步推出两项面向企业的安全增强机制:其一支持企业自定义审批策略,强制要求 AI 在执行高风险或不可逆操作(如文件删除、系统配置修改)前,必须获得人工显式授权;其二配备实时威胁感知模块,一旦识别异常行为模式,将即时中止当前运行中的代理任务,实现多层次终端防护。
伴随本次模型升级,谷歌亦同步发布 Chrome 149 稳定版。新版浏览器新增“屏幕内容选取”功能,用户只需在附件菜单中启用该选项,即可通过拖拽框选当前标签页内的任意图像或文字片段,并一键将其作为上下文提示输入 Gemini 模型,极大简化了基于网页内容开展交互式问答的操作路径。
将原生计算机使用能力深度嵌入 Gemini 3.5 Flash,不仅强化了 AI 模型与操作系统层的协同深度,更折射出行业演进的关键转向:AI 发展重心正从单纯追求参数规模,稳步过渡至聚焦真实工具调用、复杂任务拆解与端到端执行效能。这一趋势将持续加速 AI 代理在企业自动化流程与大众消费服务中的渗透节奏,重构人机协作范式与软件交互逻辑,为真正具备自主决策与闭环执行能力的下一代 AI 代理铺平道路。










