必须将grok build接入agent space构建会话而非纯对话调用,配置v1.0.11+版本url并验证session_support:true,用yaml声明等待与提取意图,开启上下文保留以获取可追溯会话id及完整执行链路。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在 Agent Space 中让 Grok Build 承担信息类任务(例如实时查价格、比对参数、提取网页结构化数据、监控页面变动),必须绕过“纯对话调用”的表层用法,直接将其接入可观察、可编排、可回溯的构建会话中。
确认 Agent Space 与 Grok Build 的连接通道
打开 Agent Space 的「Agent 配置 → 构建后端」页面,选择「Grok Build」作为默认构建引擎。若下拉列表中未出现该选项,说明当前 Agent Space 版本(v0.8.3 及以下)尚未内置支持,需手动配置自定义构建器 URL:【必须填入 v1.0.11 或更高版本的 Grok Build 实例地址,低版本不支持无头会话上下文透传】。
点击「测试连接」,等待返回 JSON 响应体中包含 "session_support": true 字段。没有这个字段,后续所有信息任务都无法获取 DOM 快照或页面状态。
定义信息任务:用 YAML 描述意图而非步骤
在 Agent Space 新建一个「信息采集型任务」,类型选「Browser Use + Grok Build」,然后粘贴如下 YAML:
task: extract_product_info<br>browser_use:<br> url: "https://www.tesla.com/modely"<br> actions:<br> - wait_for: ".price-display"<br> - extract:<br> title: "h1"<br> base_price: ".price-display"<br> range_kwh: "li:contains('Range') span.value"
这段配置不写任何 click 或 input 操作,只声明“要等什么”和“要提什么”。Grok Build v1.0.11 会自动启动无头浏览器,加载页面,识别可访问性树,定位元素并提取文本——它依赖的是页面语义,不是 CSS 选择器稳定性。
注意:若页面含动态渲染(如 React 水合后才显示价格),【必须启用 wait_for 字段,否则提取为空字符串且不报错】。
绑定执行上下文:让每次运行都生成可追溯会话
进入任务详情页 → 「会话设置」→ 开启「保留完整浏览器上下文」。此时 Grok Build 不再只返回 JSON 提取结果,还会同步生成一个会话 ID(格式如 sess_7a2f9c1e)。
复制该 ID,粘贴到 Grok Build 的 Web 控制台地址栏末尾:/sessions/sess_7a2f9c1e。你将看到本次任务完整的执行链路:页面加载瀑布图、DOM 截图、请求响应头、JavaScript 错误日志、以及模型在每一步决策时的 reasoning trace。
这一步不能跳过。没有会话 ID,就等于把 Grok Build 当成 curl 用,丢掉了它区别于传统爬虫的核心能力。
调试失败任务:从会话里定位真实断点
方法一:查看「截图序列」面板。如果某张截图显示白屏或 404 页面,说明 url 配置错误或目标网站反爬触发了拦截页。
方法二:展开「reasoning trace」折叠块,找到最后一行带 decision: "failed_to_locate_element" 的记录。它会明确指出模型尝试匹配的可访问性属性(如 name="Base Price" role="heading"),而不是模糊的“找不到元素”。这时应去目标网页右键检查,确认该元素是否真有对应 name 属性,或是否被 shadow DOM 封装。
方法三:在会话页点击「重放此步」按钮,Grok Build 会复用原始网络环境与 DOM 快照,重新执行失败前的最后三步操作——无需改代码、不用重启任务,5 秒内验证修复效果。











