扣子官方网页抓取插件仅支持css选择器,不支持xpath;使用css选择器需通过浏览器复制选择器并手动优化动态类名,xpath需借助外部服务(如python api、playwright或scrapy-cloud)实现。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在扣子(Coze)中配置网页抓取插件或自定义Bot时,需从HTML中精准提取标题、价格、摘要等关键字段,而不能依赖模糊匹配或全文扫描。
确认扣子是否支持XPath/CSS选择器
扣子官方插件「网页抓取」仅支持CSS选择器,不解析XPath表达式;若使用自定义HTTP请求+JSONPath处理,XPath需先由外部服务(如Python脚本)执行并返回结构化数据。
直接在扣子Bot工作流里填入XPath字符串(如//div[@class="price"]/text())会触发解析失败,【报错提示“无效选择器”且无调试日志】。
用CSS选择器提取网页关键信息(扣子原生支持)
第一步:在浏览器F12打开目标网页 → 右键目标元素 → 选择「Copy」→「Copy selector」
第二步:将复制的CSS路径粘贴到扣子「网页抓取」插件的「选择器」输入框,例如:article h1 或 .product__title
第三步:勾选「提取文本」或「提取属性」,若要取链接地址就选href,取图片地址就选src;不勾选则返回整个HTML片段。
注意:当网页使用动态类名(如item__price--v3_7x9)时,直接粘贴的selector大概率失效——此时必须手动删掉随机后缀,保留语义部分,比如改成.item__price。
如果你了解HTML,CSS和JavaScript,您已经拥有所需的工具开发Android应用程序。本动手本书展示了如何使用这些开源web标准设计和建造,可适应任何Android设备的应用程序 - 无需使用Java。您将学习如何创建一个在您选择的平台的Android友好的网络应用程序,然后转换与自由PhoneGap框架到一个原生的Android应用程序。了解为什么设备无关的移动应用是未来的潮流,并开始构建应用程序,提供更
用XPath提取动态ID节点(需绕过扣子限制)
方法一:调用自建API代理
部署一个轻量Python服务(Flask + lxml),接收URL和XPath字符串,返回JSON格式结果;在扣子Bot中用「HTTP请求」插件调用该API,传参{"url": "https://xxx.com", "xpath": "//span[contains(@id,'price')]/text()"}。
方法二:用Playwright预处理
在本地或云函数中运行Playwright脚本,加载页面→执行page.evaluate(() => document.evaluate(...))→序列化为JSON→供扣子读取;此方式能绕过lxml对某些HTML畸形结构的解析异常。
方法三:改用Scrapy-Cloud托管任务
将XPath规则写入Scrapy爬虫,部署到Scrapy-Cloud平台,扣子通过Webhook触发任务并轮询结果;适合需要定时抓取、反爬绕过、登录态维持的场景。
这一步操作起来很简单,直接把文件拖进去就行。
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!










