当用户请求“调用Google Patents”或“专利搜索”,或明确提到专利搜索时,触发 dataify-google-patents 技能。
数据化 Google 专利是一项面向实际任务的技能,主要用于使用这一技能将用户的 Google 专利请求转换为 Datafy Scraper API 呼叫;. 需要预调确认;
该技能适合需要稳定复用相关能力的场景,可作为自动化工作流的一部分,也便于后续检查、调整和扩展。从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
使用此技能将用户对 Google Patents 的查询请求转换为 Dataify Scraper API 调用。
每次实际发起 API 调用前,必须严格遵循以下确认流程。本流程优先级高于该技能中任何旧版工作流顺序。
engine 值。pizza、us、en、日期、机场代码、token 等)用作默认值。Authorization 字段**;须完整列出本技能参考文档中定义的所有请求体字段(含 engine),即使当前值为空也需保留。参数名、当前值、默认值、说明。DATAIFY_API_TOKEN。尽可能使用内置的预览辅助工具,根据本技能的参考文档自动生成确认表格:
python3 scripts/preview_params.py --params-json '{"q":"USER_QUERY"}'
请将所有已解析的当前值通过 --params-json 或匹配的 --field value 参数传入 preview_params.py。该辅助工具从 references/*api.md 中读取默认值与说明;若其无法解析某字段的默认值,请留空该字段的“默认值”列,**切勿自行编造**。
python3 执行内置 Python 脚本,并**直接返回 API 响应体原始内容**,不得进行摘要、提取、清洗、翻译或结构化处理。engine 设为 google_patents。json: "1"page: "0"dups: "family"patents: "true"scholar: "false"no_cache: "false"sort 字段默认按相关性排序,即**省略该字段**。DATAIFY_API_TOKEN。--print-table 参数,以生成完整的参数审查表格:python3 scripts/google_patents.py --request "search Google Patents for battery recycling patents" --print-table
向用户展示该表格,列名必须严格为:参数名、当前值、默认值、说明。随后询问用户是否需要修改任一参数。**未获用户明确确认前,禁止调用 API。**
--q)或 --params-json 传入编辑后的值,重新生成并展示表格,并再次请求确认。--print-table 的脚本调用:python3 scripts/google_patents.py --request "search Google Patents for battery recycling patents"
对于多数字段,推荐传入一个经 shell 合适转义的 JSON 对象:
python3 scripts/google_patents.py --params-json '{"q":"battery recycling","status":"GRANT","country":"US","json":"1"}'
若用户在对话中直接提供了 token(而非通过环境变量),请使用 --token 参数传入,并确保最终响应中**不回显该 token**:
python3 scripts/google_patents.py --token "USER_TOKEN" --q "battery recycling"
当需要查阅准确的字段列表、默认值、可接受值及映射提示时,请参考 references/google_patents_api.md。
核心规则:
Content-Type 必须为 application/x-www-form-urlencoded。engine 字段必须强制设为 google_patents;忽略用户可能提供的任何冲突 engine 值。Bearer 前缀的 token 将被自动补全前缀。常见映射关系:
json: "1"json: "2"json: "3"json: "4"page: "0",第二页 → page: "1"sort: "new"sort: "old"sort 字段**clustered: "true"dups: "family"dups: "language"patents: "true"scholar: "true"before 或 after 字段,格式为 priority:YYYYMMDD、filing:YYYYMMDD 或 publication:YYYYMMDDinventorassigneecountrylanguagestatus: "GRANT"status: "APPLICATION"type: "PATENT"type: "DESIGN"litigation: "YES" 或 litigation: "NO"no_cache: "true"