当用户请求“调用Google Patents”或“专利搜索”,或明确提到专利搜索时,触发 dataify-google-patents 技能。
数据化 Google 专利
功能概述
数据化 Google 专利是一项面向实际任务的技能,主要用于使用这一技能将用户的 Google 专利请求转换为 Datafy Scraper API 呼叫;. 需要预调确认;
核心要点
- 每一次真正的API 呼叫之前, 请遵循此确认。
- 它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。
- 使用时应结合输入条件选择合适的执行方式,核对必要参数、依赖环境与输出内容,并按原始要求处理异常情况。
使用与执行
该技能适合需要稳定复用相关能力的场景,可作为自动化工作流的一部分,也便于后续检查、调整和扩展。从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
结果检查与注意事项
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
Dataify Google Patents
使用此技能将用户对 Google Patents 的查询请求转换为 Dataify Scraper API 调用。
调用前必需的确认流程
每次实际发起 API 调用前,必须严格遵循以下确认流程。本流程优先级高于该技能中任何旧版工作流顺序。
- 将用户的请求解析为 API 请求体(body)中的各字段,并固定设置
engine值。 - 仅在参数说明中**明确声明默认值**时才应用默认值。禁止将示例 YAML 值、样例提示、占位符值或示例(如
pizza、us、en、日期、机场代码、token 等)用作默认值。 - 若某必需参数既无文档记载的默认值,又无法从用户请求中推断,则在构建参数表前主动向用户询问该参数。
- 调用 API 前,须向用户展示一个 Markdown 表格。表格中**不得包含
Authorization字段**;须完整列出本技能参考文档中定义的所有请求体字段(含engine),即使当前值为空也需保留。 - 表格必须严格包含以下四列:
参数名、当前值、默认值、说明。 - 表格展示后,须询问用户是否需要修改任一参数。**未获用户明确确认前,禁止调用 API。**
- 若用户修改了任意参数,须重新生成表格并再次请求确认。
- 若缺失 token,立即中止流程,并告知用户前往 Dataify Dashboard 登录以获取
DATAIFY_API_TOKEN。
尽可能使用内置的预览辅助工具,根据本技能的参考文档自动生成确认表格:
python3 scripts/preview_params.py --params-json '{"q":"USER_QUERY"}'
请将所有已解析的当前值通过 --params-json 或匹配的 --field value 参数传入 preview_params.py。该辅助工具从 references/*api.md 中读取默认值与说明;若其无法解析某字段的默认值,请留空该字段的“默认值”列,**切勿自行编造**。
- 完成用户确认及 token 处理后,使用
python3执行内置 Python 脚本,并**直接返回 API 响应体原始内容**,不得进行摘要、提取、清洗、翻译或结构化处理。
工作流
- 将用户的请求解析为 Dataify Google Patents 对应的字段。始终将
engine设为google_patents。 - 仅应用参数说明中**明确定义**的默认值:
json: "1"page: "0"dups: "family"patents: "true"scholar: "false"no_cache: "false"sort字段默认按相关性排序,即**省略该字段**。
- 禁止使用示例值作为默认值。对于无文档默认值的可选字段,除非用户明确要求,否则一律省略。
- 若缺失 token,立即中止流程,并告知用户前往 Dataify Dashboard 登录以获取
DATAIFY_API_TOKEN。 - 每次 API 调用前,均须运行内置 Python 脚本并传入
--print-table参数,以生成完整的参数审查表格:
python3 scripts/google_patents.py --request "search Google Patents for battery recycling patents" --print-table
向用户展示该表格,列名必须严格为:参数名、当前值、默认值、说明。随后询问用户是否需要修改任一参数。**未获用户明确确认前,禁止调用 API。**
- 若用户修改了参数,请通过显式标志(如
--q)或--params-json传入编辑后的值,重新生成并展示表格,并再次请求确认。 - 确认无误后,执行不带
--print-table的脚本调用:
python3 scripts/google_patents.py --request "search Google Patents for battery recycling patents"
对于多数字段,推荐传入一个经 shell 合适转义的 JSON 对象:
python3 scripts/google_patents.py --params-json '{"q":"battery recycling","status":"GRANT","country":"US","json":"1"}'
若用户在对话中直接提供了 token(而非通过环境变量),请使用 --token 参数传入,并确保最终响应中**不回显该 token**:
python3 scripts/google_patents.py --token "USER_TOKEN" --q "battery recycling"
- 将脚本输出**原样返回**给用户。不得对 API 响应内容进行摘要、提取、清洗、翻译或结构调整。
字段映射规则
当需要查阅准确的字段列表、默认值、可接受值及映射提示时,请参考 references/google_patents_api.md。
核心规则:
- API 请求必须以表单数据(form data)形式提交,
Content-Type必须为application/x-www-form-urlencoded。 - 始终使用 UTF-8 编码。
engine字段必须强制设为google_patents;忽略用户可能提供的任何冲突 engine 值。- 请求值一律保持字符串类型,除非脚本明确支持并能自动标准化布尔值。
- 若无法从用户请求中推断出有意义的搜索关键词或筛选条件,须主动发起追问。
- 脚本内自动标准化 token 值:不含
Bearer前缀的 token 将被自动补全前缀。 - 参数审查表格中**不得显示完整 token**。
常见映射关系:
- "JSON" →
json: "1" - "JSON+HTML" →
json: "2" - "HTML" →
json: "3" - "Light JSON" →
json: "4" - 第一页 →
page: "0",第二页 →page: "1" - 最新/最近/最新发布 →
sort: "new" - 最旧/最早 →
sort: "old" - 相关性排序/默认排序 → **省略
sort字段** - 分组/聚类结果 →
clustered: "true" - 同族去重 →
dups: "family" - 公开文本去重 →
dups: "language" - 包含专利结果 →
patents: "true" - 包含 Google Scholar 结果 →
scholar: "true" - 早于/晚于日期 → 使用
before或after字段,格式为priority:YYYYMMDD、filing:YYYYMMDD或publication:YYYYMMDD - 发明人姓名 →
inventor - 受让人/申请人/所有权人姓名 →
assignee - 国家/地区专利代码 →
country - 结果语言筛选 →
language - 已授权专利 →
status: "GRANT" - 申请中专利 →
status: "APPLICATION" - 发明专利 →
type: "PATENT" - 外观设计专利 →
type: "DESIGN" - 涉及诉讼(是/否)→
litigation: "YES"或litigation: "NO" - 绕过缓存 →
no_cache: "true"
热门AI工具
相关专题
本专题汇总了当前主流的AI视频生成软件推荐与排行榜单,涵盖seko、AniShort、剧云、Lovart、LiblibAI及立刻mv等热门工具。同时整理了各软件在文生视频、图生视频、时长限制、画质表现及免费额度等方面的差异对比,助您快速选对适合创作需求的AI视频生成工具。
0
2026.09.16
本专题汇总了当前免费AI生成视频工具的排行榜与推荐清单,涵盖seko、讯飞智作、AniShort及剧云、Lovart等多模型集成平台。同时整理了各工具的免费额度、输出时长、水印政策及适用场景差异,助您快速选择合适工具开启AI视频创作。
0
2026.09.16
本专题整理Pandas读取CSV、Excel、JSON、SQL、Parquet等文件的方法,以及to_csv、to_excel、to_sql和to_parquet等常用数据导出流程。
0
2026.09.16
本专题介绍GDB按照函数名、源代码行号和文件位置设置断点的方法,详细说明run、continue、next、step等命令的配合使用,帮助定位程序崩溃、逻辑异常及代码未按预期执行的问题。
0
2026.09.11
本专题介绍GDB调试过程中查看变量值的具体方法,涵盖局部变量、函数参数、数组、结构体和指针内容查询,同时整理变量持续显示、格式化输出及无法读取变量时的排查思路。
0
2026.09.11
本专题围绕GDB调试C++程序的实际过程,详细说明程序编译、调试器启动、命令行参数传入、断点命中和程序继续运行等步骤,并介绍条件断点、临时断点和观察点的设置方法,方便开发者跟踪复杂代码的执行状态。
0
2026.09.11
本专题讲解Iris框架MVC开发模式,包含控制器注册、方法命名与路径映射、By参数绑定、BeforeActivation自定义路由,以及依赖注入容器注册、数据库依赖注入、返回值序列化及MVC下WebSocket与gRPC整合实践。
0
2026.09.11
热门下载
相关下载
精品课程
最新文章

