必须用Ctrl+单击获取原始URL并清洗掉metaso.cn跳转参数,再调用metaso_web_reader工具;format须指定为"json"或"markdown",否则报错;PDF或JS渲染页将返回空内容。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要用秘塔AI搜索API直接获取某条引用来源的原始网页全文,而不是摘要或结构化摘要页,必须绕过前端跳转逻辑,调用专用的内容读取工具,且需确保URL未被重定向污染。
确认你拿到的是原始URL,不是秘塔中间页
在秘塔AI搜索结果页中,鼠标悬停于某条“参考来源”蓝色链接上→光标变手型后,**按住Ctrl键不放再单击**→新标签页打开的地址栏里,检查是否以 https:// 开头、不含 metaso.cn/redirect? 或 metaso.cn/go? 等路径。若含此类参数,说明你拿到的是秘塔跳转页,不能直传给API;此时必须右键→“复制链接地址”,粘贴到文本编辑器中,手动删掉 ?url= 及其后面全部内容,只保留原始域名和路径部分(例如从 https://metaso.cn/go?url=https%3A%2F%2Fexample.com%2Fpaper 提取出 https://example.com/paper)。
调用 metaso_web_reader 工具读取原文
方法一:使用 curl 命令行直调(推荐调试用)
打开终端,执行以下命令(将 YOUR_API_KEY 替换为真实密钥,URL 替换为上一步清洗后的原始地址):
curl -X POST "https://metaso.cn/api/mcp" \<br> -H "Content-Type: application/json" \<br> -H "Authorization: Bearer YOUR_API_KEY" \<br> -d '{"tool": "metaso_web_reader", "input": {"url": "https://example.com/article", "format": "markdown"}}'
方法二:用 Python requests 调用(适合集成进脚本)
安装 requests 库后,运行以下代码:
import requests<br>response = requests.post(<br> "https://metaso.cn/api/mcp",<br> headers={"Authorization": "Bearer YOUR_API_KEY"},<br> json={"tool": "metaso_web_reader", "input": {"url": "https://example.com/article", "format": "json"}}<br>)<br>print(response.json())
注意:format 参数必须明确指定为 "json" 或 "markdown",缺省会报错;若目标网页是PDF或需OCR识别的扫描件,该工具将返回空内容,不报错也不提示——此时需换用浏览器人工打开验证是否可读。
处理常见失败响应
第一步:检查 HTTP 状态码
如果返回 401,说明 Authorization 头缺失或 KEY 过期;如果返回 400 且 message 含 “invalid url”,说明 URL 格式非法(常见于含中文未编码、含空格、协议头缺失);【务必用 urllib.parse.quote(url, safe=':/') 对URL做编码】。
第二步:验证网页是否可公开访问
在浏览器无痕窗口中直接粘贴该 URL,若出现登录弹窗、验证码、IP限制或 403/404,则 metaso_web_reader 必然失败——它不支持 Cookie 携带、不模拟登录态、不过验证码。
第三步:区分“读取失败”与“内容为空”
成功响应的 JSON 中,若 "content" 字段为空字符串或仅含 "<p></p>",说明网页 HTML 结构异常(如纯 JS 渲染、反爬 script 标签拦截),此时无法通过此 API 获取原文,需改用 Puppeteer 或 Playwright 抓取渲染后 DOM。


















