抓取网页
web_fetch- 分组
- 联网
- 开启方式
- 对话设置「高级工具」页里的联网开关。
- 审批
- 需审查:写入和无边界的操作要你批准,除非安全级别或之前的「总是允许」已经覆盖。
- 档案键
tool.web_fetch.description
按网址抓取最多 20 个网页,把它们的正文带进对话。
只要对话的抓取提供商(在 对话设置 → 高级工具 里)不是不启用,模型就有这个工具;选原生时只在 Anthropic Messages 和 AWS Bedrock 的模型上有。配置方法见联网搜索与抓取。
什么时候询问你
一张确认卡列出本次调用里的所有网址。
限制
- 在你电脑上运行的 fetch 提供商,每页最多 4 MiB、限时 30 秒。它不运行 JavaScript,所以在浏览器里才生成内容的页面可能抓回来是空的。
- 一次调用里的所有页面共用结果压缩的额度,默认 2,000 个 token;设为 0 则保留整页。原生不截断。
值得知道
- fetch 拒绝私有和本地地址,但在完全访问下,模型可以抓取它直接点名的本地地址,比如你的开发服务器。重定向到本地网络的地址和取自搜索结果的链接总会被拒绝。
- 如果选中的提供商没有配置好或者不能用了,模型照样有
web_fetch,抓取会失败,并给出模型可以转告你的错误。
参数
| 参数 | 类型 | 说明 |
|---|---|---|
urls 必填网址 | string[] | 一批绝对 http(s) 地址;不知道地址时先用联网搜索 |