文档

联网搜索与抓取

对话可以搜索网页、读取网页内容,用的要么是模型所在提供商自带的搜索,要么是你在 Mework 里配置的搜索服务。联网按对话开启,你可以选择由谁来搜索和抓取,并过滤、裁剪返回的结果。

开启联网

联网是每个对话的一个开关:对话设置 → 高级工具 → 启用联网搜索。从顶栏的 更多选项 → 对话设置 打开对话设置,或按 ⌘⇧,(Windows 上是 CtrlShift,)。

开关关闭时,模型拿不到任何联网工具。开关打开时,模型最多拿到两个工具:

  • web_search:只要 搜索提供商 不是 不启用 就会提供。
  • web_fetch:只要 抓取提供商 不是 不启用 就会提供;选 原生 时只在 Anthropic Messages 和 AWS Bedrock 的模型上提供。

所选的提供商在设置里被关掉、不再可用或缺少 API Key 时,工具也照样提供,每次调用都会失败,并告诉你要改哪项设置。在 设置 → 提供商 → 搜索提供商 里更改提供商,不会给对话增加或拿走任何工具。

内置的 mework 预设默认打开开关,搜索和抓取提供商都是 原生,结果数 为 5,结果压缩 为 2,000,域名过滤 关闭。

预设的设置窗口和每个代理角色里也有同样的 高级工具 页。只有启动角色的对话能联网时,角色才能联网,但角色可以选择自己的提供商和域名过滤,或者选 跟随对话设置。

搜索提供商

高级工具 → 搜索提供商 决定由谁来搜索:

选项 怎么搜
原生 由模型所在的提供商搜索,在一个只含搜索词的单独请求里进行,返回一份书面报告和它查阅过的网站。token 由该提供商计费,并计入你的用量统计。
某个提供商 Mework 调用这家搜索服务,模型拿到一组结果,每条有标题、网址和正文。只列出在设置里开启的提供商。
不启用 没有 web_search,但 web_fetch 仍可能提供。

选中的提供商之后在设置里被关掉、不再可用或缺少 API Key 时,菜单显示 请修复搜索提供商,在你修好或重新选择之前每次搜索都会失败。

各类提供商的原生搜索

原生 能不能用,取决于模型所在提供商的类型,即 设置 → 提供商 → 模型提供商 里显示的类型(见提供商):

提供商类型 原生搜索 原生抓取
Anthropic Messages、AWS Bedrock 支持 支持
OpenAI Responses、OpenAI Codex (ChatGPT)、Azure OpenAI、xAI 支持 不支持
Google Gemini、Google Vertex AI 支持(Google 搜索接地) 不支持
OpenAI Chat Completions、OpenAI Compatible、Claude Agent (Claude Code) 不支持 不支持

在 Anthropic Messages 和 AWS Bedrock 上,原生 这一行会展开子菜单选择工具版本:web_search_20250305(默认)或增加了动态过滤的 web_search_20260209;抓取可选 web_fetch_20250910(默认)或 web_fetch_20260209。

模型所在类型不支持原生搜索时,原生 搜不了,请选一个提供商;ExaMCP 出厂即开启,不需要 API Key。

在支持原生搜索的模型上用 原生 实际搜索过一次后,原生搜索就在这个对话里固定下来;原生抓取则在请求第一次提供它时固定。固定后选择框变成灰色,要新开对话才能重新选择。其他情况都不会固定,所以在不支持原生搜索的模型上,你随时可以换成某个提供商。模型的提示缓存还热着时选择框显示为橙色,因为更换后下一次请求用不上这份缓存。

配置提供商

打开 设置 → 提供商 → 搜索提供商(⌘, 打开设置,Windows 上是 Ctrl,)。在列表里选一家,打开它标题栏上的开关。

字段 作用
API Key 离开输入框时保存;清空即删除。保存在系统凭据库里,不会写进对话。
搜索端点、抓取端点 留空使用下表的默认端点。路径会保留:填 https://gateway.example/tavily,搜索就发到 https://gateway.example/tavily/search。必须是 https,只有你本机或局域网里的地址(localhost、*.local、192.168.x.x 等)可以用 http。
搜索引擎(Searxng) 用逗号分隔的引擎名。留空则使用实例在 general 和 web 两个类别里都启用的引擎。
Basic Auth 用户名、Basic Auth 密码(Searxng) 实例挂在 Basic Auth 后面时填写。
提供商 搜索 抓取 API Key 默认端点 说明
Zhipu 是 — 必填 https://open.bigmodel.cn/api/paas/v4/web_search 端点按完整地址使用。
Tavily 是 — 必填 https://api.tavily.com
Searxng 是 — 无 http://localhost:8080 你自己的实例,需要开启 json 输出格式。Mework 会自己下载每个结果页,速度更慢。
Exa 是 — 必填 https://api.exa.ai
ExaMCP 是 — 可选 https://mcp.exa.ai/mcp 出厂即开启。
Bocha 是 — 必填 https://api.bochaai.com
Querit 是 是 必填 https://api.querit.ai
fetch — 是 无 在你的电脑上运行 见下文。
Jina 是 是 搜索必填,抓取可选 https://s.jina.ai、https://r.jina.ai 出厂即开启。抓取不填 API Key 也能用,填了可以提高额度。
Firecrawl 是 是 可选 https://api.firecrawl.dev

抓取网页

高级工具 → 抓取提供商 的用法和搜索提供商一样,两者互相独立。

  • 原生:Anthropic Messages 和 AWS Bedrock 的模型由提供商抓取网页。其他类型的提供商选 原生 时没有 web_fetch;OpenAI 一类的提供商会在搜索过程中自己读取网页。
  • 已开启且支持抓取的提供商:fetch、Jina、Firecrawl、Querit。
  • 不启用:没有 web_fetch。

抓取提供商之后被关掉、不再可用或缺少 API Key 时显示 请修复抓取提供商:web_fetch 照样提供,在你修好或重新选择之前每次抓取都会失败。

fetch 提供商

名为 fetch 的提供商不需要账号:由 Mework 自己下载网页并提取可读正文。

  • 它不执行 JavaScript,所以在浏览器里才生成内容的页面可能读不出正文。
  • 最多读取 4 MiB,最多保留 200,000 个字符的正文,30 秒超时。
  • 它拒绝内网和回环地址上的页面;只有在 完全访问 下,模型直接给出的本机地址可以抓取,比如你的开发服务器。重定向到局域网的请求和搜索结果里的链接一律拒绝。

域名规则

高级工具 → 域名过滤 可选 启用黑名单、启用白名单 或 不启用。编辑名单 打开 域名名单 窗口,里面有 黑名单 和 白名单 两页:一行一条规则,每份名单最多 512 条。

  • 同一时间只有一份名单生效;关掉过滤不会清空两份名单。
  • 黑名单丢掉命中规则的结果;白名单只保留命中规则的结果,所以白名单为空时什么都留不下。
  • 规则作用于提供商返回的搜索和抓取结果,抓取被拦下的网址时什么也不返回。原生 不受规则约束。
规则 命中
<all_urls> 所有 http 和 https 网址。
https://example.com/* example.com 上 https 的任意页面,不含子域名。
*://*.example.com/* example.com 及其所有子域名,http 或 https 都算。
https://example.com/blog/*/draft 符合模式的路径,* 匹配任意文字。模式必须匹配完整的路径和查询。
/example\.com\/login/ 正则表达式,不区分大小写,匹配网址的源、路径和查询。

其他写法都不是规则,会被忽略。裸写的 example.com 或 *.example.com 会被忽略,要覆盖一个域名及其所有子域名,请写 *://*.example.com/*。模式必须带路径:https://example.com 会被忽略,https://example.com/ 只命中首页。

选了 跟随对话设置 的代理角色使用对话的过滤方式和名单;自己选了过滤方式的角色只用它自己的名单。

裁剪结果

高级工具 上的两个数字限制提供商返回的结果能往上下文里放多少。两者对 原生 都不起作用,代理角色总是自己设置这两个数字。

字段 作用 默认值 范围
结果数 一次搜索要多少条结果。0 表示交给提供商决定。 5 0–50
结果压缩 整次调用的 token 预算,平均分给每条结果;超出的正文被截断,以 ... 结尾。对搜索和抓取都生效。0 表示原样保留,一次抓取就可能占满整个上下文窗口。 2,000 0–200,000

审批

在 手动 和 允许编辑 级别下,web_search 和 web_fetch 运行前会询问;完全访问 下不询问(见安全级别)。一张卡片覆盖整次调用——搜索词,或其中的全部网址——并且可以选 总是允许。结果交给模型时标记为不可信的网页内容。

在 GitHub 上编辑本页