联网搜索与抓取
对话可以搜索网页、读取网页内容,用的要么是模型所在提供商自带的搜索,要么是你在 Mework 里配置的搜索服务。联网按对话开启,你可以选择由谁来搜索和抓取,并过滤、裁剪返回的结果。
开启联网
联网是每个对话的一个开关:对话设置 → 高级工具 → 启用联网搜索。从顶栏的 更多选项 → 对话设置 打开对话设置,或按 ⌘⇧,(Windows 上是 CtrlShift,)。
开关关闭时,模型拿不到任何联网工具。开关打开时,模型最多拿到两个工具:
- web_search:只要 搜索提供商 不是 不启用 就会提供。
- web_fetch:只要 抓取提供商 不是 不启用 就会提供;选 原生 时只在 Anthropic Messages 和 AWS Bedrock 的模型上提供。
所选的提供商在设置里被关掉、不再可用或缺少 API Key 时,工具也照样提供,每次调用都会失败,并告诉你要改哪项设置。在 设置 → 提供商 → 搜索提供商 里更改提供商,不会给对话增加或拿走任何工具。
内置的 mework 预设默认打开开关,搜索和抓取提供商都是 原生,结果数 为 5,结果压缩 为 2,000,域名过滤 关闭。
预设的设置窗口和每个代理角色里也有同样的 高级工具 页。只有启动角色的对话能联网时,角色才能联网,但角色可以选择自己的提供商和域名过滤,或者选 跟随对话设置。
搜索提供商
高级工具 → 搜索提供商 决定由谁来搜索:
| 选项 | 怎么搜 |
|---|---|
| 原生 | 由模型所在的提供商搜索,在一个只含搜索词的单独请求里进行,返回一份书面报告和它查阅过的网站。token 由该提供商计费,并计入你的用量统计。 |
| 某个提供商 | Mework 调用这家搜索服务,模型拿到一组结果,每条有标题、网址和正文。只列出在设置里开启的提供商。 |
| 不启用 | 没有 web_search,但 web_fetch 仍可能提供。 |
选中的提供商之后在设置里被关掉、不再可用或缺少 API Key 时,菜单显示 请修复搜索提供商,在你修好或重新选择之前每次搜索都会失败。
各类提供商的原生搜索
原生 能不能用,取决于模型所在提供商的类型,即 设置 → 提供商 → 模型提供商 里显示的类型(见提供商):
| 提供商类型 | 原生搜索 | 原生抓取 |
|---|---|---|
| Anthropic Messages、AWS Bedrock | 支持 | 支持 |
| OpenAI Responses、OpenAI Codex (ChatGPT)、Azure OpenAI、xAI | 支持 | 不支持 |
| Google Gemini、Google Vertex AI | 支持(Google 搜索接地) | 不支持 |
| OpenAI Chat Completions、OpenAI Compatible、Claude Agent (Claude Code) | 不支持 | 不支持 |
在 Anthropic Messages 和 AWS Bedrock 上,原生 这一行会展开子菜单选择工具版本:web_search_20250305(默认)或增加了动态过滤的 web_search_20260209;抓取可选 web_fetch_20250910(默认)或 web_fetch_20260209。
模型所在类型不支持原生搜索时,原生 搜不了,请选一个提供商;ExaMCP 出厂即开启,不需要 API Key。
在支持原生搜索的模型上用 原生 实际搜索过一次后,原生搜索就在这个对话里固定下来;原生抓取则在请求第一次提供它时固定。固定后选择框变成灰色,要新开对话才能重新选择。其他情况都不会固定,所以在不支持原生搜索的模型上,你随时可以换成某个提供商。模型的提示缓存还热着时选择框显示为橙色,因为更换后下一次请求用不上这份缓存。
配置提供商
打开 设置 → 提供商 → 搜索提供商(⌘, 打开设置,Windows 上是 Ctrl,)。在列表里选一家,打开它标题栏上的开关。
| 字段 | 作用 |
|---|---|
| API Key | 离开输入框时保存;清空即删除。保存在系统凭据库里,不会写进对话。 |
| 搜索端点、抓取端点 | 留空使用下表的默认端点。路径会保留:填 https://gateway.example/tavily,搜索就发到 https://gateway.example/tavily/search。必须是 https,只有你本机或局域网里的地址(localhost、*.local、192.168.x.x 等)可以用 http。 |
| 搜索引擎(Searxng) | 用逗号分隔的引擎名。留空则使用实例在 general 和 web 两个类别里都启用的引擎。 |
| Basic Auth 用户名、Basic Auth 密码(Searxng) | 实例挂在 Basic Auth 后面时填写。 |
| 提供商 | 搜索 | 抓取 | API Key | 默认端点 | 说明 |
|---|---|---|---|---|---|
| Zhipu | 是 | — | 必填 | https://open.bigmodel.cn/api/paas/v4/web_search |
端点按完整地址使用。 |
| Tavily | 是 | — | 必填 | https://api.tavily.com |
|
| Searxng | 是 | — | 无 | http://localhost:8080 |
你自己的实例,需要开启 json 输出格式。Mework 会自己下载每个结果页,速度更慢。 |
| Exa | 是 | — | 必填 | https://api.exa.ai |
|
| ExaMCP | 是 | — | 可选 | https://mcp.exa.ai/mcp |
出厂即开启。 |
| Bocha | 是 | — | 必填 | https://api.bochaai.com |
|
| Querit | 是 | 是 | 必填 | https://api.querit.ai |
|
| fetch | — | 是 | 无 | 在你的电脑上运行 | 见下文。 |
| Jina | 是 | 是 | 搜索必填,抓取可选 | https://s.jina.ai、https://r.jina.ai |
出厂即开启。抓取不填 API Key 也能用,填了可以提高额度。 |
| Firecrawl | 是 | 是 | 可选 | https://api.firecrawl.dev |
抓取网页
高级工具 → 抓取提供商 的用法和搜索提供商一样,两者互相独立。
- 原生:Anthropic Messages 和 AWS Bedrock 的模型由提供商抓取网页。其他类型的提供商选 原生 时没有
web_fetch;OpenAI 一类的提供商会在搜索过程中自己读取网页。 - 已开启且支持抓取的提供商:fetch、Jina、Firecrawl、Querit。
- 不启用:没有
web_fetch。
抓取提供商之后被关掉、不再可用或缺少 API Key 时显示 请修复抓取提供商:web_fetch 照样提供,在你修好或重新选择之前每次抓取都会失败。
fetch 提供商
名为 fetch 的提供商不需要账号:由 Mework 自己下载网页并提取可读正文。
- 它不执行 JavaScript,所以在浏览器里才生成内容的页面可能读不出正文。
- 最多读取 4 MiB,最多保留 200,000 个字符的正文,30 秒超时。
- 它拒绝内网和回环地址上的页面;只有在 完全访问 下,模型直接给出的本机地址可以抓取,比如你的开发服务器。重定向到局域网的请求和搜索结果里的链接一律拒绝。
域名规则
高级工具 → 域名过滤 可选 启用黑名单、启用白名单 或 不启用。编辑名单 打开 域名名单 窗口,里面有 黑名单 和 白名单 两页:一行一条规则,每份名单最多 512 条。
- 同一时间只有一份名单生效;关掉过滤不会清空两份名单。
- 黑名单丢掉命中规则的结果;白名单只保留命中规则的结果,所以白名单为空时什么都留不下。
- 规则作用于提供商返回的搜索和抓取结果,抓取被拦下的网址时什么也不返回。原生 不受规则约束。
| 规则 | 命中 |
|---|---|
<all_urls> |
所有 http 和 https 网址。 |
https://example.com/* |
example.com 上 https 的任意页面,不含子域名。 |
*://*.example.com/* |
example.com 及其所有子域名,http 或 https 都算。 |
https://example.com/blog/*/draft |
符合模式的路径,* 匹配任意文字。模式必须匹配完整的路径和查询。 |
/example\.com\/login/ |
正则表达式,不区分大小写,匹配网址的源、路径和查询。 |
其他写法都不是规则,会被忽略。裸写的 example.com 或 *.example.com 会被忽略,要覆盖一个域名及其所有子域名,请写 *://*.example.com/*。模式必须带路径:https://example.com 会被忽略,https://example.com/ 只命中首页。
选了 跟随对话设置 的代理角色使用对话的过滤方式和名单;自己选了过滤方式的角色只用它自己的名单。
裁剪结果
高级工具 上的两个数字限制提供商返回的结果能往上下文里放多少。两者对 原生 都不起作用,代理角色总是自己设置这两个数字。
| 字段 | 作用 | 默认值 | 范围 |
|---|---|---|---|
| 结果数 | 一次搜索要多少条结果。0 表示交给提供商决定。 |
5 | 0–50 |
| 结果压缩 | 整次调用的 token 预算,平均分给每条结果;超出的正文被截断,以 ... 结尾。对搜索和抓取都生效。0 表示原样保留,一次抓取就可能占满整个上下文窗口。 |
2,000 | 0–200,000 |
审批
在 手动 和 允许编辑 级别下,web_search 和 web_fetch 运行前会询问;完全访问 下不询问(见安全级别)。一张卡片覆盖整次调用——搜索词,或其中的全部网址——并且可以选 总是允许。结果交给模型时标记为不可信的网页内容。