wigolo是本地AI Agent网页工具,为Claude/Cursor/Zed等AI编程工具提供免费网页搜索/抓取/提取能力。18引擎聚合、永久本地缓存、隐私优先,完全免费0账单。比Tavily/Firecrawl更适合预算有限的独立开发者,文末附详细使用教程
🎤 引言
用 Claude Code / Cursor 写代码的时候,想要 AI 实时搜一下网页?
正常操作:
- 切出去打开 Google
- 复制粘贴回来
- 等 AI 读完再继续
或者你用的是 Tavily / Firecrawl API,每月账单蹭蹭涨,免费额度分分钟用完。
今天安利的 wigolo 就是来解决这个痛点的 —— 本地运行的 MCP 服务器,给 AI 编程工具装一个私有网页网关,18 个搜索引擎聚合、永久本地缓存、0 API 账单。
GitHub 上 2.8k Stars,v0.2.1(2026-07-19),完全开源(许可证待确认),TypeScript 94.7%,macOS / Linux / Windows 全平台。
核心卖点就一句话:让 AI Agent 拥有自己的私有 Google,免费、隐私、离线可查。
⭐ 核心功能
1. 多引擎网页搜索(18 个适配器)
内置 18 个直接适配器,聚合多搜索引擎结果,通过 rank fusion + ML cross-encoder 重新排序,每个结果都有可解释的评分分解。
# 搜索
npx wigolo search "如何用 Docker 部署 NestJS 应用"特点:
- 并行搜索多个引擎,一次返回综合最优结果
- 每个结果附带来源、可信度评分、摘要
- 支持传入查询数组并行搜索多主题
2. 网页抓取(Fetch)
三层递进路由:
- HTTP → TLS 伪装 → 无头浏览器:自动识别反爬挑战或 SPA 页面逐级升级
- 输出干净 Markdown + 元数据 + 链接列表
# 抓取单个页面
npx wigolo fetch https://github.com/KnockOutEZ/wigolo3. 全站爬取(Crawl)
多种爬取策略:
- BFS(广度优先) / DFS(深度优先)
- Sitemap 驱动
- Map-only(只爬链接不抓内容)
# 爬取整个网站
npx wigolo crawl https://example.com --mode bfs --max-depth 3内置:
- 域名级限速(防封)
- robots.txt 尊重
- 重复内容去重
4. 结构化数据提取(Extract)
从任意页面提取结构化数据:
- 表格、JSON-LD、元数据
- 品牌信息
- 具名 Schema(Article / Recipe / Product 等)
- 自定义 JSON Schema
# 提取商品信息
npx wigolo extract https://amazon.com/product/xxx --schema product5. 持久本地缓存
所有查询结果存在 ~/.wigolo/,本地持久化:
- 离线重查:相同查询直接返回缓存,毫秒级
- 节省 API 成本:AI 多次问同类问题只查一次
- 隐私保障:查询数据永远在本地
6. 研究模式(Research)
自动执行多轮搜索 + 抓取 + 提取链路,适合深度调研任务。
7. Find-Similar
根据已有结果找相似页面。
📥 安装与使用
系统要求
- Node.js ≥ 20
- 约 1.5GB 空闲磁盘空间
- macOS / Linux / Windows
一键安装(推荐)
npx -y wigoloHomebrew 安装
brew install knockoutez/tap/wigolo单文件二进制
curl -fsSL https://raw.githubusercontent.com/KnockOutEZ/wigolo/main/install.sh | sh安装后 wigolo 会自动配置 MCP 连接,将自身注册为 AI 编程工具的网页工具。
诊断命令
# 检查安装状态
npx wigolo doctor卸载
npx wigolo config --uninstall --yes🤝 集成主流 AI 编程工具
Claude Code
# wigolo init 时指定 agent
npx wigolo init --agents claude-codeClaude Code 通过 MCP 调用 wigolo 的搜索/抓取/提取能力,无需切换窗口。
Cursor / Zed / Windsurf / VS Code
# 同样支持
npx wigolo init --agents cursor,zed,vscode,windsurfGemini CLI / Codex / Antigravity
npx wigolo init --agents gemini-cli,codex,antigravity--agents 参数接受逗号分隔列表,支持:claude-code · cursor · codex · gemini-cli · vscode · windsurf · zed · antigravity
其他 MCP 客户端
任何 MCP 客户端/框架/自托管 Agent,只需在 MCP 配置里注册:
npx -y wigolo官方提供了每个客户端的具体配置块说明。
🔍 对比/替代方案
| 特性 | wigolo | Firecrawl | Exa | Tavily |
|---|---|---|---|---|
| 多引擎搜索 | ✅ 18个 | ✅ | ✅ | ✅ |
| 结构化提取 | ✅ | ✅ | ✅ | ✅ |
| 全站爬取 | ✅ | ✅ | — | ✅ |
| 原文标注来源(字偏移) | ✅ | — | — | — |
| 可解释评分 | ✅ | — | — | — |
| 永久本地缓存 | ✅ | — | — | — |
| 查询数据留在本地 | ✅ | — | — | — |
| API Key 需求 | 无需 | 必需 | 必需 | 必需 |
| 查询费用 | $0 | 按量计费 | 按量计费 | 按量计费 |
关键差异
- vs Firecrawl:Firecrawl 收费且云端处理,wigolo 本地免费,数据不离开你的机器
- vs Tavily:Tavily 免费额度有限,AI 编程 Agent 会高频发起搜索请求,账单会快速累积;wigolo 零账单
- vs Exa:Exa 偏搜索引擎,wigolo 更偏向 AI Agent 场景的网页工具箱,支持 crawl + extract
- 隐私优势:wigolo 所有查询存在
~/.wigolo/,离线可重查,适合处理敏感信息的场景
⚠️ 注意事项
- 公测阶段:v0.2.1 仍为公测版本,API 设计和功能可能会有 break change,生产环境使用前注意锁定版本。
- 数据新鲜度:本地缓存意味着历史查询返回快,但最新网页内容可能需要手动刷新或清理缓存。
- Node.js 依赖:需要 Node ≥ 20,如果你的环境 Node 版本较老,需要先升级。
- 磁盘占用:完整安装约 1.5GB,主要是本地搜索引擎索引和浏览器组件,如果磁盘紧张注意定期清理
~/.wigolo/。 - 18 引擎 vs 单引擎:多引擎聚合搜索结果质量更高,但速度比单引擎慢一些,对速度敏感的场景可配置只用指定引擎。
- 自定义搜索引擎:官方提供插件系统,约 100 行代码可添加自定义搜索引擎,参考
examples/plugin-search-engine。 - 反爬限制:wigolo 的 TLS 伪装和无头浏览器能绕过部分反爬,但对于 Cloudflare 高级防护或需要验证码的网站仍然有限。
✅ 总结
wigolo 是 2026 年 AI 编程工作流里的"隐私网关" —— 装上它,Claude Code / Cursor / Zed 这些工具就能自己搜网页、读页面、抓数据,而你不用付一分钱 API 账单。
优点:
- 完全免费,零 API 账单,本地运行不依赖云服务
- 18 个搜索引擎聚合 + ML 重新排序,结果质量有保障
- 永久本地缓存,离线可重查,AI 高频提问也不怕
- 隐私优先,查询数据永远留在
~/.wigolo/ - MCP 原生,装上就能对接 Claude Code / Cursor / Zed 等主流工具
- 支持 crawl / extract / research,不只是搜索
缺点:
- 公测阶段,API 可能 break change
- 需要 1.5GB 磁盘 + Node ≥ 20
- 对抗高级反爬时能力有限
推荐指数 ⭐⭐⭐⭐(4/5)
适合:用 AI 编程工具(Cursor/Claude Code/Zed)、预算有限、注重隐私的独立开发者。
不适合:需要企业级 SLA 保证、对最新数据有强需求的场景。
仓库:github.com/KnockOutEZ/wigolo
最新版本:v0.2.1 (Jul 19, 2026)
安装:npx -y wigolo 一键搞定,或 Homebrew / curl 方式