工具
TinySearch v0.6.1 发布:本地 LLM 轻量网页检索工具新增「自带浏览器」
面向本地大语言模型的自托管检索工具 TinySearch 发布 v0.6.1,引入 CDP 自带浏览器支持,并附带可复现…
2026.08.20 · 周四约 3 分钟阅读
TinySearch 是一款面向本地大语言模型的自托管 MCP/FastAPI 网页检索工具,v0.6.1 版本在原有架构上引入了多项改进,其中最受关注的是「自带浏览器」(bring-your-own-browser)支持。
核心机制
TinySearch 的设计思路是:在网页内容进入模型上下文窗口之前,先在本地完成筛选与压缩。它采用 BM25 关键词检索结合本地 ONNX embedding 向量匹配,从抓取的网页中提取与查询相关的文本片段,并以原始正文加来源 URL 的形式返回给模型。整个流程不依赖外部付费搜索或抓取 API,中间环节也不需要大模型做摘要或过滤。
这一设计尤其针对 4B/9B 级别的小参数本地模型——给这类模型灌入 50k token 的网页内容、再指望它自己挑出 5 段关键信息并不现实。
v0.6.1 主要更新
- 自带浏览器支持:通过 CDP 协议,用户可指向自己运营的浏览器(带个人 profile、代理、Cookie 等),替代工具自带的 Chromium 实例,对反爬严格的站点尤为有用。
- 搜索与抓取分离:search 接口不再启动 Chromium 或加载 embedding 模型,保持轻量快速;scrape_urls 支持一次传入 1–5 个 URL 并发抓取。
- 问答与全文两种模式:可对单个页面提出聚焦问题、由 TinySearch 检索并重排相关片段,也可直接返回清理后的页面正文。
- 相关链接返回:按查询相关性排序后返回,由上层智能体决定下一步访问目标,避免工具自动扩散抓取范围。
- MCP 响应格式升级:从旧的文本 prompt 格式改为 XML 格式。
- 预处理优化:在 Markdown 生成前完成模板化内容剥离。
可复现的基准测试
开发者附带了可复现的 benchmark 脚本。在 8 个研究类查询、同一批网页的条件下:
- 抓取原始网页合计:146,878 tokens
- 经 TinySearch 筛选后:53,426 tokens
- 总体压缩比约 64%
需注意的是,这一比例并非普适保证:对于结构臃肿的站点可达 80% 以上,而本身已较干净的页面则变化有限。
适用场景与局限
TinySearch 的典型工作流为:search → 模型挑选 URL → scrape_urls → 模型仅获得相关证据,适合运行本地小模型且希望自托管搜索/抓取流程的用户。
作为小型自托管工具,其能力受限于浏览器/CDP 接入环境,在对自动化访问控制严格的站点上仍可能失效;benchmark 也仅覆盖 8 个查询,代表性有限。项目源代码已在 GitHub 开放(自托管、MCP/FastAPI),可作为本地 LLM 工具链中的一环进行尝试与二次开发。
