工具
Readability Reader:本地优先的网页与 PDF AI 阅读器
一款基于 Chrome 与 Firefox 的浏览器扩展,支持本地 AI 摘要和 TTS 朗读,数据不离开设备。
2026.07.27 · 周一约 3 分钟阅读
Show HN 上出现了一款名为 Readability Reader 的开源浏览器扩展,主打「本地优先」的网页与 PDF 阅读体验,集成 AI 摘要与自然语音合成,所有处理均在浏览器端完成,不向任何应用服务器发送文档内容。
核心功能
该扩展面向 Chrome(Manifest V3)与 Firefox 平台,点击工具栏按钮即可在干净的阅读视图中打开任意文章或 PDF。其主要能力包括:
- 使用 Mozilla Readability 在本地提取网页正文
- 使用 PDF.js 解析 PDF,并保留文本层级与阅读顺序
- 内置 DocLayNet 布局模型,识别 PDF 中的文本、标题、图片、表格与公式
- 用 KaTeX 本地渲染识别出的 LaTeX 公式
- 在浏览器内置 Summarizer API 可用时生成本地摘要
- 通过 PocketTTS 或 Inflect Micro/Nano 进行朗读,支持多音色与逐句高亮
- 自动跳过导航与代码块,并朗读图片的可访问描述
所有模型文件(语音、布局、可选识别模型)按需从 Hugging Face 直接下载并缓存到持久化浏览器存储中,重复使用不再重复拉取。
安装与构建
项目以 Node.js 和 npm 构建:
npm install && npm run build:构建扩展产物npm run package:生成版本化的 Chrome 与 Firefox 压缩包到release/目录
Chrome 用户可在 chrome://extensions 开启开发者模式后选择「加载已解压的扩展」,本地 PDF 需在扩展详情中开启「允许访问文件 URL」;Firefox 用户则通过 about:debugging 临时加载 zip 包。
第三方依赖
扩展依赖以下开源组件:
- Mozilla Readability(网页正文提取)
- PDF.js(PDF 解析与渲染,Apache-2.0)
- KaTeX(公式渲染)
- Transformers.js + ONNX Runtime Web(本地文档模型推理)
- Texo / FormulaNet(公式识别,AGPL-3.0)
- PocketTTS、Inflect Micro、Inflect Nano(本地语音合成)
当前局限
纯扫描版 PDF 不含可提取文本,目前依赖外部 OCR 引擎,扩展本身尚未内置 OCR 能力。表格区域识别需要单独下载识别模型才能完整重建。
