桃子桃子快讯
返回首页
工具

Readability Reader:本地优先的网页与 PDF AI 阅读器

一款基于 Chrome 与 Firefox 的浏览器扩展,支持本地 AI 摘要和 TTS 朗读,数据不离开设备。

2026.07.27 · 周一3 分钟阅读

Show HN 上出现了一款名为 Readability Reader 的开源浏览器扩展,主打「本地优先」的网页与 PDF 阅读体验,集成 AI 摘要与自然语音合成,所有处理均在浏览器端完成,不向任何应用服务器发送文档内容。

核心功能

该扩展面向 Chrome(Manifest V3)与 Firefox 平台,点击工具栏按钮即可在干净的阅读视图中打开任意文章或 PDF。其主要能力包括:

  • 使用 Mozilla Readability 在本地提取网页正文
  • 使用 PDF.js 解析 PDF,并保留文本层级与阅读顺序
  • 内置 DocLayNet 布局模型,识别 PDF 中的文本、标题、图片、表格与公式
  • 用 KaTeX 本地渲染识别出的 LaTeX 公式
  • 在浏览器内置 Summarizer API 可用时生成本地摘要
  • 通过 PocketTTS 或 Inflect Micro/Nano 进行朗读,支持多音色与逐句高亮
  • 自动跳过导航与代码块,并朗读图片的可访问描述

所有模型文件(语音、布局、可选识别模型)按需从 Hugging Face 直接下载并缓存到持久化浏览器存储中,重复使用不再重复拉取。

安装与构建

项目以 Node.js 和 npm 构建:

  • npm install && npm run build:构建扩展产物
  • npm run package:生成版本化的 Chrome 与 Firefox 压缩包到 release/ 目录

Chrome 用户可在 chrome://extensions 开启开发者模式后选择「加载已解压的扩展」,本地 PDF 需在扩展详情中开启「允许访问文件 URL」;Firefox 用户则通过 about:debugging 临时加载 zip 包。

第三方依赖

扩展依赖以下开源组件:

  • Mozilla Readability(网页正文提取)
  • PDF.js(PDF 解析与渲染,Apache-2.0)
  • KaTeX(公式渲染)
  • Transformers.js + ONNX Runtime Web(本地文档模型推理)
  • Texo / FormulaNet(公式识别,AGPL-3.0)
  • PocketTTS、Inflect Micro、Inflect Nano(本地语音合成)

当前局限

纯扫描版 PDF 不含可提取文本,目前依赖外部 OCR 引擎,扩展本身尚未内置 OCR 能力。表格区域识别需要单独下载识别模型才能完整重建。

信源