工具
Webstractor:面向 AI 智能体的按需付费网页数据 API
一款面向 AI 智能体的网页数据提取 API,支持搜索与多平台结构化抽取,附带托管 MCP 服务器。
2026.08.12 · 周三约 3 分钟阅读
Webstractor 是一款面向 AI 智能体的网页数据提取 API 服务,主打「即付即用」模式,旨在把公开网络内容转换为智能体可直接消费的上下文。该项目以 Show HN 的形式发布,强调无需注册即可每日免费调用 10 次,并提供 30 天的提取缓存。
核心能力
服务围绕一个统一的 GET 接口展开,主要提供三类能力:
- 公开网页搜索:覆盖网页、新闻、可授权图片、公开视频与地点检索,返回统一结构化结果。
- 公开 URL 抽取:用户提交任意公开链接,服务返回可读的 Markdown 或规范化的 Schema v1 JSON,便于下游模型直接消费。
- 网页截图:将任意公开页面渲染为 WebP 或 PNG 预览,相同请求直接命中缓存,不消耗额度。
所有请求均经过缓存层处理,缓存命中免费,从而降低重复抓取的成本。
平台适配器
服务内置针对多个主流平台的结构化提取适配器,覆盖范围较广,包括:
- 电商:Amazon、Shopify、WooCommerce 的商品、评分、目录与店铺信息。
- 应用商店:App Store 与 Google Play 的应用详情、定价、评分、版本与媒体。
- 社交媒体:Bluesky、Mastodon、Reddit、Instagram、TikTok、X 的帖子、个人资料与社区。
- 音视频:Spotify、SoundCloud、YouTube、Vimeo 的曲目、专辑、播放列表、频道与公开视频。
- 资讯与金融:Google News 的话题与头条、Yahoo Finance 的行情快照与 OHLCV 历史数据。
每个平台均提供专用端点,开发者可通过统一的 API 形态访问。
智能体集成
服务提供托管的 MCP(Model Context Protocol)服务器,智能体只需连接一次 MCP,即可发现网页、新闻、图片、视频、地点与股票行情等资源,并通过 extract_public_url 工具读取清洗后的内容。该能力对基于 MCP 构建的智能体框架较为友好。
计费方式
采用预付费信用点制:
- 价格:每 1,000 信用点 0.49 美元。
- 每次提取、搜索、金融数据或截图请求计为 1 个信用点。
- 缓存命中不计费,信用点永不过期。
- 速率限制:每分钟 60 次 API 调用。
- 新用户可领取 1,000 个免费信用点。
无月度订阅要求,余额用尽后再充值即可,定位为轻量级的按需付费工具。
