桃子桃子快讯
返回首页
工具

Webstractor:面向 AI 智能体的按需付费网页数据 API

一款面向 AI 智能体的网页数据提取 API,支持搜索与多平台结构化抽取,附带托管 MCP 服务器。

2026.08.12 · 周三3 分钟阅读

Webstractor 是一款面向 AI 智能体的网页数据提取 API 服务,主打「即付即用」模式,旨在把公开网络内容转换为智能体可直接消费的上下文。该项目以 Show HN 的形式发布,强调无需注册即可每日免费调用 10 次,并提供 30 天的提取缓存。

核心能力

服务围绕一个统一的 GET 接口展开,主要提供三类能力:

  • 公开网页搜索:覆盖网页、新闻、可授权图片、公开视频与地点检索,返回统一结构化结果。
  • 公开 URL 抽取:用户提交任意公开链接,服务返回可读的 Markdown 或规范化的 Schema v1 JSON,便于下游模型直接消费。
  • 网页截图:将任意公开页面渲染为 WebP 或 PNG 预览,相同请求直接命中缓存,不消耗额度。

所有请求均经过缓存层处理,缓存命中免费,从而降低重复抓取的成本。

平台适配器

服务内置针对多个主流平台的结构化提取适配器,覆盖范围较广,包括:

  • 电商:Amazon、Shopify、WooCommerce 的商品、评分、目录与店铺信息。
  • 应用商店:App Store 与 Google Play 的应用详情、定价、评分、版本与媒体。
  • 社交媒体:Bluesky、Mastodon、Reddit、Instagram、TikTok、X 的帖子、个人资料与社区。
  • 音视频:Spotify、SoundCloud、YouTube、Vimeo 的曲目、专辑、播放列表、频道与公开视频。
  • 资讯与金融:Google News 的话题与头条、Yahoo Finance 的行情快照与 OHLCV 历史数据。

每个平台均提供专用端点,开发者可通过统一的 API 形态访问。

智能体集成

服务提供托管的 MCP(Model Context Protocol)服务器,智能体只需连接一次 MCP,即可发现网页、新闻、图片、视频、地点与股票行情等资源,并通过 extract_public_url 工具读取清洗后的内容。该能力对基于 MCP 构建的智能体框架较为友好。

计费方式

采用预付费信用点制:

  • 价格:每 1,000 信用点 0.49 美元。
  • 每次提取、搜索、金融数据或截图请求计为 1 个信用点。
  • 缓存命中不计费,信用点永不过期。
  • 速率限制:每分钟 60 次 API 调用。
  • 新用户可领取 1,000 个免费信用点。

无月度订阅要求,余额用尽后再充值即可,定位为轻量级的按需付费工具。

信源