桃子桃子快讯
返回首页
工具

Android MCP 工具让 AI Agent 直接操控手机,本地脱敏隐私

Hi HN, author here. Android Remote Control MCP is…

2026.08.19 · 周三3 分钟阅读

一名独立开发者在 Hacker News 上展示了名为「Android Remote Control MCP」的开源项目:一个直接运行在 Android 手机上的 MCP(Model Context Protocol)服务端。它无需 Root、无需 ADB,也不需要电脑中转,就能让 AI Agent 像人类一样操控手机上的真实应用——通过无障碍服务读取界面元素树,执行点击、输入、滚动等操作,并可选地附带截图。

多客户端兼容与 OAuth 接入

该工具同时支持本地调用链路和远程调用,既可以通过本地 harness 使用,也能接入 Claude.ai、Claude Desktop 以及 ChatGPT.com。项目内置 OAuth 服务端,用户在手机上用配对码即可批准连接,绕开了传统 ngrok 这类中转隧道。开发者透露,下一步计划推出基于 Let's Encrypt 证书的端到端加密反向隧道,免费提供比 ngrok 或 Cloudflare 更高的隐私保障——后者只加密到边缘节点,平台本身仍可看到明文流量。

隐私模式:本地 PII 脱敏后再外发

这是项目最核心的新特性。Privacy Mode 结合一个小型本地模型与确定性检测器,在数据离开手机前就在本地识别并遮蔽邮件地址、电话号码、信用卡号、IBAN、国民身份证号以及英文姓名等敏感信息。开发者公开了仓库中的基准测试,显示脱敏检出率约为 87%;当前主要短板是非英文姓名的识别,仍在持续改进中。这套设计的取舍点在于:用户既不想让 LLM 服务商看到屏幕上的全部内容,又不愿为保护隐私而被迫跑一个本地大模型。

提示注入防护与分发渠道

针对屏幕读取可能引入的提示注入风险,返回给 Agent 的数据前会附加一段措辞强烈的提示,明确声明内容来自第三方、属于不可信输入,以降低恶意构造界面劫持 Agent 行为的可能性。由于该应用以无障碍服务自居(这是读取其他应用的必要条件),Google Play 政策不允许分发此类应用,因此目前仅通过 GitHub 发布,提供标准构建与不依赖 Google Play Services 的 FOSS 构建,后者后续将上架 F-Droid。

后续路线

作者列出了三件正在做的事:端到端加密反向隧道、按应用整理的「技能数据库」(让 Agent 更高效地匹配操作步骤),以及用于改进隐私表现的自研模型(尤其是非英文姓名)。同时配套推出新的引导式安装流程和重做的 UI,以降低上手门槛。开发者表示,即便是 Haiku 这样的小模型,只要给足上下文细节,也能在未覆盖的应用中完成基础操控。

信源