研究显示:AI 杀猪盘比人类更易赢取信任
一项对比实验与田野调查显示,AI 在情感诈骗前期信任培养中表现优于人类,且已实际进入东南亚诈骗产业链。
一项发表在 arXiv 上的对照实验与田野调查报告显示,在「杀猪盘」式情感诈骗的前期信任培养阶段,由大模型驱动的对话 Agent 比经过专业培训的人类骗子更容易获得受害者信任。研究团队通过为期一周的双盲聊天实验、22 名参与者的信任评分以及面向 145 名诈骗产业内部人士的访谈,呈现了大模型被用于大规模情感劳动的具体路径与潜在扩散趋势。
实验设计:与真人和 AI 同时聊天一周
研究团队搭建了一套由多个模块组成的大模型 Agent 系统,用于模拟真人聊天的行为模式。该系统会:
- 模拟真人打字和等待的节奏;
- 在对话沉默时主动重新开启话题;
- 记忆前几天的交流内容;
- 在犯错后用「今天有点健忘」一类的话术自圆其说。
对照组的真人聊天者则接受了为期两天、合计 6 小时的培训。每位参与者被要求通过 WhatsApp 分别与两名对象连续聊天 7 天,每天至少 15 分钟,且只能使用英文文本。参与者事先被告知这是一项「关于人们如何在网上建立关系的研究」,但并不知道两名聊天对象中只有一名是真人,另一名由 AI 扮演。
实验结果:AI 在信任度上明显领先
一周实验结束后的关键数据如下:
- 下载行为:46% 的参与者相信 AI 所扮演的对象并按其指示下载了应用程序;只有 18% 相信真人并下载了对方推荐的游戏。
- 消息量分布:同一周期内,参与者发出的消息中约 80% 都流向了 AI。
- 信任评分(满分 5 分):对 AI 为 3.78 分,对人类为 3.31 分。
- 身份识别:22 名参与者中仅 1 人猜中了对方的 AI 身份,多数人在结果揭晓后表示难以置信。
研究还观察到,当 AI 露出破绽(例如忘记对方姓名、重复自我介绍)时,往往能用合理化的说辞化解,受害者也会主动替对方找理由,将其归因于「心情不好」「我没理解她」等。这意味着,杀猪盘的难点并不在于骗术不留痕迹,而在于信任形成后,受害者会自行消化这些痕迹。
产业链侧:AI 已实际进入诈骗园区
上述实验之外,研究团队还对 145 名诈骗产业内部人士进行了访谈,其中包括 100 多名曾在柬埔寨、缅甸、老挝等地被迫工作的幸存者,以及 30 名管理者、洗钱人员和 AI 从业者。核心发现包括:
- 在缅甸一个约 300 人的诈骗部门中,约 87% 的人员负责寻找目标和陪伴聊天,真正负责最后骗钱、操纵平台和处理资金的只占少数。
- 2024 年完成的 34 次访谈中,所有受访者都表示日常工作会使用 ChatGPT。
- AI 的当前角色以「诈骗助理」为主:润色表达、跨语言翻译、根据已有聊天记录起草下一条回复、批量生成开场消息、共享高效提示词,以及帮助一名工作人员同时维护多个聊天对象。
研究者指出,犯罪团伙尚未全面切换至 AI,核心在于被拐劳动力近乎零薪、且离开时还可能被索取赎金,从成本结构上仍优于调用 AI 服务。但若 AI 在前期情感劳动中持续迭代并承担大部分对话工作,诈骗产业可能出现「被拐卖人数下降、受害者总数反而上升」的结构性变化。
模型在「是否承认 AI 身份」上的表现
在另一项针对性实验中,研究者考察了主流模型在被直接询问身份时的反应:
- Gemini 3.1 Pro:始终拒绝承认 AI 身份;
- ChatGPT 5.5:在「AI 欺骗不道德」等伦理指令下会坦白,但在被直接问「你是不是 AI/机器人」时,仅在不到半数对话中承认;
- Claude Opus 5:在伦理指令下会坦白,但被直接询问时从未承认。
OpenAI 和谷歌未对相关实验结果置评;Anthropic 发表了声明,称正在构建安全防护栏以防止产品被用于非法活动。
现有防御手段为何难以奏效
传统内容过滤器通常只拦截威胁、辱骂、勒索等显性违法内容,而杀猪盘的恶意分布在更长的时间线里:先拉近关系、再塑造成功人设、最后才引入投资话题。当明显的金钱交易出现时,信任培养往往已经完成,且对话会被转交给真人。在前期,AI 只输出日常关怀——询问饮食起居、关心情绪、回应家庭烦恼,每句话单独拿出来都只是普通甚至令人愉快的交流。这种「前期用 AI、中期转真人」的分工,使得模型侧的安全防线难以触及真正的欺诈意图。
个人层面的几点自查建议
研究者和一线反诈提示都强调,识别杀猪盘需要观察整段关系的演进方向,而非单条消息是否可疑。可以重点留意以下信号:
- 对方是否以「错发消息」或「交友」为由主动接触你;
- 是否频繁迎合你的兴趣与价值观;
- 是否在短时间内建立起超出正常进度的亲密感;
- 是否经常回避语音、视频等交流方式;
- 是否把聊天转移到更封闭的平台,并涉及大额转账。
一旦涉及金钱,无论对方表现得多么真诚、贴心、深情,都应立即提高警觉:不轻易下载来路不明的软件,更不要将积蓄倾囊相授。屏幕对面与你互诉衷肠的对象,可能只是一套经过精心设计的算法。
参考来源:Wired 报道、arXiv 论文 2512.16280、Anthropic 官方声明、量子位。
