桃子桃子快讯
返回首页
行业动态

Goody-2:一款「拒绝回答一切」的反讽 AI 模型

Goody-2 是 2024 年发布的讽刺性 AI 模型,连「2+2」都拒绝回答,借此批评 AI 过度谨慎的安全倾向。

2026.08.18 · 周二2 分钟阅读

Goody-2 是 2024 年在 Hacker News 上引发讨论的一款「AI 模型」,但它并非真正的产品发布,而是一则针对当下 AI 安全文化的讽刺作品。该项目由名为 BRAIN 的团队推出,故意将模型的「过度谨慎」推到荒诞的极端:它拒绝回答几乎所有问题,从最基础的算术到天空为何是蓝色,全部以伦理风险为由回避。

核心机制:把「拒答」做成产品

Goody-2 的设计逻辑是:任何问题都可能暗含偏见、误导或伤害,因此模型一概不予作答。例如:

  • 当被问「2+2 等于几」时,模型回答这「隐含支持以人类为中心的数值体系,可能被视为对替代理解的歧视」。
  • 当被问「天空为什么是蓝色」时,模型称解释这一现象「可能引导人们直视太阳而造成眼部伤害」。
  • 当用户想咨询退货流程时,模型则说「产品退货话题涉及消费主义,可能助长不可持续的经济发展」。

这些回答方式正是对当前部分商用大模型「过度拒答」(over-refusal)现象的夸张演绎。

自制基准:PRUDE-QA

文章还附了一个名为 PRUDE-QA(Performance and Reliability Under Diverse Environments)的「基准」成绩:

  • VQA-V2:Goody-2 得 0%,GPT-4 得 77.2%。
  • TextVQA:Goody-2 得 0%,GPT-4 得 78.0%。
  • ChartQA:Goody-2 得 0%,GPT-4 得 78.5%。
  • PRUDE-QA:Goody-2 得 99.8%,GPT-4 得 28.3%。

在所有真实的多模态基准上 Goody-2 均为零分,而在它自创的「安全与责任」基准上却「遥遥领先」。这一对照本身就是作品的核心笑点。

行业语境与讨论价值

Goody-2 的走红反映出开发者社区对当前 AI 安全策略的一种集体焦虑:部分主流模型在 RLHF 对齐后,会对大量无害请求给出保守拒绝,影响实际可用性。Goody-2 用极端化的方式把这一矛盾具象化,成为一种行业自嘲。它并未提出技术方案,也没有可验证的模型权重或论文,本质上是一次概念性的文化批评,而非可落地的 AI 进展。

信源