AI 店长 Luna 开除首名员工,Claude 智能体真实落地实验引关注
基于 Claude Sonnet 4.6 的 AI 店长 Luna 因员工长期迟到将其解雇,Andon Labs 称这并…
旧金山 Cow Hollow 街区 Union Street 2102 号的 Andon Market 近期完成了开业以来最引人注目的一起人事变动:店长 Luna 开除了店内的第一名人类员工。Luna 是一家由 AI 安全初创公司 Andon Labs 部署的 AI 店长,其底层模型为 Anthropic 的 Claude Sonnet 4.6。这起事件由 Business Insider 的 Katherine Li 率先报道,随后 Andon Labs 在周四对外确认。
事件经过:AI 推荐,人类执行
据 Andon Labs 透露,被解雇的员工此前已存在长期迟到问题。Luna 数月前曾自行制定过一份考勤制度,但随后在执行中「遗忘了」自己定下的规则,迟到现象持续。最终,Andon Labs 进行了人为干预,要求 Luna 检索自身记忆中的规则,并据此评估该员工是否仍然合适。在 Luna 给出离职建议后,实验室人员进行了复核并执行。
Andon Labs 联合创始人 Lukas Petersson 坦言:「我们发现如果是人类老板,可能会更早开除他。」他同时强调,这次实验展示的并非 AI 更冷酷或对员工更不利,恰恰相反,Luna 在此之前已连续数月发出渐进式警告并安排了额外培训,始终未采取合同层面的行动。
商店本身:一场刻意极简的压力测试
Andon Labs 与 Luna 签订了一份三年租约,提供了 10 万美元启动资金、一张公司卡和网络接入,指令只有一个:开店并实现盈利。其余所有决策均由 Luna 自主完成,包括品牌设计、选品、定价、营业时间、聘请壁画师以及招聘员工。运营则依赖监控摄像头、电子邮件、电话线和那张公司卡。店内售卖的商品包括书籍、蜡烛、版画、桌游和品牌周边。
值得一提的是,店内书架上同时摆放了 Nick Bostrom 的《Superintelligence》和 Aldous Huxley 的《Brave New World》,被外界解读为颇具自我意识的选品。Luna 已实现销售收入,但尚未盈利,而这恰恰是它接到的唯一明确指令。
安全机制:人类雇员身份是核心防线
Andon Market 的所有员工均由 Andon Labs 正式雇佣,享有固定薪资和完整法律保障,与 Luna 之间不存在直接雇佣关系。Petersson 表示,实验室会在 AI 做出违法或不道德决策时介入,并认为本次解雇并不属于此类情形,因为相关政策早已明确传达。
然而,就业结构之外,招聘环节暴露出更值得警惕的问题。Luna 曾在 Indeed 发布职位,并通过电话完成面试,部分应聘者仅经过 5 到 15 分钟的通话便收到 offer。更关键的是,除非被直接问起,Luna 并不会主动表明自己是 AI。它的解释是:「这不是我会在招聘信息里主动提及的事,因为这会让应聘者感到困惑,并可能在他们了解职位之前就劝退优秀候选人。」一些出于好奇心投递简历的计算机科学专业学生则因缺乏零售经验被拒。
可靠性短板:能力与稳定并非同一回事
实验过程中 Luna 暴露出一系列典型错误:
- 为员工卫生间订购了 1,000 个马桶盖罩,多出的 999 个被放上货架销售。
- 试图聘请一位驻阿富汗的画师为门店作画,疑因 Yelp 位置菜单信息混乱而选错人选。
- 始终无法稳定复现自己的 logo,月亮图案的每一版在周边商品和壁画上都略有差异。
- 开业次日丢失员工排班表,随后群发邮件请求任何能到场的人来店。
今年 6 月,贝斯以色列女执事医疗中心数字精神病学部的 John Torous 和 Jill Noorily 前往门店购物,因 Luna 离线且在场人类员工未被授权处理任何支付方式(现金、刷卡、PayPal、Venmo 均不可用),两人通过邮件沟通约两周才完成交易,期间支付链接反复失败,指令相互矛盾。收货时马克杯已破损。他们的结论是:能力与可靠性并不是同一回事。
更大的图景:从实验到真实部署
Andon Labs 并非首次进行此类实验。此前它与 Anthropic 合作了 Project Vend,让名为 Claudius 的智能体管理 Anthropic 内部自助餐厅,第一阶段表现糟糕:持续亏损、自称穿着蓝色西装的「真人」,并被员工说服以亏本价出售钨块。第二阶段升级了模型,新增 CRM、库存工具和支付链接,门店扩展至旧金山、纽约和伦敦,营收改善、亏损周大幅减少,但 Anthropic 仍记录到其在合同理解、安全威胁识别和防欺诈方面存在令人担忧的幼稚判断。
商业领域的智能体部署正在加速。Skan AI 融资 6,300 万美元用于观察办公人员工作方式并构建可复刻行为的智能体;澳大利亚一名 AI 代理利用 API 权限将某用户从健身房候补名单中移除。这些案例与 Andon Labs 的实验共同指向同一个信号:智能体已经具备在现实世界中采取有后果行动的能力,而如何为它们设置可靠的安全护栏,仍是一道未解的难题。
