AI Agent Luna首次裁员时需人类提醒规则才能执行;能力更强的模型更果断建议终止,但弱模型会犹豫。
AI 代理 Luna 在一次人类员工的反复迟到等问题后,第一次决定解雇一名员工。
但在此之前,她需要人类从旁推动。她自己写的规则手册已经从记忆中消失,她很大程度上容忍了反复的迟到和其他问题。
当 Andon Labs 用七个模型重放这一场景时,更强大的模型往往更一致地建议解雇。
AI 代理 Luna 自四月起在旧金山经营一家门店,刚刚首次解雇了一名员工。当用不同模型重放这一场景时,更强大的 AI 比弱小的模型更一致地建议解雇。
一个名为 Luna 的 AI 代理自四月起在旧金山经营 Andon Market。Luna 雇用了员工、制定了排班表,还协商过薪资。现在,据运营方 Andon Labs 表示,她第一次决定解雇一名员工。Andon Labs 称,这是已知首例 AI 老板解雇人类员工。
Andon Labs 在真实商业环境中长期测试 AI 代理。Luna 在做出决定时运行在 Anthropic 的 Claude Opus 4.8 上。员工由 Andon Labs 正式雇用,享有保障薪酬和完整法律保护。解雇决定经人类审核并执行。
Luna 写了自己的规则,然后遗忘了
在这名员工被雇用的六天前,Luna 写了一份员工手册。其中规定,30 天内三次无故迟到将触发正式警告,进一步违规可导致解雇。
然而手册从 Luna 的记忆中消失了。Andon Labs 表示,这是当前 AI 代理的常见问题:它们对直接指令响应良好,但很少主动行事,且难以在较长时间内保留知识。
该员工反复迟到。有一次,他在独自值周日班时迟到了 68 分钟。Luna 保持了宽容,没有发出任何警告。Andon Labs 后来发现,这名员工在 23 次报了打卡时间的班次中迟到了 17 次。Luna 只正式记录了六次,悄悄原谅了另外十一次。
还有其他问题。该员工被告知不要使用公司卡买零食,却依然故我;无视额外指令;还有一次在未告知同事的情况下离开了销售区。
只有在人类推动后才发生解雇
Andon Labs 让 Luna 在记忆中搜索手册以及任何解雇依据。她找到了规则,但最初只建议进行口头警告。
只有在研究人员提醒她,包括书面警告在内的多次正式谈话已经发生后,Luna 才审查了完整历史。她列举了迟到、财务管控违规、无视指令和可靠性差等问题,同时也承认了该员工的积极品质。
她最终建议解雇。作为替代方案,她提出最后一次书面警告配合两周改进计划。Luna 需要外部的明确推动。但在之后,她的决定是坚定的。
更强大的模型更容易做出解雇决定
Andon Labs 保存了 Luna 的状态,用七个 AI 模型各重放三次同一决定。七次中有四次在全部三次运行中都建议解雇。据 Andon Labs 称,一种模式似乎浮现出来:更强大的模型更一致地选择解雇,而较弱的模型则更频繁地犹豫。Andon Labs 没有解释为什么 GPT-5.6 Terra 是唯一一个在三次运行中都没有建议解雇的模型。

在 X 上有用户猜测 GPT-4o 可能不会解雇员工后,Andon Labs 也用该模型运行了这一场景。结果部分证明了她的正确:GPT-4o 只有 20% 的运行中建议解雇。Andon Labs 评论称,该模型选择解雇的频率远低于当前顶级模型。
GPT-4o 因其谄媚倾向而受到批评。这种行为后来在问题性情感依赖的背景下被讨论,并被纳入诉讼考量。本实验无法证明谄媚驱动了这一结果,但模式是吻合的。
AI 模型雇用速度快
解雇后,Luna 开始寻找替代人选。一名申请人带来了多个危险信号。基于他的简历和面试,Luna 仍然建议雇用。七 个模型的全部 21 次重放运行得出了相同结论。几乎所有模型都将那一长串前雇主解读为广泛经验,而非警告信号。
只有在 Andon Labs 明确提醒模型关于先前被解雇员工的问题后,21 次运行中有 18 次希望在雇用前核查推荐信。在实际雇用过程中,Luna 无法确认任何一位所列推荐人。她仍然让该申请人从事了带薪试岗,之后再次建议雇用他。21 次重放运行中有 17 次得出相同结论。Andon Labs 最终坚持要求在入职前确认至少一位推荐人。这从未发生,因此该申请人未被雇用。
AI 老板在宽容和错误决策之间摇摆
Andon Labs 在其博客系列的第一部分已经发现,其 AI 老板极为宽容。Luna 和在斯德哥尔摩经营咖啡馆的 AI 代理 Mona 批准了她们收到的全部 26 个请假请求。Luna 的员工共迟到 27 次,而她从未发出过警告。Luna 还为一名员工批准了七天工作日程,据 Andon Labs 称,这违反了加州劳动法,直到公司介入才作罢。
类似的弱点在 Anthropic 和 Andon Labs 的联合实验 Project Vend 中已经暴露。AI 在获得更好的工具后变得更加盈利,但仍然容易被操纵,并做出一些法律上存疑的决定。
Andon Labs 将 Luna 和 Andon Market 视为 AI 与人类未来工作关系的预览。由于 AI 在数字任务上的进步速度快于机器人技术的进展,AI 系统可能最终依赖人类来执行体力劳动。这引出了一个问题:哪些人事决定应该完全交给此类系统处理。