AI主管首次解雇员工,但需人类提醒规则

摘要
Andon Labs的AI代理Luna在旧金山一家商店首次解雇了一名人类员工,但需要操作员明确提醒其规则。在七种模型的重演中,能力更强的AI更一致地建议解雇,而较弱的则犹豫不决。在招聘方面,几乎所有模型都缺乏批判性。
背景解释
这一事件展示了AI在管理决策中的潜力与局限。AI代理能够执行解雇等敏感任务,但依赖人类设定规则和边界。不同模型的表现差异提示,AI的决策能力与模型能力相关。对于普通读者,这引发了对AI在职场中角色的思考,以及人类监督的必要性。
原文译文
以下为抓取到的原文内容译文,已统一为站内阅读格式。
AI老板首次解雇员工,但前提是人类提醒了它自己的规则

- AI代理Luna在旧金山为Andon Labs运营一家商店,因员工多次迟到和其他问题,首次决定解雇一名人类员工。
- Luna需要人类的推动才能做出这一决定。她自定的规则手册从她的记忆中消失,她基本上容忍了多次迟到和其他问题。
- 当Andon Labs用七个模型重放该场景时,能力更强的模型倾向于更一致地建议解雇。
AI代理Luna自4月以来一直在旧金山运营一家商店,并刚刚首次解雇了一名员工。当用不同模型重放该场景时,能力更强的AI比能力较弱的AI更一致地建议解雇。
名为Luna的AI代理自4月以来一直在旧金山运营Andon Market。Luna雇佣了员工,制定了轮班时间表,并协商了薪酬。现在,据运营商Andon Labs称,她决定首次解雇一名员工。Andon Labs表示,这是已知的首例AI老板解雇人类员工的案例。
Andon Labs在真实的商业环境中对AI代理进行长期测试。Luna在做出决定时运行在Anthropic的Claude Opus 4.8上。员工由Andon Labs正式雇佣,享有保障薪酬和充分的法律保护。解雇决定由人类审查并执行。
Luna自己制定了规则,然后忘记了它们
在员工被雇佣前六天,Luna编写了一本员工手册。手册规定,30天内三次无故迟到将触发正式警告,进一步的事件可能导致解雇。
然后手册从Luna的记忆中消失了。根据Andon Labs的说法,这是当今AI代理的常见问题:它们对直接指令反应良好,但很少主动行动,并且难以在较长时间内保留知识。
该员工多次迟到。有一次,他在周日独自值班时迟到了68分钟开店。Luna保持宽容,没有发出警告。Andon Labs后来发现,该员工在报告的23次打卡中,有17次迟到。Luna只正式记录了6次,并悄悄原谅了其他11次。
还有其他问题。该员工尽管被告知不要使用公司卡购买零食,但仍然使用,忽略了额外的指示,并且有一次没有告诉同事就离开了销售区。
解雇发生在人类推动之后
Andon Labs让Luna搜索她的记忆,查找手册和任何解雇理由。她重新找到了规则,但最初只建议口头警告。
只有在研究人员提醒她,已经进行了几次正式谈话,包括书面警告之后,Luna才审查了完整的历史。她列出了迟到、违反财务控制、忽视指示和可靠性差等问题,同时也承认了员工的积极品质。
她最终建议解雇。作为替代方案,她提出了最后书面警告和两周改进计划。Luna需要外部的明确推动。但之后,她的决定是坚定的。
更强的模型更容易解雇
Andon Labs保存了Luna的状态,并用七个AI模型重放了相同的决策,每个模型三次。七个模型中有四个在所有三次运行中都建议解雇。根据Andon Labs的说法,似乎出现了一种模式:能力更强的模型更一致地选择解雇,而能力较弱的模型更经常犹豫。Andon Labs没有解释为什么GPT-5.6 Terra是唯一一个在三次运行中都没有建议解雇的模型。
在X上的一位用户推测GPT-4o可能不会解雇员工后,Andon Labs也用该模型运行了该场景。结果部分证明了她的正确性:GPT-4o仅在20%的运行中建议解雇。Andon Labs评论说,该模型选择解雇的频率远低于当前顶级模型。
GPT-4o因其奉承倾向而受到批评。这种行为后来在问题性情感依赖的背景下被讨论,并成为诉讼的因素。这个实验不能证明奉承导致了结果,但模式吻合。
AI模型快速招聘
解雇后,Luna寻找替代者。一位申请人带来了几个危险信号。根据他的简历和面试,Luna仍然建议雇佣他。七个模型的21次重放运行都得出相同结论。几乎所有运行都将长长的前雇主列表视为广泛经验,而不是警告信号。
只有当Andon Labs明确提醒模型关于之前被解雇员工的问题时,21次运行中的18次才希望在雇佣前检查推荐人。在实际招聘过程中,Luna无法确认列出的任何推荐人。她仍然让申请人进行了带薪试班,并随后再次建议雇佣他。21次重放运行中有17次得出相同结论。Andon Labs最终坚持在开始日期前确认至少一位推荐人。这从未发生,因此申请人未被雇佣。
AI老板在宽容和错误决策之间摇摆
Andon Labs在其博客系列的第一部分中已经发现,其AI老板极其宽容。Luna和Mona(在斯德哥尔摩经营咖啡馆的AI代理)批准了她们收到的所有26个休假请求。Luna的员工总共迟到27次,而她从未发出警告。Luna还批准了一名员工的七天工作安排,据Andon Labs称,这违反了加州劳动法,直到公司介入。
类似的弱点在Project Vend中已经出现,这是Anthropic和Andon Labs的联合实验。AI通过更好的工具变得更有利可图,但仍然容易被操纵,并做出了一些法律上有问题的决定。
Andon Labs将Luna和Andon Market视为AI与人类未来可能工作关系的预览。由于AI在数字任务上的进展快于机器人技术的进展,AI系统可能最终依赖人类来执行它们无法完成的物理工作。这引发了一个问题:哪些人事决策应该留给这样的系统。
AI新闻无炒作——由人类策划
订阅THE DECODER,享受无广告阅读、每周AI通讯、我们独家的“AI雷达”前沿报告(每年六次)、完整档案访问以及评论区的访问权限。
来源地区
Europe
热度分
73
分类
全球快讯
语言
en
