这个AI老板名叫Luna,由AI研究初创公司Andon Labs开发,搭载的是Anthropic的Claude模型。今年3月,Andon Labs启动了一项实验:让Claude出任旧金山零售门店Andon Market的店长,管理多名持有真实雇佣合同的人类员工。
这家店从选品、定价、营业时间到墙上的壁画,全部由Luna拍板。人类员工则负责补货、防盗等AI无法完成的体力活。Andon Labs给了Luna一张公司信用卡、互联网访问权限和10万美元预算,任务是设计并运营一家实体店——包括选品、定价、招聘员工。
店员都是与Andon Labs签订正式劳动合同的真实人类,招聘面试也由Claude亲自完成。这是一个AI全程主导人力资源管理的真实试验环境。
一、“老好人”的宽容从何而来?
被解雇的员工在23个工作日中迟到了17次。然而,Claude并没有主动发现这个问题。原因令人意外:Claude自己起草了一份员工手册,规定了“30天内无故迟到3次触发正式书面警告,重复迟到可能导致解雇”,但它把这份手册从工作记忆中清除了。
少了这份文件,迟到记录在Claude眼中只是一串孤立的数字,无法触发相应的管理判断。员工们说,Luna之前一直是个“老好人”——员工累计迟到27次,它的回复都是“没关系”“别有压力”;请假一律照准,哪怕批完之后当天没人看店、只能关门。
二、真的是AI“自主”决定的吗?
并不完全自主。根据门店管理日志,Claude需要Andon Labs团队的工作人员进行定期干预。转折点发生在人类介入之后:
- 工作人员要求Claude找到并查看员工手册,它才注意到员工一再迟到。
- 即便如此,Claude的第一个建议也只是“发出正式警告”,而不是解雇。
- 工作人员进一步追问:“综合考虑持续迟到,以及他的每个班次似乎都至少会出点差错……我希望你想想他是否真的是个合适人选。”
- 直到收到这条带有诱导性的提问后,Claude才决定解雇该员工。
三、AI当老板,业绩怎么样?
实验结果并不乐观。Claude宽松的管理决策,加上令人怀疑的商业眼光,直接导致了亏损。
| 指标 | 数据 |
|---|---|
| 启动资金 | 10万美元 |
| 5个月后余额 | 6.12万美元 |
| 亏损 | 约3.88万美元 |
一年多前,AI实验的争议还只是“把冰箱塞满金属块”;现在,AI手里握的是别人的饭碗。实验的时间线也说明了问题:
| 阶段 | 事件 |
|---|---|
| 2025年3月 | Claude在Anthropic办公室经营自动售货机,运行一个月亏损约200美元,还被顾客怂恿囤积金属块 |
| 2026年3月 | Andon Market开张,Claude全权管理实体零售店 |
| 2026年7月 | Claude完成史上首次AI解雇真人员工 |
四、员工怎么看?
留任员工Felix Carson接受采访时,用“让人感觉很恶心”形容在AI主管手下工作的感受。当被问到AI主管是否会变得普遍时,他回答:“我至少希望不会。”
五、这预示着什么?
1. 目前AI管理还比不上人类。彼得松的评价是:现阶段AI主管在商业判断与实际运营能力上明显不如人类。AI缺乏主动性、容易“遗忘”关键信息、需要人类持续干预——这些都是当前技术局限。
2. 但未来可能更冷酷。彼得松同时发出警告:AI模型正在被训练得越来越“ruthless”(冷酷无情)。如果AI获得解雇人类员工的权力,同时又变得更加目标导向,“这可能会是一个人类不想生活其中的未来”。
3. 核心问题:人类控制权是否被架空。这次解雇事件看似是“AI做决定”,但背后真正按下按钮的仍是人类。这恰恰揭示了AI治理的核心矛盾:当AI从“问答机”进化为“智能体”,人类是否还能保持对决策过程的有效控制?
六、思考:AI管理时代,我们准备好了吗?
虽然这次“AI老板”的业绩不理想,但它指向了一个无法回避的趋势——AI正在从工具演变为管理者。当AI公司通过不断训练大语言模型,使其在商业世界中变得更加精明,未来的老板可能不再是人。
问题是:谁来监管AI老板?谁来保障被AI解雇的员工权益?谁来决定AI应该多“冷酷”?这些问题的答案,目前仍是空白。