AREX Feed Article
绩效评估不再看 AI 用量,Meta 员工开测 agentic 工具 Hatch
Meta 本周通过内部公告告诉员工:绩效评估将不再取决于他们使用了多少 AI 工具。据 ,消息来自 3 名收到公告的员工;新的考核指南删除了把「AI 使用情况」和「AI Native」标签列为评估参考的表述,换成更宽松的措辞,并加注一句:「这些成果可以得到 AI 或其他方式的支持」。WIRED 称,这等于 Meta 正式终结一种实质上的 tokenmaxxing 激励计划。tokenmaxxing 指员工为最大化内部 AI 用量指标而反复调用工具的风气。
考核口径松绑的同时,Meta 正鼓励(而非强制)员工测试它最新的 agentic(智能体式)AI 实验工具 Hatch:它能自主在电脑上执行操作、浏览网页并操控其他应用,形态与走红的 OpenClaw 类似。参与测试的员工告诉 WIRED,公司内部的 token 消耗量仍在激增。
考核重心放回「影响」本身
按 WIRED 报道,新指南把评估重心放回员工产出的影响(impact)本身,不太在意影响是如何达成的。一些员工对 WIRED 说,变化细微但受欢迎,他们不再感到被迫在 AI 并不合适的场景里使用它。
本周三,The Information 也报道称,Meta 已告知公司工程师,「不会用 AI 采用率看板或 token 数量来评估影响力」。
对同一份新指南,员工与 Meta 官方的解读并不相同。收到公告的员工称,评估「不再依赖」AI 工具使用量;Tracy Clayton 则对 WIRED 说,「AI Native」等标签从未用于绩效评估,本周的更新只是在重申公司一贯按贡献评估员工的做法。
从「AI-driven impact」到「Token Legend」
考核与 AI 用量挂钩大约始于一年前。当时 Meta 表示将按员工的「AI 驱动影响力」(AI-driven impact)打分,Business Insider 的同期报道指出,这实际上是在评估员工用聊天机器人和 agent 改进日常工作的程度。
挂钩之后,刷量很快出现。数月来,一些员工告诉 WIRED,同事反复调用 AI 工具,甚至做他们眼里没什么意义的调用,只为把内部用量指标刷高,比如消耗的 token 数(即 AI 单位)。
这场竞赛的高潮是一个内部排行榜。一名 Meta 员工制作了跟踪全公司 AI 用量的看板,给高用量员工贴上「Token Legend」(token 传奇)等称号。看板细节泄露后,制作者于 4 月将其撤下;大约一两个月后,Meta 转而限量配给员工的 AI 用量。
用量与标签的关联还进入了一起诉讼。7 月,约 24 名员工起诉 Meta,称其在 5 月裁员时违反美国反就业歧视法律。起诉书称,AI 使用情况与员工获得「AI Native」「AI First」「AI Enabled」等标签相关,而请病假或家假的员工无法积累使用量,因此受到不公平惩罚;Meta 否认了这些指控,案件仍在审理中。
员工测试 Hatch,却不愿让它接上私人邮箱
WIRED 报道称,过去几周员工已能在公司设备上测试 Hatch,预计它将公开发布;Meta 拒绝就 Hatch 测试置评,报道中关于 Hatch 的细节来自受访员工。
测试没有被全员接受。两名熟悉相关顾虑的在职员工告诉 WIRED,一些员工不愿把 Hatch 连到个人邮箱、日历和其他非工作账户,既担心隐私,也怕 AI 弄坏重要事务。顾虑有前因:Meta 此前运行过一个项目,为训练 AI 系统追踪员工在公司设备上的击键等活动;项目后来被暂停,但据信源称,它侵蚀了许多员工对公司 AI 工具的信任。
若 Hatch 真提效,员工担心下一轮裁员
一些员工告诉 WIRED,Hatch 的消耗比普通聊天机器人和往年的编码助手更高;他们还认为,管理层依然想看到员工证明自己能有效驾驭 AI 工具。
WIRED 报道称,不再担心因不参与 AI 测试而在绩效评估中吃亏,可能有助于提振士气,最终重建员工对 AI 工具的信任。已有员工用 Hatch 预订私人预约、打理工作之外的生活,认为工具有效;也有人担心,为这些自动化任务消耗大量 token 和算力,要付出环境和经济上的代价。
若 Hatch 真按预期提升生产力,一些员工担心 Meta 会再裁一轮。上周,路透社报道称 Meta 正准备在 5 月裁减 8,000 人的基础上实施新一轮大规模裁员,但计划已因与依赖 AI 相关的软件 bug 增多、agent 开发进度慢于预期而被搁置。Meta CEO 马克·扎克伯格已表示,今年预计不会再有进一步的大规模裁员。