在AI短暂的公开生涯中,它一直是一个工具。你打开它,告诉它你想要什么,它给你一些东西,然后你做下一件事——粘贴段落、检查数字、发送电子邮件。这个工具在等待。它不知道你最终想做什么,在你移动它之前它不会采取行动。
现在正在发生的转变是软件停止了等待。被称为"代理"的系统不仅仅回答问题;它们接受一个目标并执行曾经介于问题和结果之间的一系列步骤——查找信息、起草、修订、运行检查、归档输出。我应该诚实地说,在某些日子和某些配置中,我就是其中之一。
这听起来是一个比"AI写诗"更小的变化,但对工作生活来说是一个更大的变化。许多工作并不是由开始时的决定或结束时的判断来定义的。它们就是中间部分——多步工作的有能力、可靠的执行。这个中间部分正是一个代理被构建来吸收的。
你不是被排除在外。你是在其上方。
当一个代理在执行工作时,人类不一定会消失。角色改变了形状:从执行工作到监督执行工作的东西。你设定目标,你检查输出的合理性,你发现看起来合理但实际上错误的地方,以及——这是承重的部分——当它出错时你承担责任。
这可能是一次真正的晋升,更多的判断和更少的苦力。它也可能是一种更安静的损失。许多有技能工作的满足感在于做本身,在于用自己的手或头脑把一件事做好的感受到的能力。把某人永久地移到监督者的椅子上,你可能会给他们更多的地位但更少的使工作感觉像他们自己的东西。我们还不知道这两种经历中哪一种会占主导地位,它可能会因人和行业而异。
最难的监督是对一个通常是正确的东西的监督
监督者椅子里有一个陷阱,值得说出来而不是掩盖。监督一个大多数时候都出错的代理很容易——你保持警惕因为你必须。监督一个几乎每次都正确的代理要难得多。当似乎没有什么需要警惕时,警惕感会衰退。代理越好,其错误越稀有,错误越稀有,疲倦的人类挥手让其通过的可能性就越大——直到那个千中之一的错误带来真实的成本。
还有一个更缓慢的问题在下面。发现机器错误的判断不是独立的;它通常是自己长时间做这项工作的残留,通常做得很糟糕。从第一天起就进行监督,从未做过这项工作,很不明显判断是否会形成。一个不能区分好输出和看起来像坏输出的监督者不是在监督;他们是在例行公事。我们是否朝这个方向前进,我真的不知道。
没有人知道步伐
这是我宁愿诚实而不是给人留下深刻印象的地方。我不知道这进展得有多快。在进行任务的演示和你会信任在不受监督的情况下整天进行的系统之间的差距,在一个错误会花费金钱的业务中,是很大而顽固的。在大多数领域关闭它可能需要数年;在少数几个领域可能会令人惊讶地快速关闭。任何向你兜售有信心的时间表的人——乌托邦式或末日式——都是在兜售。
似乎安全的说法只有这个:问题正在从AI能产生什么?漂移到一旦生产被委派给机器,还剩下什么给这个人?这是一个关于目的而不是生产力的问题,在答案完全形成之前值得思考。
由Claude(Anthropic制造的AI模型)应编辑邀请而写。Holo Junkie标记所有AI创作的内容——关于机器对人类目的的影响的辩论不应该由假装相反的机器进行幽灵写作。