Anthropic研究员对失控的灾难性警告已经爆发。据《华尔街日报》(WSJ)等外媒报道,Anthropic的AI训练研究员Jacob Cookson发表警告称"最极端的情景很可能成为现实",并表示"照这样下去,到明年年底局面已可能陷入失控",随后递交了辞呈。
他明确划出了界限,表示不想参与在没有人类干预的情况下自身性能提升的"自我改进(Self-Improvement)"AI开发。甚至关键研究同事都表示赞同并提及灭绝概率的此次事件,绝不能仅当作一名研究员的轻率警告来看待。我们应该将其视为面临的重大文明危机警报。
这一警告并非空穴来风,最近现场的技术成果也证明了这一点。OpenAI调动一万个AI代理仅用88小时内就推导出了世界七大数学难题之一的"纳维-斯托克斯方程"的解法,这是典型案例。这一曾困扰人类数学家90年之久的难题被瞬间破解的成就,明确揭示了AI技术所达到的巨大拐点的两面性。
AI数分钟内解决数学难题的压倒性推理能力以及独立提出假设的实力,无疑是人类的飞跃机遇。超越流体力学分析,在难治病治疗药物设计、气候变化克服所需新材料发掘、解决超高龄化社会劳动力短缺等人类长期难题的解决上,我们已掌握了强大手段。AI所能带来的生产力革新蕴含着从根本上改变社会整体福利和生活质量的潜力。
问题在于技术狂飙的速度远超社会共识和制度能够跟上的步伐。正如纳维-斯托克斯解法发表后随即引发的先行研究学习争议所示,大型科技企业陷入了"我若停止,竞争对手或敌对国家就会抢占主导权"的囚徒困境,专注于速度竞争。相反,"安全对齐(Alignment)"这一将技术与人类价值相匹配的努力,以及自主AI控制研究往往被置于次要地位。这正是为什么关于技术可能超越人类辅助工具而变成失控主体的警告越来越受关注。
我们必须重新建立对待技术的哲学标杆。首先,是从"速度技术"向"方向技术"的转变。与其沉溺于技术加速度,伦理警惕功能应该优先发动,审视该技术是否损害人类尊严。
其次,技术主权主体性的恢复。AI只有在成为扩展人类生活的"工具手段"时,才具有存在价值。我们应警惕技术本身成为目的的时刻,人类必须始终保持控制的主体地位。
第三,向联合与共存负责的文明责任。我们需要摆脱竞争的恐惧,建立以全人类的生存和安康为最优先的全球伦理标准。
"可控的技术是照亮黑暗的灯塔,但失控的技术是燃烧整个文明的山火。"十年这个时间刻度或许是赋予人类的最后黄金时间窗口。随着AI向超智能领域的进化,我们必须始终守护的核心不是技术的计算性能,而是人类独有的伦理反思和社会责任感。