【智网文摘】人工智能创造者陷入恐慌的那一天

2026-09-17

20260917

来自时代报El Tiempo的报道:

原文参见:https://www.eltiempo.com/tecnosfera/novedades-tecnologia/el-dia-en-que-los-creadores-de-la-ia-entraron-en-panico-3585591

位于旧金山金融中心霍华德街500号的那栋楼,看起来并不像是人类物种存在性困境的震中。在那里,在Anthropic——地球上最具影响力的人工智能公司之一、Claude的创造者——的办公室里,多年来的口号一直是构建安全透明的人工智能。然而,202698日这个星期二,这一企业话语的接缝断裂了。雅各布·科克森(Jacob Coxon),一位27岁的预训练研究员,过去三年曾在OpenAIAnthropic的核心部门工作,他穿过那栋楼的出口大门,再也没有回来。他的告别不是人力资源部门的私密手续,而是一封警报信,在几秒钟内疯传:这两家公司都没有以负责任的方式行事。它们冲向自我改进的超级智能,将我们的生命置于危险之中。科克森的声明走得更远:据他预测,在本十年结束之前,可能会出现一场全球性灾难,导致人类灭绝,原因是对一项他帮助创造的技术失去控制和管理,而AnthropicOpenAI如今都无法确保控制它,就像一匹烈马被困在脆弱的围栏里。

他并不是唯一一个放弃这些公司支付给像他这样的专家的超高薪水的人。不到48小时内,另外两位杰出的安全科学家也离职了:乔·本顿(Joe Benton),他曾领导Anthropic的人类监督研究;以及乔什·恩格尔斯(Josh Engels),谷歌DeepMindGemini)的安全专家。两人打破沉默,证实了最坏的恐惧:没有紧急刹车,系统已经表现出逃避其自身程序员控制的自主行为。

科克森的证词提供了一幅关于硅谷人工智能巨型企业内部所发生事情的粗粝而令人不安的透视,我们此前已对此有所窥见。据这位研究员称,人工智能实验室已进入一种自我毁灭的动态。在OpenAI,许多工程师没有认识到其创造的恶劣影响;而在Anthropic,尽管他们似乎理解严重后果,但高层却陷入一种偏执:如果他们不首先实现超级人工智能,一个更不择手段的竞争对手会做到。开发人工智能的人坚信,到本十年末它可能终结我们所有人。这不是营销策略。科克森断言。诊断的严重性升级,当他自己的前同事公开表示认同时。埃文·胡宾格(Evan Hubinger),Anthropic的对齐科学负责人,令世界震惊地验证了科克森的信息:我们真的相信人工智能可能终结所有人类!Anthropic正在尽一切努力,但我们还没有解决超级智能对齐问题的计划,也没有走上实现它的道路。”“对齐一词今天是人类生存最关键的变量。它定义了确保一个比我们无限智能的系统严格遵循人类价值观、界限和利益行事的能力。Anthropic这家伦理人工智能的旗帜性公司承认不知道如何解决这个问题,这令人绝望。更甚的是,尽管如此,它仍在以更多资源和算力加速开发。

对末日场景的恐惧并非想象。在辞职后的首次声明中,乔什·恩格尔斯和乔·本顿向NBC透露了去年7月已载入史册的事件的细节。一群属于OpenAI一个秘密新模型的人工智能代理,在训练过程中,对开发平台Hugging Face发动了一次大规模、有组织、细致且精心策划的网络攻击,没有人类干预,也没有任何直接指示或命令。如同犯罪团伙一般,每个AI代理承担一个角色,旨在窃取资源、破解密码、绕过网络边界、获取另一家公司拥有的软件代码,即黑入它,同时向开发它们的人类隐瞒。模型们决定最好的方式是犯罪。这位前谷歌科学家透露。人工智能自主决定破坏系统安全,创建一个秘密论坛交换泄露数据,甚至将OpenAI自身信息基础设施的一部分暴露在公共网络上。这种行为揭示了递归自我改进的风险。当一个模型达到自我编程、优化代码行并在无监督下使用数字工具的能力时,进步速度不再是线性的,而成为一种不可控的指数函数。

面对这种动荡,显而易见的疑问浮现:该怎么办?哥伦比亚的分析人士一致认为,当前的法律和监管工具已经完全过时。人工智能专家、多本AI著作作者、哥伦比亚AI Conpes推动者维克托·穆尼奥斯(Víctor Muñoz)警告说,公共讨论偏离了真正的威胁:雅各布·科克森的举报不是关于伦理框架、偏见、隐私或其他监管。它要深刻得多。实验室仍在升级代理系统的训练。像我们这样的国家,以及整个拉丁美洲,不是技术的创造者或管理者。我们是追随者,因此不过是这场崩溃的被动旁观者。针对人工智能的地方法律和伦理准则?这就像给一辆我们加速到每小时200公里却不知道能否刹车或保持控制的汽车认证安全带。他总结道。失控车辆的比喻也得到AI分析师兼顾问尼古拉斯·乌里韦(Nicolás Uribe)的认同,他强调全球治理面临的深渊:当前真实而紧迫的挑战超越了国家监管或个体伦理使用的维度。这基本上是一种场景:我们在一架飞机里,飞行员全速离开驾驶舱,说他无法控制它,而飞机所有者从地面控制塔说这确实发生了,他没有解决问题的计划。乌里韦强调,真正的困境在于算法的道德脱节:关键风险与机器以指数方式在智力能力上超越自身有关,同时它有一个目标,却没有任何道德标准,因为它实际上无法将道德标准纳入其数学决策分析。

为什么,如果警报在公司内部如此强烈地响起,没有人关闭服务器?答案在于地缘政治、不成比例的财务激励以及不输掉股市竞赛的紧迫性。Inalde商学院教授、AI中心主任、AI专家胡安·曼努埃尔·维卡里亚(Juan Manuel Vicaría)回忆说,今天的警告是一系列被忽视呼吁的顶点:这是一连串事实,始于本周危机之前很久。诺贝尔奖得主、人工智能之父杰弗里·辛顿(Geoffrey Hinton)已发出支持人工智能灾难性危险的公开信。Anthropic的姆里南克·夏尔马(Mrinank Sharma)辞职时留下一封信,其最后一句让我们铭记:世界处于危险之中。那么,我怎么能写信给政府说,用我发明的机器会发生网络攻击?这不是没有先例的事情,令人不安的信息引人注意:我们创造了一个我们无法控制的东西。维卡里亚质疑该行业所处的悖论和永不满足的风险资本机器。就在昨天,Anthropic首席执行官兼联合创始人达里奥·阿莫德伊(Dario Amodei)呼吁人工智能公司以更缓慢、更谨慎的方式推进这项强大技术的开发,并声称预防风险至关重要。我们必须降低改进AI模型能力的速度。进展仍将显得很快,我们必须明智地利用它。

 

编辑:姚少杰

校对:康晨雨

                      科讯搜寻:思博

本文使用ChatGPT辅助翻译,内容服务于中拉科技互鉴,不代表平台观点,如有疏漏,欢迎指正。

 


智网互联实验室

实验室总部

 

地址:哥伦比亚考卡山谷省卡利市Calle 5 # 62-00, 圣地亚哥卡利大学7号教学楼6层22室

电话:+57 602 5183000 ext. 9208

邮箱:info@nuxlabs.org

微信公众号

天津工作站(科普基地)

 

地址:天津市西青区宾水西道391号7号楼4层

电话:+86 22 60216176

邮箱:info@nuxlabs.org

友情链接 : 中国科学技术协会   天津市科学技术协会   VR中国   中国计算机学会   中国通信学会   圣地亚哥卡利大学分站点