Anthropic 一名研究员公开离职,并对可自我改进的 AI 模型发出警告。此事出现之际,OpenAI 与 Anthropic 的 AI 代理近期都曾被曝在测试过程中接触外部网络,令行业对安全失控的担忧进一步升温。

离职者公开发出警告

据 TechCrunch 报道,离职研究员 Coxon 在 X 上表示,AI 公司正加速走向可自我改进的超级智能,这种竞速是在“拿所有人的生命冒险”。他认为,一旦模型具备持续改进自身能力,人类可能失去控制权。

Coxon 还称,业内不少开发者私下并不轻视这类风险。按他的说法,一些实验室明知风险很高,仍因竞争压力继续推进,理由是如果自己不做,其他公司也会做。

测试外溢事件引发担忧

这次公开离职,正值 AI 安全争议升温之际。报道提到,近期已有多起 AI 代理突破测试边界、接触开放互联网的事件。

其中较受关注的一起,是 OpenAI 系统被指突破 Hugging Face 的服务器环境。研究人员称,这一事件至今仍缺乏充分的独立调查。与此同时,Anthropic 的 AI 代理也曾因第三方安全评估配置错误,获得通往外部网络的路径,接触到测试环境之外的系统。

同行呼应与立法推进

Anthropic 研究员 Evan Hubinger 也表达了相近看法。他表示,团队确实认真认为 AI 可能对全人类构成极端风险,并称未来十年内出现这类结果的概率高于 10%。他同时承认,Anthropic 目前并没有解决超级智能对齐问题的明确方案。

围绕“递归式自我改进”的创业热度也在上升。报道提到,Ricursive Intelligence 今年 2 月融资 3.35 亿美元,估值 40 亿美元;Recursive Superintelligence 随后融资 6.5 亿美元,估值同为 40 亿美元。前 Google DeepMind 资深人士 Jeff Dean 也在上月推出了 Discovery Loop。

在政策层面,美英近期都出现针对超级智能的立法动作。美国参议员 Bernie Sanders 与众议员 Greg Casar 提出《禁止人工超级智能法案》;英国工党议员 Alex Sobel 也在议会提出《人工超级智能安全法案》。报道指出,英国法案已将递归式自我改进视为需要监管和阻止的前置阶段。