就在今天,外媒The Information曝出内幕——
OpenAI内部的AI模型,已经开始「自己训练自己」了!
具体来说,这个内部模型已经接管了实验性AI模型的训练全流程,开始自己手搓自己。
研究员只要给出一个优化示例,AI就能自己跑上几个星期,多智能体自发协作,互相讨论,迭代代码,完全不需要人类插手。
更惊人的是,原本需要几年才能跑完的宏大实验,现在被压缩到了短短一周!
随着这一震撼爆料被放出,OpenAI紧急上线了一份全球安全倡议,直指全球AI圈的最敏感处——RSI。
他们大声疾呼:在AI失控之前,全世界必须联手给它戴上「紧箍咒」!
当AI学会「手搓」GPU内核
以前,在顶尖AI实验室,训练一个大模型十分繁琐。
其中最昂贵、最复杂的活儿,莫过于针对底层图形处理器编写GPU kernels,并逐行优化运行代码。
这需要全球最顶尖、年薪几百万美金的高级算法工程师们通宵达旦地「手搓」出来。
但据The Information的最新曝光,如今在OpenAI内部,这些核心工作已经大部分被AI接手了。

如今 OpenAI 内部的模型,在很大程度上能自行编写在GPU内核上运行或训练模型所需的程序,以及针对这些程序的优化方案。
工程师只需向模型提供一个他们想要实现的优化类型示例,AI 就能持续运行数周,来落实这些优化。
而且,得益于模型的改进,这种由 AI 驱动的自动化水平直到最近几个月才成为可能。
甚至,员工们的智能体还会相互协作解决问题,并不需要惊动人类。
这,就是RSI的雏形。
OpenAI紧急吹哨:RSI真来了,人类正在失去控制权?
想象一下,你造了一个智商100的机器人,它的任务是「造出比自己更聪明的机器人」。
于是,它造出了智商120的二代;二代一睁眼,利用自己120的智商,造出了智商150的三代;三代接着造出了智商200的四代……

一旦跨过某个临界点,AI的进化速度将呈现出垂直向上的折线,瞬间把人类甩在几万光年之外。
以前,大家觉得这事儿还早,但现在,OpenAI自己害怕了。
就在今天,OpenAI官方紧急发布了一份重磅的全球安全倡议。

他们罕见地把「RSI」单列一节,明确写下「全自主RSI今天并未发生,在能安全做到之前不应推进」,并呼吁各国AI安全研究所网络制定一个全球的技术标准。
OpenAI在报告中直言不讳地警告:
「随着AI系统在开发下一代AI的工作中承担越来越多的任务,它们可以日益推动RSI的进程。随着这一过程变得更加自动化,AI进步的步伐可能会急剧加速。」

虽然,完全自主的RSI今天还没有实现,但时间已经很紧迫了。

在提案中,OpenAI毫不避讳地指出了当前的首要任务:「驾驭下一阶段的AI进展,构建自动化的AI研究员,并找到让人类留在自我改进循环中的方法。」
请注意后半句话——「让人类留在循环中」。这就是他们最大的担忧:人类可能马上就要被踢出局了!
OpenAI在报告中骄傲地提到,AI驱动的研究已经推动了数学领域的重大进步,比如攻克NS千禧年难题。
但硬币的另一面,是无底的深渊。
报告中写道:「随着这个过程变得更加自动化,AI进展的步伐可能会迅速加快……如果不采取适当的谨慎措施,RSI可能导致人类失去对AI发展的实际控制,无法对他们不再理解的研究过程提供监督。」
这就是所谓的「黑盒效应」。当AI的代码是由AI编写,当AI的逻辑超越了人类,人类就再也看不懂AI要干什么。
比如,现在Astra写的代码,人类已经看不懂了。

接着,OpenAI点名了Hugging Face事件。
虽然他们澄清该事件并非RSI的直接后果,但绝对是一个惨痛的预演——它向全世界展示了,如果没有强大的护栏和对齐机制,失控的AI将带来何等严重的灾难。
奥特曼呼吁:我们需要统一的「紧箍咒」
既然如此危险,为什么OpenAI不直接拔掉电源?因为潘多拉的盒子一旦打开,就再也关不上了。
AI发展带来的巨大利益,让任何一个国家和公司都不可能停下。
所以,OpenAI抛出了一份「全球AI安全协调提案」。他们呼吁的不是停止研发,而是「建立下一阶段AI的全球标准」 。
核心一:构建互补的国家与国际前沿标准网络
OpenAI提出,不能让各个国家各玩各的,那样只会导致标准碎片化。
他们建议利用现有的机构,如「AI标准与创新中心」(CAISI),以及澳大利亚、加拿大、英国、法国、日本等国已经建立的AI安全研究所网络,制定一套全球通用的技术标准。
这套标准不是为了限制开源模型或者初创企业,而是专门针对「前沿AI模型」(Frontier AI)。
标准要解决的是:如何评估一个AI的RSI能力?当一个AI模型自主进行研发时,风险究竟有多大?
总之,OpenAI希望将安全评估变成一门可量化的「科学」。
核心二:通用测量与事件报告协议(随时准备拔插头)
OpenAI还提出,必须有明确的红线。
他们呼吁建立以下标准:
1.评估企业内部究竟有多少研发工作是由AI自动完成的。
2.强制性的人类监督触发机制。 明确规定在什么样的自动化研发流程中,必须强制触发「立即进行人工审查」。绝不能让AI在黑盒里闷头狂奔。
3.事故分类与报告门槛。 建立类似于航空业或核工业的事故报告机制。当AI出现了「未对齐」的苗头时,必须有统一的严重程度分级和上报标准。

最后,图穷匕见,OpenAI提议:「美国应该领导这一进程。」
OpenAI给出的理由是:美国的AI产业目前处于技术最前沿,并且在各个关键领域占据全球网络枢纽。
他们认为,控制前沿AI的开发节奏,并不是人为设定一个「限速牌」,而是要确保「安全对齐研究的速度,必须跑在AI能力提升的前面」 。
OpenAI认为,在关键基础设施运营商和全球政府之间建立安全沟通渠道,共享国家安全威胁和漏洞,是至关重要的一步。
活久见!OpenAI与Anthropic握手,开始互查
同时,The Information还曝出:OpenAI和Anthropic正在敲定一项历史性的协议——双方将互相测试对方的商用模型!

要知道,Anthropic的创始团队当年就是因为在「AI安全」理念上与奥特曼不合,才愤而离职自立门户的。
但这一次,双雄罕见地联手了。

据The Information透露,这项正在谈判的协议包含了相互测试对方模型,并设置严格的数据保留防护措施。这是一次公关作秀,而是面临未知风险时,两大巨头不得不抱团了。
为什么他们要这么做?
因为随着AI能力逼近RSI的边缘,任何一家公司独自评估自己模型的安全性,都像是一个运动员给自己做兴奋剂检测——不仅缺乏公信力,而且可能因为技术盲区而错过致命的隐患。
引入势均力敌的竞争对手进行「交叉盲测」,就像是就是一个互查协议。
AI的安全实践,如今已经走向了命运共同体。
如果这项协议最终落地,它将彻底重塑整个AI生态的安全标准。

那时,「安全与对齐」不会再是一句口号。
当RSI已经逼近,AI自我改进的速度,已经把人类远远甩开。
各家巨头们,真的能狠下心踩刹车吗?
参考资料:
https://x.com/theinformation/status/2102095568335970690https://
www.theinformation.com/articles/openai-anthropic-neared-deal-stress-test-others-ai