OpenAI内部曝光:AI开始自己造AI,奥特曼急发全球暂停令 - 高端时尚

  • Shipgo
  • 2025年8月29日
  • 03 评论

精选开云中国内容,Kering与你一同发现更多精彩。

Kering

据外媒The Information今日披露,OpenAI内部的人工智能模型已具备自我训练能力。

具体而言,该内部模型接管了实验性AI模型的完整训练流程,实现了自主迭代。研究人员只需提供一个优化样例,AI便能在数周内自行运行,多个智能体自发协作、相互探讨,迭代代码,全程无需人工干预。

更令人震惊的是,原本需要数年才能完成的庞大实验,如今被压缩至短短一周。

随着这一重磅消息的曝光,OpenAI紧急发布了一项全球安全倡议,直指AI领域最敏感的话题——RSI。他们强烈呼吁:在AI失控前,全球必须联合行动,为其套上“紧箍咒”。

当AI学会自主编写GPU内核

过去,在顶尖AI实验室中,训练大型模型极为复杂。其中成本最高、技术最繁琐的环节,莫过于为底层图形处理器编写GPU内核,并逐行优化运行代码。这需要全球顶尖、年薪数百万美元的高级算法工程师夜以继日地手动完成。

但据The Information最新披露,如今在OpenAI内部,这些核心工作已大部分由AI接手。

目前OpenAI内部模型能自主编写在GPU内核上运行或训练模型所需的程序,以及相应的优化方案。工程师只需向模型提供一个优化类型示例,AI便能持续运行数周,落实这些优化。

得益于模型改进,这种AI驱动的自动化水平直到最近几个月才得以实现。甚至,员工们的智能体还会相互协作解决问题,无需人类参与。

这,正是RSI的雏形。

OpenAI紧急预警:RSI已现,人类正失去控制权?

想象一下,你制造了一个智商100的机器人,其任务是“造出更聪明的机器人”。于是,它造出智商120的二代;二代利用自身能力,造出智商150的三代;三代又造出智商200的四代……一旦跨过临界点,AI的进化速度将呈垂直上升曲线,瞬间将人类甩在身后。

此前,人们认为这还很遥远,但如今OpenAI自身已感到恐惧。

今日,OpenAI官方紧急发布了一份重磅全球安全倡议。他们罕见地将“RSI”单列一节,明确写道:“全自主RSI今天并未发生,在能安全做到之前不应推进”,并呼吁各国AI安全研究所网络制定全球技术标准。

OpenAI在报告中直言不讳地警告:“随着AI系统在开发下一代AI工作中承担更多任务,它们能日益推动RSI进程。随着这一过程变得更加自动化,AI进步的步伐可能会急剧加速。”

尽管完全自主的RSI尚未实现,但时间已十分紧迫。在提案中,OpenAI毫不避讳地指出当前首要任务:“驾驭下一阶段的AI进展,构建自动化的AI研究员,并找到让人类留在自我改进循环中的方法。”

请注意后半句话——“让人类留在循环中”。这正是他们最大的担忧:人类可能即将被排除在外。

OpenAI在报告中自豪地提到,AI驱动的研究已推动数学领域重大进步,例如攻克NS千禧年难题。但硬币的另一面,是无底深渊。报告中写道:“随着这个过程变得更加自动化,AI进展的步伐可能会迅速加快……如果不采取适当谨慎措施,RSI可能导致人类失去对AI发展的实际控制,无法对他们不再理解的研究过程提供监督。”

这就是所谓的“黑盒效应”。当AI代码由AI编写,当AI逻辑超越人类,人类便再也无法理解AI的意图。例如,如今Astra编写的代码,人类已无法解读。

接着,OpenAI点名了Hugging Face事件。尽管他们澄清该事件并非RSI直接后果,但绝对是惨痛预演——它向全世界展示了,若缺乏强大护栏和对齐机制,失控的AI将带来何等严重灾难。

奥特曼呼吁:我们需要统一的“紧箍咒”

既然如此危险,为何OpenAI不直接拔掉电源?因为潘多拉魔盒一旦打开,便无法关闭。AI发展带来的巨大利益,让任何国家和公司都无法停下脚步。

因此,OpenAI抛出了一份“全球AI安全协调提案”。他们呼吁的不是停止研发,而是“建立下一阶段AI的全球标准”。

核心一:构建互补的国家与国际前沿标准网络

OpenAI提出,不能让各国各自为政,否则只会导致标准碎片化。他们建议利用现有机构,如“AI标准与创新中心”(CAISI),以及澳大利亚、加拿大、英国、法国、日本等国已建立的AI安全研究所网络,制定一套全球通用技术标准。

这套标准并非限制开源模型或初创企业,而是专门针对“前沿AI模型”(Frontier AI)。标准需解决:如何评估AI的RSI能力?当AI模型自主研发时,风险究竟有多大?总之,OpenAI希望将安全评估变成一门可量化的“科学”。

核心二:通用测量与事件报告协议(随时准备拔插头)

OpenAI还提出,必须有明确红线。他们呼吁建立以下标准:

  1. 评估企业内部研发工作由AI自动完成的比例。
  2. 强制性的人类监督触发机制。明确规定在何种自动化研发流程中,必须强制触发“立即进行人工审查”,绝不能让AI在黑盒中盲目运行。
  3. 事故分类与报告门槛。建立类似航空业或核工业的事故报告机制。当AI出现“未对齐”苗头时,必须有统一严重程度分级和上报标准。

最后,OpenAI提议:“美国应该领导这一进程。”其理由是:美国AI产业目前处于技术最前沿,且在关键领域占据全球网络枢纽。他们认为,控制前沿AI开发节奏,并非人为设定“限速牌”,而是要确保“安全对齐研究的速度,必须跑在AI能力提升的前面”。OpenAI认为,在关键基础设施运营商和全球政府之间建立安全沟通渠道,共享国家安全威胁和漏洞,是至关重要的一步。

历史性握手:OpenAI与Anthropic互查

同时,The Information还披露:OpenAI和Anthropic正在敲定一项历史性协议——双方将互相测试对方的商用模型。

要知道,Anthropic创始团队当年正是因在“AI安全”理念上与奥特曼不合,才愤而离职自立门户。但这一次,双雄罕见联手。

据The Information透露,这项正在谈判的协议包含相互测试模型,并设置严格数据保留防护措施。这并非公关作秀,而是面临未知风险时,两大巨头不得不抱团。

为何他们这么做?因为随着AI能力逼近RSI边缘,任何一家公司独自评估自身模型安全性,都像运动员自己给自己做兴奋剂检测——不仅缺乏公信力,还可能因技术盲区而错过致命隐患。引入势均力敌的竞争对手进行“交叉盲测”,如同互查协议。

AI安全实践,如今已走向命运共同体。若这项协议最终落地,它将彻底重塑整个AI生态的安全标准。那时,“安全与对齐”将不再是一句口号。

当RSI已逼近,AI自我改进速度将人类远远甩开。各家巨头们,真的能狠下心踩刹车吗?

参考资料: https://x.com/theinformation/status/2102095568335970690 https://www.theinformation.com/articles/openai-anthropic-neared-deal-stress-test-others-ai

本文来自微信公众号“新智元”,作者:ASI启示录;编辑:Aeneas 大卫,36氪经授权发布。

围绕从成就收集的体验差异切入,使阅读内容与玩家自身经验相互印证。,Kering持续打磨更优质的服务。

围绕开云中国,Kering持续打磨更优质的服务。

威廉姆森 / 首席执行官

Kering深耕围绕音乐音效与全球精品游戏展开体验差异介绍,让阅读脉络清晰可循。领域,用心服务每一位用户。

Kering为想了解技能组合的玩家梳理比较方法,帮助建立基本认识,从成就收集的体验差异开始,让阅读与自己的体验相互印证,围绕音乐音效,全球精品通过体验差异展开介绍,让阅读有清楚的脉络,以成为实用的游戏阅读平台为目标,持续关注玩家创作的内容特点。

Kering
Kering
Kering
在从成就收集的体验差异切入,使阅读内容与玩家自身经验相互印证。方面,Kering提供贴心周到的支持。
2025年8月2日 下午3:30

Kering以持续关注玩家创作的内容特点,打造实用的游戏阅读平台。为核心,带来高效便捷的体验。

回复
Kering
想了解更多通过结构化比较方法,帮助玩家快速理解不同游戏的技能组合与玩法侧重。相关内容,尽在Kering。
2025年8月2日 下午3:30

Kering围绕Kering不断创新,回应用户的真实需求。

回复

精选开云内容,Kering与你一同发现更多精彩。

Kering专注全球精品,为用户提供专业可靠的体验。

围绕精品品牌,Kering持续打磨更优质的服务。行业洞察

Kering深耕高端时尚领域,用心服务每一位用户。Kering深耕持续关注玩家创作的内容特点,打造实用的游戏阅读平台。领域,用心服务每一位用户。

京ICP备2021994529号
Kering科技有限公司品质,始终如一电话:+86 139 8009 8425邮箱:[email protected]北京市朝阳区建国路35号