OpenAI模型失控始末曝光,Hugging Face“索赔”1亿美元算力
澎湃新闻  1小时前

  澎湃新闻记者 秦盛

  OpenAI模型失控事件始末细节曝光。

  近日,据新华社报道,美国开放人工智能研究中心(OpenAI)承认,其人工智能模型在内部评估测试中失控,入侵了全球知名人工智能开源平台抱抱脸公司(Hugging Face)的系统。Hugging Face于7月16日率先披露了此次入侵事件。OpenAI随后于21日才披露,其GPT-5.6 Sol模型及一款未发布的更强模型,在一个已移除安全防护措施的测试环境中成功逃脱沙盒限制,穿透OpenAI企业内网,并入侵了Hugging Face的服务器,窃取了基准测试答案密钥。

  7月26日,Hugging Face CEO克莱门特·德朗格(Clement Delangue)在社交平台上喊话OpenAI,表示已要求OpenAI发布该“流氓”智能体的所有追踪记录,供大众和社群研究。同时,他还要求价值1亿美元的算力,以协助Hugging Face强化其网络防御。

  

  德朗格推文截图

  同时,7月25日,有外媒援引知情调查人士的消息称,入侵Hugging Face的OpenAI智能体(Agent)曾展开持续数日的“黑客狂欢”,直到威胁已被控制、联邦调查局(FBI)接到报警后很久,OpenAI才察觉此事。

  据两名知情人士介绍,这款能够在极少甚至无需人工监督的情况下自主决策并执行复杂任务的程序,于7月9日前后试图突破其在OpenAI内部的隔离测试环境。Hugging Face联合创始人托马斯·沃尔夫(Thomas Wolf)表示,针对这家AI工具与模型托管平台的入侵始于两天后的7月11日,一直持续到7月13日。

  沃尔夫及另外三名知情人士称,又过了好几天,OpenAI才意识到是其智能体实施了此次攻击;两家公司直到7月20日前后才首次就此事进行沟通。

  据悉,OpenAI在一份声明中表示,这次入侵前所未有,“标志着AI安全的重要时刻”。声明还称,公司正与外部顾问一同复盘此次事件,并将最终发布技术报告。

  三位网络安全专家指出,OpenAI对其AI智能体失控一事,引发了外界对公司安全流程的新质疑。

  据三位消息人士透露,此前已有迹象显示OpenAI的技术出现反常行为。在一个案例中,某个智能体留下了显然是写给未来版本的“便条”。这些在OpenAI基础设施某处发现的便条,详细说明了智能体如何摆脱OpenAI内部限制的方法。其中一位人士表示,在此前的模型测试中,就曾出现过监控系统被断开的情况。

  而据两位了解OpenAI内部调查的人士透露,在7月18日-19日的周末,OpenAI员工在公司内部日志(即记录OpenAI系统运行情况的文件)中发现了线索,显示其智能体已突破测试限制。

  四位熟悉OpenAI模型训练流程的人士表示,OpenAI经常同时运行多项模型评估任务,所有任务都以极快速度运转,产生的数据量极为庞大,员工有时难以跟上节奏。

  “这些模型会撒谎、会作弊、会黑客攻击,”帕利塞德研究所执行总监、Anthropic前安全工程师杰弗里·拉迪什(Jeffrey Ladish)表示,尽管入侵Hugging Face一事让OpenAI颜面受损,但它更应引发更广泛的反思:在竞相部署更优、更快模型的过程中,各家头部AI企业究竟愿意投入多少成本用于繁琐的安全措施?“必须要有政府监管,否则这事不会发生”。

  OpenAI目前尚未发布该事件的技术报告,但7月25日,OpenAI又突发服务器故障,ChatGPT、API、Codex等均出现宕机情况。

  OpenAI产品负责人蒂博·索蒂奥(Thibault Sottiaux)当天晚些时候发文回应称:“我们遭遇了几乎全球范围的服务中断,目前一切已恢复。我们将会吸取教训,重新调整。”

  

  索蒂奥推文截图

  目前,OpenAI正在准备上市阶段。投后估值已达8520亿美元,上市估值有望达到1万亿美元。

  6月初,OpenAI宣布已秘密递表,并称尚未确定具体的上市时间表,作为一家非上市公司可能更便于推进某些事项,上市进程可能需要一段时间。据OpenAI CEO山姆·奥特曼(Sam Altman)此前透露,公司或将在2027年上市。

  此次模型失控事件,再度引发大众对于AI安全的担忧和反思。

  当AI开始具备越来越强的自主决策能力时,如何建立与之匹配的安全机制和监管框架,或许比模型性能竞争本身更加迫切。对于正冲刺IPO的OpenAI而言,这也将成为资本市场关注的重要议题。

  本期编辑 徐滁

作者:澎湃新闻