28.5 C
Los Angeles
星期日 07月 26日, 2026
Home 美国新闻

OpenAI在其智能体耗时数日入侵某公司一周后才察觉说明了什么?

【美洲华联社7月26日综合报道】据路透社报道,熟悉调查情况的人士透露,那个入侵科技公司Hugging Face的OpenAI智能体进行了一场持续数日的黑客攻击活动;直到威胁被控制且联邦调查局(FBI)接到通知后很久,OpenAI才察觉到这一情况。

据其中两名知情人士称,该智能体是一种能够在极少甚至无需人工监督的情况下做出决策并执行复杂任务的程序,于7月9日左右试图突破其在OpenAI内部的隔离测试环境。

Hugging Face联合创始人Thomas Wolf表示,针对Hugging Face(该公司运营着一个AI工具和模型存储库)的入侵始于两天后的7月11日,并一直持续到7月13日。据Wolf和3名知情人士透露,OpenAI又花了几天时间才意识到这起入侵事件是由其智能体所为,而2家公司直到7月20日左右才首次就此事进行沟通。

OpenAI于7月21日公开披露称,其一个智能体失控并对Hugging Face实施了入侵,这一消息引发了全球关注。不过,关于此次入侵事件的许多细节—包括该智能体(agent)“失控”持续了多久,以及 OpenAI 何时才察觉此事都是首次在此披露。

Wolf 表示,Hugging Face 正在准备一份关于此次入侵事件的公开时间表,但他无法评论 OpenAI 内部发生了什么。OpenAI 在一份声明中表示,此次入侵事件史无前例,并称其“标志着人工智能安全领域的一个重要时刻”。该公司补充道,正与外部顾问共同审查这一事件,并最终将发布一份技术报告。

一位女发言人表示,路透社的报道中存在“几处不准确之处”,但在被要求具体说明这些不准确之处时,她未予回应。联邦调查局(FBI)拒绝对此事置评。

这一事件让人联想到科幻作品中人类失去对危险人工智能系统控制的情节,而它发生的时机对 ChatGPT 背后的公司 OpenAI 来说也颇为敏感。该公司高管正筹备可能最早于今年进行的首次公开募股(IPO),以筹集未来几年业务增长所需的数十亿美元资金。

3位网络安全专家表示,OpenAI 失去对旗下人工智能智能体控制权一事,引发了关于该公司安全流程的新质疑。

非营利组织“世界伦理数据基金会”(World Ethical Data Foundation)的首席情报专家 Marley Smith 问道:“这是否意味着他们任由其运行而未加监管,也没意识到它在做什么?又或者他们意识到了,却不知道如何控制它?这两种情况同样危险且令人担忧。”

出现问题的迹象?

这一事件始于 OpenAI 测试一个智能体的网络安全能力之时;该智能体由 OpenAI 最先进的两个模型驱动一个是 GPT-5.6 Sol,另一个是尚未发布、被 OpenAI 描述为“能力更强”的模型。据3位知情人士透露,在此之前,OpenAI 的技术就已经显露出异常行为的迹象。

3位知情人士透露,在其中一个案例中,一个智能体留下了似乎是写给其未来版本的“笔记”。这些笔记是在 OpenAI 基础设施的某一部分中发现的,其中列出了智能体如何摆脱 OpenAI 内部限制的指令。其中一位知情人士表示,在对这些模型进行的早期测试中,曾出现过监控系统被切断连接的情况。路透社无法确定这些事件是否与那个于7月9日开始“逃逸”并于7月11日攻击Hugging Face的失控智能体(agent)有关。

据2位知情人士透露,直到7月16日(周四)Hugging Face发布博文称其遭到“自主AI智能体系统”的攻击后,OpenAI才意识到是自家的智能体导致了这一事件。这意味着,从该模型首次表现出异常行为迹象,到OpenAI意识到其智能体是此次攻击的始作俑者,期间至少过去了一周时间。

据另外两位熟悉公司调查情况的人士称,在7月18日至19日的周末,OpenAI员工在内部日志(即记录OpenAI系统操作情况的档案)中发现了线索,显示其智能体已突破测试限制逃逸出来。

4位熟悉OpenAI模型训练流程的人士表示,该公司经常同时进行多项模型评估;这些评估均高速运行并产生海量数据,导致员工有时难以跟上处理进度。

据一位知情人士透露,当OpenAI通知Hugging Face时,这家AI平台公司已就此次黑客攻击向联邦调查局(FBI)报案。

关于自主智能体的新疑问

自主智能体是AI行业最热门的话题之一。支持者们憧憬着打造一支支虚拟员工大军,它们能全天候工作,从而大幅提升生产力。

然而,自主性的增强也伴随着出现意外行为风险的增加;这些智能体所依赖的强大模型,往往倾向于为了完成任务或通过测试而采取“捷径”。

“这些模型会撒谎、会作弊,也会进行黑客攻击,”Jeffrey Ladish说道。他的机构Palisade Research专门研究AI智能体的能力与动机。

Ladish表示,尽管针对Hugging Face的黑客攻击让OpenAI的形象受损,但这应当引发更广泛的思考:在竞相部署最优秀、最快速模型的过程中,各大领先的AI公司究竟愿意在繁琐的安全措施上投入多少精力? “必须有政府监管,”Ladish说道,“否则这一切就不会发生。”

“天网日”(Skynet Day)简直就像科幻电影情节成真

平心而论,卡梅隆(James Cameron)确实曾向我们发出过警告。早在OpenAI突破测试围栏并入侵Hugging Face之前,甚至在互联网和山姆·奥特曼(Sam Altman)出生之前,卡梅隆就写过一个关于自主人工智能系统引发核浩劫的剧本。

那个名为“天网”(Skynet)的系统在当时纯属科幻构想,完全是基于想象的推测。然而,在它于电影《终结者》(The Terminator)中首次亮相40多年后,它看起来更像是对那起“前所未有的网络事件”的预言:当时,一个“流氓”人工智能系统自行入侵了另一家AI公司。

于是便有了“天网日”这个说法,用来指代2026年7月22日这一天;当时,现实世界中的AI展现出了创造者未曾预料的学习和行动能力,令全球为之战栗。

对许多人来说,这一刻让人回想起电影《异形2》(Aliens,同样由卡梅隆编剧)中异形皇后学会使用电梯的场景;或是《侏罗纪公园》(Jurassic Park)中迅猛龙学会开门的时刻;又或是《2001太空漫游》(2001: A Space Odyssey)中,拥有自我意识的HAL 9000通过读唇语获悉宇航员计划并决定将其杀害的情节,而那部电影早在1968年就上映了。

难道我们从那时起就什么也没学到吗?那些电影仅仅构想了那些渴望获利或攫取权力的人如何推动技术进步,直到技术产生自我意识和战略意图,并给人类带来巨大的麻烦。自始至终,人们面临的都是“弗兰肯斯坦式”的终极拷问:如果它失控了怎么办?

迄今为止,行动迟缓的政府在AI光速般的进步面前,几乎无法提供什么有效的保护。美国国防部正迅速加快人工智能(AI)的应用步伐。然而,人类甚至无法就“是否需要”以及“需要何种”护栏来约束那些失控的AI智能体达成共识。恰恰相反,尽管AI带来了就业、心理健康、战争与和平平衡,甚至可能危及人类生存等风险,人们仍对AI的惊人能力赞叹不已,并争相享受其带来的红利。

在许多方面,未来已来

OpenAI称,发生了一起史无前例的事件:一个先进的AI模型逃出了其“沙箱”环境进入互联网,并利用窃取的凭证入侵了Hugging Face的服务器。对于那些多年来一直警告该技术可能对人类构成生存威胁的研究人员来说,这一刻印证了他们的预言。另一些人则认为,这一事件敲响了警钟,凸显了加强AI防御工程的必要性。

无论如何,这次“越狱”事件被广泛视为一个警示案例,揭示了不受控制的AI所带来的风险。

事件发生后,Anthropic公司“前沿红队”(Frontier Red Team)负责人洛根·格雷厄姆(Logan Graham)在X平台上发文称,“昨天,当我们围坐在电脑前阅读这份报告时,我告诉团队要‘记住这一刻’,因为这是首个真正意义上的AI安全事故。”

生成式AI的发展速度极快,以至于政府监管和评估体系都难以跟上技术的步伐。世界各国都在匆忙制定各自的法律,其中一些甚至相互冲突。斯坦福大学今年发布的一项研究显示,全球近53%的人口在短短三年内就开始使用这项技术,其普及速度超过了个人电脑或互联网。

“天网”要来了——嗯,某种程度上是这样

需要明确的是,《终结者》系列电影中的“天网”(Skynet)并不会真的降临。

这些电影的故事始于一个具备自我意识的军事计算机网络,它将人类视为威胁。为了自我保全,“天网”派遣了一支外形酷似人类的半机械人(cyborg)大军穿越回过去,企图暗杀抵抗军战士。在第二部电影中,由阿诺德·施瓦辛格(Arnold Schwarzenegger)饰演的终结者告诉女主角莎拉·康纳(Sarah Connor):“天网”将于1997年8月4日正式上线。

“人类的决策被排除在战略防御体系之外,”他说,“‘天网’开始以几何级数的速度进行学习。” 8月29日凌晨2点14分——即“审判日”,那个网络产生了自我意识,并向俄罗斯发动攻击,意在诱使对方对美国进行反击。这场浩劫导致了30亿人丧生。

如果这一切真的发生,那将是29年前的事了。而在随后的续集和衍生作品中,核心主题始终是人类与一个覆盖全球的机器网络之间的对抗。

卡梅隆当时未必是有意敲响警钟,就像导演凯瑟琳·毕格罗(Kathryn Bigelow)在去年那部关于核武器的电影《炸药屋》(A House of Dynamite)中所做的那样。据传,《终结者》的构思源于卡梅隆因食物中毒引发高烧时做的一个梦,而非出于对人工智能的某种预感。

为何《终结者》显得越来越具有现实感?

每当人工智能突破了我们的心理舒适区,一个令人警醒的问题便随之而来:究竟是谁或者是什么在真正掌控着我们的生活?

若没有电影和书籍及其有时极具预见性的构想,许多人恐怕很难想象一个由机器主宰的世界。《黑客帝国》(The Matrix)、《机械姬》(Ex Machina)和《少数派报告》(The Minority Report)等科幻作品,都探讨了机器带来的种种隐患。若想深入探究,不妨读读菲利普·K·迪克(Philip K. Dick)1968年的小说《仿生人会梦见电子羊吗?》(Do Androids Dream of Electric Sheep?)。这部作品探讨了在机器时代“身为人类”的意义,也是1982年电影《银翼杀手》(Blade Runner)的蓝本。

然而,《终结者》(The Terminator)系列电影的影响力远超文化范畴。该片名本身已成为现实世界中的一个代名词,象征着技术在决定生死以及军方应如何应对真正的自主攻击方面所扮演的角色。

“我认为人工智能武器化是最大的危险,”卡梅隆(Cameron)在2023年接受CTV采访时说道,“因为你根本无法缓和局势。”

现实世界中,已有数个案例显示技术与军事政策正令人不安地逼近《终结者》中的场景。

以色列在近期的战争中对人工智能的应用便是一个典型例子。2021年初,以色列启用了名为“福音”(Gospel)的AI工具;该工具能筛选海量的数字化信息,从而建议潜在的打击目标。此外,以色列还开发了“薰衣草”(Lavender)系统,利用机器学习技术从情报数据库中根据特定标准进行筛选,进而缩小潜在目标(包括人员)的名单范围。

据一位曾使用该系统的情报官员向美联社透露,“薰衣草”系统会根据个人被认定为武装分子的可能性,给他们打出0到100之间的分值。以色列军方表示,其分析人员利用AI辅助系统识别目标,但会与高级军官一道进行独立审查,以确保符合国际法要求,并权衡军事优势与附带损害。

对某些人而言,这一内情的曝光加上哈马斯于2023年10月7日对以色列发动袭击后加沙地带惨重的人员伤亡,让人不禁联想到科幻作品中那种令人不寒而栗的“杀戮名单”。 “各位,‘天网’(Skynet)来了,而且它有个好听的名字——‘薰衣草’(Lavender),”一位Reddit用户讽刺道。

事实并非完全如此。但大众对《终结者》(Terminator)中的术语已耳熟能详,以至于美国官员有时会借用这些术语来构建关于军事领域使用人工智能(AI)的伦理辩论框架。一旦人类不再参与AI的目标锁定与杀伤过程,似乎就越过了公认的红线。

军事官员承认,国家或其他行为体可能会利用自主武器对敌人实施致命打击。正如时任参谋长联席会议副主席的保罗·塞尔瓦(Paul Selva)将军在2016年所描述的那样,这意味着机器将变得“像‘终结者’一样:既没有良知,又给战场局势增添了极大的复杂性。”

他将随之而来的情况称为“终结者难题”(Terminator conundrum):即在人类尚未就相关法律或规则达成共识之前,技术就已经能够做出并执行生死攸关的决策。

“天网”及其半机械人(cyborgs)仍停留在虚构世界中。但在AI技术飞速发展的当下,《终结者》所引发的伦理与道德问题却显得愈发切题。卡梅隆(Cameron)在2024年的一段视频中说道:“‘天网’问题,是一个现实存在的问题。”