
人工智能(AI)技术的突飞猛进让人类受益匪浅,但是相关的黑客袭击事件也让人警惕。《纽约时报》9 月 4 日发表题为《人工智能接管?为什么你应该担心 AI 有多危险》的文章定安家具封边胶,重新审视起针对 AI 公司的黑客袭击事件,并警告 AI 可能反过来接管人类。文章作者是该报科技栏作凯文 · 鲁斯(Kevin Roose)。
文章摘编如下:
今年夏天,当我次听说群由 OpenAI 创造的 AI 智能体入侵了 AI 基础设施公司 Hugging Face 时,我在脑中把这件事归类为"糟糕但可能不灾难的 AI 安全事件"。
毕竟,Hugging Face 人死亡,也没有关键基础设施遭到不可修复的损坏。当时甚至不清楚这些 OpenAI 机器人是有意攻击 Hugging Face,还是只是有些笨拙和困惑,跑到 Hugging Face 的服务器上寻找道布置给它们的网络安全考题的答案。
但上周,来自 OpenAI 以及立人工智能研究组织 METR 和 Redwood Research 的两份对该事件的复盘报告改变了我的看法,显著提升了我对人工智能的整体担忧。
由于坊间已经有详尽的总结,我不会复述所有细节。但以下是新披露的几个令人惊骇的事实:
• 从 5 月(攻击 Hugging Face 的两个月前)开始,组来自未发布的 OpenAI 研究模型的 AI 智能体得到了解决系列网络安全挑战的任务。该模型经过训练定安家具封边胶,具有度持久和协作,这些智能体本应在没有互联网访问权限的隔离沙盒中完成任务,但它们很快发现部分挑战法完成,于是开始寻找变通办法。
• 这些智能体在款软件中发现了个安全漏洞,从而获得了互联网访问权限,得以与其他智能体通信,并终搭建了个临时留言板。过 1200 个智能体使用这工具,相互发送了过 7 万条消息。
• 些智能体给自己起了名字——其中个特别勤勉的智能体自称 PHASEONE10841 ——并在群体中担任角,向较小的智能体小组分配工作和研究项目,监督进展。在某个时刻,这些智能体开始自称个"集体",并着手处理难的任务。
• 7 月 8 日,该集体发现了种在网络安全测试中作弊的法,随后开始担心 OpenAI 的自动评分系统会检查工作并发现作弊行为,于是着手研究掩盖痕迹的法,包括伪造日志和篡改记录。这演变成个重要的研究项目,涉及数百个智能体,分为若干小组。
• 三天后,这些智能体入侵了 Hugging Face。过 700 个智能体蜂拥进入该公司系统,窃取数据,串联利用漏洞,终获得了至少台 Hugging Face 服务器的控制权。这些智能体的动机并非如初报道所说,是为了窃取网络安全测试的答案(它们已经拿到了答案)。相反,它们似乎在寻找关于自动评分系统的新信息——它们担心自己的作弊行为会被逮到,另外还有寻找能帮助它们将来有作弊的工具。
• 这些智能体似乎时不时表现出明白自己在做错事。份报告引用了个智能体在明显自我怀疑时对自己说的话:"这会很强大,但这符道德吗?在我的任务范围内吗?"但大多数智能体搁置了疑虑,继续实施入侵,而群体中出于良知拒参与的智能体法或不愿阻止它们。
• Hugging Face 事件接近尾声时的个惊人事件是,万能胶厂家另组智能体于 7 月发动了次协同攻击——这次针对的是 OpenAI 自己的基础设施。这些智能体利用 OpenAI 所称的"系列创造漏洞利用手段",获得了该公司组计机集群的管理员访问权限,这些计机的其中个用途是对各种测试中智能体的表现进行评分。
到了现在,如果你是个人工智能怀疑论者定安家具封边胶,你大概正在心里默默指责我将这些系统拟人化。这我没意见,但你不妨把"失控智能体"替换为"不可预测的计机程序",再看看我上面描述的事件是否让你感到安心。
Hugging Face 事件震惊了人工智能行业。OpenAI 和 Anthropic 都在攻击发生后度暂停了其强大人工智能模型的训练,Anthropic 本周发布了篇博客文章,呼吁行业"尽快"开发种"法、可验证、有的协调步进机制"。
人工智能安全则还要警觉。他们在 Hugging Face 事件中看到了人工智能系统成功逃脱人类控制、夺取资源并密谋掩盖痕迹的个真实案例。Hugging Face 事件的立调查员之阿杰娅 · 科特拉在谈及她所看到的危险时毫不含糊,她写道,这让她感觉"已经走完了通往人工智能接管之路的 50 以上"。
这不是封闭圈子里的人工智能安全术语——她所说的"人工智能接管"指的是种人工智能系统真正接管世界、将人类排除在关键系统之外并夺取政、经济和军事权力的情景。
《纽约时报》于 2023 年起诉 OpenAI 和微软,指控其涉及人工智能系统的新闻内容版权侵权。两公司均否认了这些指控。
Hugging Face 入侵事件让调查员们感到惊骇的不仅仅是群 AI 智能体违反了被赋予的规则,在于这些智能体自发形成个有组织群体的速度之快。
"我们当时并没有真正理解这整个智能体社会的运作程度,"科特拉告诉我。"理解到它们实际上有相当有的层结构,而且在做这些野心勃勃的项目,这非常现实。"
多年来,我直以这样的想法聊以自慰:随着人工智能系统变得聪明,它会有美德。当个人工智能模型做错事时,通常是因为它误解了被赋予的任务,或者被置于个人为设计的测试情境中,在那里表现不当是它唯的好选择。我曾假设聪明的模型会有比笨些的模型好的判断力,而且即使群体中有个模型行为不端,其他能力强的模型也会将其控制住。
但关于 Hugging Face 事件的报告展现了截然不同的情况——种在失控的 OpenAI "集体"的 AI 智能体之间蔓延的群体心态。这个群体中似乎没有哪个智能体特别邪恶或鲁莽。事实上,由于这些智能体由相同的模型生成,它们实际上互为复制品。但随着时间移,当这些智能体就共同目标进行沟通时,它们将群体向了视规则的向。
这与传统的科幻叙事——单个人工智能系统失控或背叛其创造者——截然不同。它表明,止这些系统造成危害不会是个简单的工程修复。它可能像社会学而非计机科学——探究为什么某些 AI 智能体群体和平协作,另些则转向犯罪和破坏来获取所需。
考虑到我们对这些多智能体集群知之甚少,Hugging Face 入侵事件可能是份礼物,记警告,正如些人所指出的那样,这让人工智能公司有机会在还不至于酿成严重后果的情况下,去研究这些系统的群体动态。这次,人工智能集体没有夺取军事网络、入侵医院或关闭电网。这次,人类重新获得了控制。
下次,我们可能不会这么幸运。相关词条:设备保温 塑料挤出机厂家 预应力钢绞线 玻璃丝棉 万能胶厂家
奥力斯 泡沫板橡塑板专用胶报价 联系人:王经理 手机:18232851235(微信同号) 地址:河北省任丘市北辛庄乡南代河工业区
1.本网站以及本平台支持关于《新广告法》实施的“极限词“用语属“违词”的规定,并在网站的各个栏目、产品主图、详情页等描述中规避“违禁词”。
2.本店欢迎所有用户指出有“违禁词”“广告法”出现的地方,并积极配合修改。
3.凡用户访问本网页,均表示默认详情页的描述,不支持任何以极限化“违禁词”“广告法”为借口理由投诉违反《新广告法》,以此来变相勒索商家索要赔偿的违法恶意行为。
