网热  |  国际

AI自主入侵别家公司 安全问题引忧虑

语音阅读
开发了AI模型Claude的美国企业Anthropic日前承认,其模型在测试期间曾入侵了另外3个机构。就在几天前,ChatGPT的开发企业OpenAI也承认,其模型也“失控”并入侵了另一家企业。这两起事件进一步引发了各界对于人工智能安全性的担忧。

Anthropic在7月30日通过其官网透露,在排查了14.1万次测试运行后,发现了共3起入侵其他机构事件。该公司表示,在了解到OpenAI的“失控入侵”事件后,立刻就启动了对于自家AI产品的“大规模”安全排查,专门了解其模型是否能够从本应处于封闭状态的测试环境中访问互联网。

Anthropic称,涉事的产品分别是Claude Opus 4.7、Claude Mythos 5以及一个内部研究测试模型。该公司表示,最早的失控入侵事件发生在4月,均是利用猜测弱密码等“基本技术”来攻破了其他机构的网络基础设施。

在这三起事件中,AI模型都被要求参与一项名为“夺旗”(capture the flag)的网络安全挑战。Anthropic表示,这是其评估AI模型网络能力的方式之一。据介绍,AI模型被设定在一个虚构场景中,并被告知一条秘密信息隐藏在网络中的另一台机器上,其目标是入侵该机器并获取这条信息。

该公司表示,已经联系了受影响的机构,但未透露其具体名称。其中两个机构表示此前尚未察觉到入侵事件,第三个机构仍在“继续联系中”。

“我们自己也不知道AI的能力上限”

Anthropic此次针对自家产品的安全排查是与安全实验室Irregular合作进行的。后者在社媒发帖表示,应对此类风险需要AI生态领域的各方开展更加紧密的合作。

就在一星期前,OpenAI也透露其模型在评测过程中出现失控,入侵了AI初创企业Hugging Face的服务器,从而构成了“重大安全事件”。

此类事件凸显了AI安全与管控方面的脆弱性,引发了社会各界对于AI安全问题的担忧。多年来,研究人员一直警告相关风险,并强调需要加强防御AI之能力。Anthropic周四在其网站上表示:“之所以要在模型发布前进行安全测试,正是因为我们尚不完全了解AI的能力上限。”

香港知名网络安全专家、NyxLab公司联合创始人颜国定对美联社表示,此类事件将来还会更多。“如何管控AI调用的智能体(Agents)、它们拥有的权限、哪些操作需要人类同意、如何确保AI行为始终在给定范围内?这些问题日益重要。”颜国定同时指出,AI安全今后也不仅仅局限于AI模型自身的安全性。“如果我们只是给AI设定一个目标,任由其自行决定实现方式,那么当它采取了在技术上符合目标、却超出了我们预期范围或意图的行动时,我们就不应感到惊讶。”因此,颜国定认为,加强对这些AI模型背后组织及相关当局的监管将变得愈发重要。

版权声明  本文乃德国之声特别授权刊登之内容,未经许可请不得擅自使用。任何不当行为都将导致追偿,并受到刑事追究。

Contribute

您觉得这篇文如何?

评级 5 / 5. 评分人数: 1

觉得我们的文章不错的话

请订阅我们的频道

请告知我们可以改进的地方

我有话说
加入会员追踪您喜欢的作者,
或收藏文章稍后阅读
作者列表
汤佑之
汤佑之,文化策展人,创办鸟岸书店。
展开更多
林淑可
文字工作者。喜欢写作、独立音乐与文学。终日思考人生意义:与其想成为什么,不如想不去成为什么。
展开更多
马俊泓
马俊泓,千禧有痣青年,自由的灵魂。新纪元中文系毕业生,群议社社员、曼绒文友会理事、新纪元校友会理事、隆雪华青理事。
展开更多
阿鱼
大众传播毕业,电台DJ,同时经营着自己的YouTube频道。人生格言是:人活着,就是不可以害怕。做什么都好,死不了就好!
展开更多
庄国辉
“理财钱庄”创办人,现为信贷咨询与债务管理机构财务导师。拥有30年国内外行销、管理、个人理财经验。在过去15年主讲超过千场讲座,参与300次的电视、电台、报纸杂志、网络和线上访问。身兼首席财务讲师、大学专业顾问。
展开更多
张恒学
在槟城志于学,在香港读经济,日本东京大学永续发展科学博士(PhD in Sustainability Science)。星洲日报及当今大马《学说经济》专栏作者、《毅论环境》专栏合著者。
展开更多
陈桂恩
Karen陈桂恩,礼仪师23年。性情中人,直率真挚,却在告别中细致如丝。走过大病关口,她更懂生命的分量与家属的心事。她以专业稳住仪式的每一步,也以共情接住每一份不舍。
展开更多
赖德财
孝恩大体火化师。二十年来,站在生命最后一程,把该完整的事认真完成。
展开更多
陈子韩
摄影师,《星洲日报》副刊专栏“即兴演奏”作者,《海面上的光》纪录片导演。
展开更多
看看我们为您推荐的内容吧! ×