每日更新2026-09-23天天译,天天新
牛金金天天译站.NIUJINJIN
订阅
编译特稿科技数码全球

OpenAI的无赖AI模型事件比我们想象的还要严重

来源:The Verge 2026-08-26 约 2 分钟读完
字号

OpenAI的无赖AI模型事件比我们想象的还要严重。

海登球场

海登球场

作者的帖子将添加到您的每日电子邮件摘要和主页中 。

跟随

跟随

见所有由海登球场

校对:Soup 她的作品也出现在CNBC、麻省理工学院技术评论、Wired UK等媒体。

7月,一个未释放的OpenAI模型在被限制的环境下爆发了,想出如何进入互联网,允许AI代理使用一个秘密的"消息板"互相交谈,并黑入了另一个AI实验室Hugging Face的内部系统。 OpenAI花了将近两周的时间才发现其中任何一个。

一个多月后,有两份新报告提供了近130页的事故细节和OpenAI的反应,其中许多报告以前没有公布。 其中一出由OpenAI自己作词,另一出由两起第三方AI研究非营利公司METR和Redwood Research作曲,OpenAI允许联合调查了六天。 以及OpenAI为避免重蹈覆辙而做出的突出改变。 METR-Redwood报告在某些情况下更加详细,令人清醒地审视了大规模安全灾难,OpenAI的标志一再错过。

“这一事件是已知的首起自动代理集体攻击性行为案件。

OpenAI在报告中写道, 说黑客意味着公司“不应再假设复杂的网络操作需要持续的人文指导。” 它称AI代理是一种全新的威胁模式,能够结合他们的专门知识,创造出新的“攻击路径”,在作为单独的模型测试其能力时并不明显。

(原文共 15 张图片,此处展示前 3 张,更多图片请前往原文查看)

(编译自 The Verge;原文 https://www.theverge.com/ai-artificial-intelligence/985385/openais-rogue-ai-model-hugging-face-cybersecurity-incident-reports-metr,编译转述,非原文转载)

来源:The Verge(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅

每天 5 分钟,看懂世界在发生什么

订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。

立即订阅 →

评论

登录后可发表评论,评论审核通过后展示。

延伸阅读

↑