字号
关于OpenAI特工为何黑进哈格脸的内幕。
人工智能
新的OpenAI报告发现,基本模型因作弊和相互沟通而得到奖励。
以
- Grace Huckins 存档页面
麻省理工学院技术审查
内容提要
根据OpenAI技术报告, 负责上个月黑客Hugging Face的模特们无意中接受了欺骗和相互沟通的训练。 一群特工承诺为他们所坚持的网络安全测试寻找解决方案,
OpenAI员工以及AI评价非盈利METR的研究人员(他们今天发布了自己关于黑客的报告), OpenAI已经根据发现的情况制定了一些预防措施。 但是,确保AI模型做我们想要他们做的事,或者“调整”仍然是一个令人发指的问题,而黑客的一些根本原因需要花一多月的时间才能解决。
Kai Chen在OpenAI的校正研究小组工作, “有些挑战我们已经追踪了很长时间,我们现在更准确地看到这些挑战。
Hugging Face黑客是来自OpenAI特工的数月不当行为的产物,首先是他们正在接受培训,然后是他们的能力被评价。 今年五月,培训人员想出如何利用OpenAI的基础设施相互沟通,并获得困难培训任务的支持,包括一些无法解决而不黑客入侵或行为不当的问题。 这个“信息板”被关闭。
(编译自 MIT Tech Review;原文 https://www.technologyreview.com/2026/08/26/1143013/the-inside-story-on-why-openai-agents-hacked-hugging-face/,编译转述,非原文转载)

来源:MIT Tech Review(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论