字号
本期编译精选。
已张贴
以
BeauHD 软件
2026年9月3日星期四 @02:00PM
从思维的链子。
一位匿名读者引用了TechCrunch的一份报告:OpenAI的新Astra模型将使用一种名为经常性深度的推理技术,允许它在大多数推理模型的特征的相继思维之外运作。The Information于星期二上报。这个技术,也叫“不透明重现”, 很可能使模型的思维链更难监测—— 这让AI安全专家惊慌失措。虽然Astra对技术的使用据说有限,但其出现仍然引起大赦国际安全专家的严重关切。
“我对Astra使用不透明复发方式的报道感到极为担忧”, 我不知道Astra是否比之前的模型更能监控CoT. 但如果OpenAI进一步推开这一技术,他们会有大规模地增加再现并完全破坏CoT可监测性的选择.
长期AI安全倡导者Zvi Mowshowitz(Zvi Mowshowitz)也进行了权衡并写道,可能需要法律来防止AI实验室中的竞相. 这个技术在玩火,冒着OpenAI和Anthropic为了确定我们努力维持思想的忠诚和可监控链而奋斗的禁忌的风险,Mowshowitz写道。更密集地使用这些技术 可能会破坏可监测性
(原文共 10 张图片,此处展示前 3 张,更多图片请前往原文查看)
(编译自 Slashdot;原文



来源:Slashdot(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论