每日更新2026-09-23天天译,天天新
牛金金天天译站.NIUJINJIN
订阅
编译特稿AI 人工智能全球

一位人类研究者刚刚给我们看了一眼自我改进的AI

来源:TechCrunch 2026-08-28 约 2 分钟读完
字号

一位人类研究者刚刚给我们看了一眼自我改进的AI。

训练人工智能模型与人工智能模型一起成为新实验室非常受欢迎的目标,

Anthropic在星期五发表了一份题为“自动化研究人员可以合理缓解校正失败”的新文件,其中详细介绍了AI系统如何根据一套校正基准可靠地改进模型的性能。 在为具体错位行为设定了10个基准时,自动化系统能够提高每个系统的业绩,而不会降低总体业绩。

该系统由Anthropic同仁陈岳汉(英语:Chen Yueh-Han)为首,复制了许多传统的研究方法。 每个自动系统搜索可用的文献,提出一种方法,并使用这种方法对模型进行30分钟的训练,比几个迭代逐渐提高基准。 有效的方法得以保留,而无效的方法则被抛弃,使该系统能够迅速和大规模地运作。

“总的来说,这些结果提供了早期证据,表明在近期内自动调整后培训可能切实可行。”

本文是走向递归自我改善的一步, 如果模型可以改进自己的校正训练,那么它们可以更广泛地改进训练做法是可行的 — — 此时,人类人工智能研究人员可能很快会过时。

并明确将自动校正研究者(AAR)与同类人相比较。 “最佳的AAR方法比经验丰富的人类提出的方法要好,平均在6小时内。” “人类指导的研究方向不会导致更大的业绩。”

如果有人不相信, AAR在API推论中大约每小时花费4美元,而我们付给人类研究人员每小时150美元。

(编译自 TechCrunch;原文 https://techcrunch.com/2026/08/28/an-anthropic-researcher-just-gave-us-a-peek-at-self-improving-ai/,编译转述,非原文转载)

来源:TechCrunch(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅

每天 5 分钟,看懂世界在发生什么

订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。

立即订阅 →

评论

登录后可发表评论,评论审核通过后展示。

延伸阅读

↑