Anthropic报告Claude主导26%的AI研发任务

9月17日,Anthropic提议衡量AI开发进程的指标,并报告8月内部评估中,按任务所投入人力时间加权后,26%的研发处于Claude主导、有人监督的阶段。
这一阶段允许AI从高层指示出发完成任务的大部分,但仍由人监督。公司表示,所测研究领域尚无完全自主的阶段。
本报观点
等待检查可能成为研究的新瓶颈
AI产出越多,安排人的审查顺序就越重要。即使能生成一百个实验方案,只有几个人检查时,也无法立刻全部确认。
研究竞争可能因此扩展到快速发现关键失败与发现的能力。能够把人的专业知识集中在正确检查点上的实验室,可能更有优势。
今后生活可能怎样改变?
以下是根据这则新闻作出的未来设想。
早上从AI的夜间实验中挑出重要结果
未来研究者可能早上查看AI夜间推进的工作,再深入追查意外结果。重复操作减少后,对什么感到好奇可能更能体现研究者的差别。
这一场景超出了已报告数字,描绘的是人如何重新分配监督和构思的时间,而非监督消失。

