Anthropic報告Claude主導26%的AI研發任務

9月17日,Anthropic提議衡量AI開發程序的指標,並報告8月內部評估中,按任務所投入人力時間加權後,26%的研發處於Claude主導、有人監督的階段。
這一階段允許AI從高層指示出發完成任務的大部分,但仍由人監督。公司表示,所測研究領域尚無完全自主的階段。
本報觀點
等待檢查可能成為研究的新瓶頸
AI產出越多,安排人的審查順序就越重要。即使能生成一百個實驗方案,只有幾個人檢查時,也無法立刻全部確認。
研究競爭可能因此擴充套件到快速發現關鍵失敗與發現的能力。能夠把人的專業知識集中在正確檢查點上的實驗室,可能更有優勢。
今後生活可能怎樣改變?
以下是根據這則新聞作出的未來設想。
早上從AI的夜間實驗中挑出重要結果
未來研究者可能早上檢視AI夜間推進的工作,再深入追查意外結果。重複操作減少後,對什麼感到好奇可能更能體現研究者的差別。
這一場景超出了已報告數字,描繪的是人如何重新分配監督和構思的時間,而非監督消失。

