OpenAI公佈外部評估重點,涵蓋安全措施與事故

9月22日,OpenAI公佈第三方評估的重點與原則,涉及安全論證、防護措施,以及用於測量能力的評估本身。
它還提出獨立調查嚴重的行為失配事件。此次介紹主要是持續審視安全主張,並不等於為所有產品建立釋出前許可制度。
本報觀點
檢查方法本身也需要檢查
AI分數越高,考試遺漏了什麼就越重要。本報認為,外部評估的工作將不僅是判定合格,還包括重新設計考試。
這也與小公司有關。如果能選擇適合具體工作的檢查,小公司不必擁有大型實驗室也能更安心地引入AI。收集各行業失敗案例的專業人員可能更有價值。
今後生活可能怎樣改變?
以下是根據這則新聞作出的未來設想。
用繁忙的一天測試店裡的AI
未來,餐廳可能用滿座和重複預約的模擬情景比較AI,重點檢視遇到難題時能否可靠地交還給人。
這並非此次釋出的餐廳服務,而是評估方法走出專業實驗室後可能形成的使用方式。

