OpenAI、外部評価の重点を公表 安全対策や事故も検証対象に

9月22日、OpenAIは第三者によるAI評価の重点と原則を公表した。安全だと説明する根拠に加え、危険な動作を防ぐ仕組みや、能力を測る試験そのものも確認対象に挙げている。
AIが許可なく行動したり監督を避けたりする重大な問題も、独立した調査の対象としている。今回説明した取り組みは、主に長い期間をかけて安全性の主張を詳しく調べるもので、全製品への事前認可制度の導入を意味しない。
本紙の考察
評価されるのは、AIだけでなく検査のやり方
AIが試験に高得点を取るほど、その試験で何を見落としているかが大切になる。本紙は、外部評価の役割が合否を付けるだけでなく、試験問題を作り直すことへ広がると考える。
この変化は小さな会社にも関係する。自社で巨大な研究所を持たなくても、任せたい仕事に合う検査を選べればAIを導入しやすくなる。専門家が業種ごとの失敗例を集める仕事に、新しい需要が生まれそうだ。
今後、暮らしはどう変わる?
ここからは、ニュースをもとに考えた未来の予想です。
店のAIを、忙しい日を想定して試す
将来、飲食店が予約受付AIを選ぶとき、満席や重複予約の模擬試験を見比べる。会話の自然さだけでなく、困ったときに人へ戻せるかで選ぶようになるかもしれない。
これは今回用意された店舗向けサービスではない。AIの評価方法が専門家の外にも届いた先にある、使い方の予想だ。

