Grok 4.7公開 長い仕事と、自分で確かめる力を強化

9月21日、SpaceXAIはGrok 4.7を公開した。前版より大きな基盤モデルを使い、長時間かかる難しい課題での学習や、結果の確認を強化したと説明する。
GitHubも同日、Copilotでの段階的な提供を案内した。開発元の評価値は試験や推論設定で変わるため、すべての仕事で他のモデルを上回ると読み替えることはできない。
本紙の考察
AIの速さは、返事より完成までの時間で決まる
本紙は、長く働く力と自分で確かめる力が一緒に重視される点に注目する。返事が速くても人が毎回直すなら、仕事は早く終わらない。AIが途中で間違いに気づけるほど、人を呼び戻す回数を減らせる可能性がある。
すると比較すべきなのは、答えの速度だけでなく、依頼してから自分が何分関わったかになる。AIの競争が、人の注意をどれだけ節約できるかへ移る可能性がある。
今後、暮らしはどう変わる?
ここからは、ニュースをもとに考えた未来の予想です。
作業を頼んでいる間に、別の仕事へ集中する
将来、個人事業主がウェブサイトの修正を頼んでから、接客に集中する。AIは変更と検査を進め、判断が必要なところだけをまとめて知らせる。
これは今回のモデルで必ず実現するという保証ではない。人が作業を見張り続けなくてよくなるほど、一人が同時に進められる仕事は変わっていきそうだ。

