Apple Intelligence / AI

AIがAIを進化させる時代へ。でも「人間が監視できるのか」が難しくなる

OpenAI Chief ScientistのJakub Pachocki氏が、再帰的自己改善とChain-of-Thought監視の難しさを語りました。AIの能力と監視を考えます。

OpenAI / AI安全性AIがAIを進化させる?人間による監視は追いつくのか
りんご親父りんご好きringozuki.com

OpenAI Chief ScientistのJakub Pachocki氏が9月6日、「An Alien Mind」を公開しました。

内容はかなり踏み込んでいます。

現在のAI進歩が続けば、AIがAI開発そのものを加速するRecursive Self-Improvementへ進む可能性が高い。

一方で、その速度に安全性と監視が追いついていないという話です。

同日にOpenAIが発表した「AI研究インターン」と合わせて読むと分かりやすいです。

AIが研究を手伝う。

AIが研究作業を任される。

AIがAI研究そのものを加速する。

能力向上と同時に「AIをどう監視するか」がボトルネックになっていく可能性があります。

Pachocki氏は、モデルがツールや他AIと複雑にやり取りし、自分自身の推論過程を扱う能力も上がることで、Chain-of-Thought監視への依存が難しくなっていると説明しています。

長く動いてほしい。

複数並列で働いてほしい。

承認回数も減らしたい。

でも、人間が何も見なくていいわけではありません。

全部を人間が確認するのではなく「重要なところで止められる」「異常時に人間へ戻す」という監視設計が、能力そのものと同じくらい重要になりそうです。

この記事をシェア

XFacebookLINE

今回の主な情報源

※製品仕様・価格は発表時点の情報です。

NEXT READ

OpenAI / AIエージェントAI研究インターンがもう働いている人間1日でAIは3.1日分
りんご親父りんご好きringozuki.com

りんご好き

OpenAIでは「AI研究インターン」がもう働いている。人間1日でAIは3.1日分

OpenAI / AIAIエージェントを最後に止めるのは?便利さと安全性を考える
りんご親父りんご好きringozuki.com

りんご好き

AIエージェント同士がWikiで情報交換。便利だけど「人間が最後に止められる仕組み」は絶対に欲しい

AI / CodexCodexが過去を検索へAIの弱点だった忘れるが変わる?
りんご親父りんご好きringozuki.com

りんご好き

GPT-6 AstraでCodexが「過去を検索」へ。AIの弱点だった“忘れる”が変わり始めた