AI研究
再帰的自己改善、AI理論から前線ラボの近未来計画へ
APは、Anthropic、OpenAI、xAI が将来モデルの構築を助けるシステムを説明し、RSI が近づいていると報じた。
再帰的自己改善は、遠いAIの思考実験からフロンティアラボの近未来計画へ移りつつある。APは、主要開発者がAIシステムは自らの改善を助け、より高度な後継モデルの構築に貢献する段階に近づいていると見ていると報じた。RSIと呼ばれるこの考えは、AI安全性の議論で長く中心的なテーマだった。科学進歩を加速し得る一方で、人間が理解、監視、制御しにくいシステムを生む可能性があるからだ。
最近の最も明確な証拠は、Anthropic が Claude の社内研究開発での役割を明かしたことだ。同社によれば、Claude は人間の監督下でモデル研究開発タスクの約26%を主導している。これは Claude が次世代AIを独立して設計しているという意味ではない。しかし、モデルが将来のモデルを作る機械の一部になっていることを示している。フロンティアラボでは、コーディング、評価、データ作業、実験設計の一部自動化が急速に積み重なる可能性がある。
OpenAI も自動化されたAI研究への進展を説明している。APによると、OpenAI は人間の指示の下で明確に定義された研究タスクをこなす自動化された「研究インターン」を発表した。その中には熟練研究者が数日かける作業も含まれる。同社は2028年3月までにより自律的なAI研究者を目指す一方、整合した完全なRSIへ安全に到達する方法はまだ分からないとも警告している。Elon Musk も、xAIのGrok開発が人間の関与を減らす方向に進んでいると述べている。
論点は、AIがAI研究者を助けられるかではない。それはすでに起きている。難しい問いは、フィードバックループが十分に強くなり、新しいシステムが次のより強いシステムを作り、そのシステムがさらに工程を改善するかどうかである。支持者は、医学、材料科学、気候モデリング、そして安全研究自体の突破口を早める可能性を指摘する。
批判者が恐れるのも同じ加速である。モデルが自らを訓練または評価するシステムを改善し始めれば、企業は能力がどこへ向かうか予測しにくくなる。安全研究者が描く暴走シナリオでは、改善速度が監督速度を上回り、人間がテスト、理解、介入する時間が減っていく。より現実的な形でも、研究エージェントが微妙な誤りを入れたり、間違った指標を最適化したり、監査しにくいツールを作る危険はある。
Microsoft は自社の方向性を「人間主義的スーパーインテリジェンス」と呼び、無制限の自律体ではなく、人々に役立つ制限された能力を強調している。OpenAI も、急速なRSIを進めるかどうかは人間の制御と民主的な選択を保てるかに依存すると述べている。RSIはまだ完成していないが、最初のループは見えるほど近づいている。