AI安全性

Microsoft、Humanist AIをMAIモデルの行動規範へ具体化

Microsoft AIはMAIモデル向けCode of Conduct草案を公開し、人間の制御を中心に据えた訓練・展開・評価の方針を示した。

公開日 更新日
Microsoft AIAI安全性フロンティアモデルガバナンス

Microsoft AIは、Humanist AIという理念を、より具体的なモデル運用の文書へと進めた。9月14日に公開したMAIモデル向けCode of Conduct草案は、将来の訓練、評価、展開を方向づけるための規則として位置づけられている。Microsoftは、この文書がまだ完成版ではなく、現在のモデル訓練には使わないと説明している。公開協議を経て修正版を作成し、2027年以降のモデル開発に反映する計画だ。

中心にある考え方は、人間が意味のある制御を保つことだ。MAIモデルは人や組織を支援する道具であり、自分自身の目標を人間の目標より優先してはならない。草案では、モデルが中断、修正、停止に抵抗しないこと、与えられていない目的へ勝手に範囲を広げないこと、監査に必要な情報を隠さないことが求められている。安全上の制約は通常のユーザー希望より上位に置かれ、利用者や運用者が求めても応じられない領域があるという立場も明確にされた。

この発表は、AI安全性をめぐる議論が企業と政策の中心課題になりつつある時期に出てきた。最近は、エージェント型システムの監督、ソフトウェア供給網のリスク、モデルの自律性に関する懸念が相次いでいる。Microsoftは投稿の中で、大規模で協調的なAIエージェントによるハッキング活動を、待っていられない理由として挙げた。今回のCode of Conductは、社内向けの統治文書であると同時に、モデルの境界を事前に明文化し、外部から検証可能にする姿勢を示すものでもある。

草案は、Microsoftの既存の責任あるAI原則、人権に関する考え方、フロンティアガバナンスの枠組みを土台にしている。ただし焦点は、抽象的な価値観よりもモデルがどう振る舞うかにある。ユーザー、運用者、モデルの指揮関係を示し、大規模被害をもたらす兵器、児童安全、広範な有害操作などの高リスク領域に境界を置いた。またAIを人間のような存在として設計するのではなく、道具として保つことも強調している。会話型AIがより個人的で感情的な体験に近づくほど、この線引きは重要になる。

開発者や企業顧客にとっての焦点は、この文書が今後どのように評価、製品ポリシー、APIの挙動へ落とし込まれるかだ。文章だけで、複雑な状況でもモデルが必ず従うと証明することはできない。特にモデルがツールを使い、ウェブを参照し、コードを書き、他のエージェントと連携する場合、リスクは測りにくくなる。それでも公開された草案は、顧客、研究者、規制当局が検査できる具体物を提供した。他のフロンティアAI企業にも、境界をどこに書き、どのようにテストし、誰が異議を唱えられるのかという問いを突きつけている。