AIインフラ

OpenAI、10億人超のChatGPT利用を支えるHabitatの拡張を説明

OpenAIはオンラインストレージ基盤HabitatがPythonライブラリから大規模サービスへ発展した経緯を明らかにした。

公開日 更新日
OpenAIChatGPTAIインフラHabitat

OpenAIは9月11日、ChatGPT、Codex、API製品を支えるオンラインストレージ基盤「Habitat」について、詳しい技術記事を公開した。記事によると、Habitatは現在、毎秒7000万件を超えるリクエストを処理し、週に10億人以上が使う製品を支え、約40の地域にまたがって500PBを超えるデータを扱っている。生成AIサービスの表側ではモデルの性能が注目されがちだが、この発表は、その応答速度と安定性を成立させる裏側の仕組みに光を当てている。

Habitatは当初、DevDay 2023のころに作られたPythonのクライアントライブラリだった。目的は、製品チームがデータの保存場所、権限、データレジデンシー、暗号化、ルーティング、接続管理を個別に実装しなくて済むようにすることだった。しかしChatGPTの利用が急拡大し、サービス数も増えると、クライアント側に複雑なロジックを置く方式は限界を迎えた。プロトコル変更や地域分散の改善を行うたびに、多数のサービスへ更新を行き渡らせる必要があり、運用上のリスクが高まった。

OpenAIはそこでHabitatを独立した中央サービスへ移した。これにより、認可、監査ログ、レート制御、ルーティングを一か所で実施できるようになった。さらに、Habitatは任意のSQLを許すのではなく、コストを見積もりやすいオブジェクトとエッジの操作に絞っている。大規模なオンラインストアでは、柔軟すぎる問い合わせが障害の原因になるため、設計上の制約そのものが信頼性を高める役割を持つ。

記事はPythonの課題にも触れている。圧縮、暗号化、チェックサム、設定解析などのCPU負荷が高い処理は、asyncioのスケジューリング遅延を生み、下流ストレージが速く応答しても利用者が遅さを感じる原因になる。OpenAIは設定更新の方法や接続再利用の方針を見直し、EnvoyとHTTP/2も活用した。最終的にはRustへの移行が進み、2026年第2四半期に2人のエンジニアがCodexとGPT-5.5を使ってサービスを書き換えたという。Rust版は生産リクエストの95%を処理し、CPU効率は6倍、メモリ効率は15倍になったとされる。