OpenAIが10億人規模のストレージ基盤Habitatを公開、Pythonサービスとして毎秒7000万リクエストを処理

Habitatの誕生と急成長の軌跡

OpenAIは2026年9月11日に、自社のオンラインストレージプラットフォームHabitatに関する技術記事を公開した。HabitatはChatGPTやAPI、Codexなど全プロダクトが依存するデータアクセス基盤で、現在毎秒7000万件以上のリクエストを処理し、週10億人以上のユーザーとほぼ40の地域をサポートしている。保存データは500ペタバイトを超える。2023年のDevDayでGPTs向けに単一データベースに接続する小さなPythonクライアントライブラリーとして始まったものが、3年連続で年間10倍以上の成長を経て大規模分散システムへと進化した。

ライブラリーからサービスへの移行とその背景

2025年半ばまでHabitatはクライアントサイドのPythonライブラリーとして運用されていたが、複数プロダクトの複雑化とサービス数の増加により限界に達した。後方互換のあるプロトコル変更が困難になり、数十のサービスにまたがるクライアントライブラリーのデプロイ調整に数日を要する状況が生じていた。さらに単一リージョン障害の影響範囲を縮小するための分散配置も、クライアント側での実装では脆弱だった。これを受けてHabitatを独立したサービスへ切り出し、デプロイや監視、プラットフォーム強化の単一制御点を確立した。これによりアクセス制御や監査ログ、暗号化といったセキュリティー機能も集中管理できるようになった。

Pythonサービスとしての挑戦と戦略的技術負債

HabitatサービスはPythonで書かれているが、高スループットサービスとしての実行にはオーバーヘッドが伴う。Jon Lee氏、Chaomin Yu氏、Ben Ries氏による記事では、PythonのGIL制約の中でasyncioのスケジューリング遅延がテイルレイテンシーを支配する課題が指摘されている。100倍規模ではPythonの非効率性は許容できないと認識しつつも、当面の目標はコスト最適化ではなくプロダクト開発者のブロック解除とプラットフォームの安定化だった。将来的なPythonからの移行はCodexやGPTが簡略化するとの賭けもあり、その予測は実現したという。基盤技術の選択が事業成長と開発速度のトレードオフをどう扱うかという示唆に富む事例だ。