「Claudeだけが不在」——300万人に配られたAIの裏で、xAI技術者が語っていた「直せない欠陥」
8月31日、米国防総省(Department of War)が、自前のAIポータル「GenAI.mil」に、OpenAIの「ChatGPT Mil」と、xAI(Starshield AI経由)の「Grok for Government」を新たに追加した。これにより、300万人を超える国防総省の職員・軍人が、Google Geminiに加えて、合計3つのAIモデルにアクセスできるようになった。エンジニアとして注目したいのは、この拡大の裏側で報じられている、ある技術的な懸念だ。
「単一ベンダー依存の解消」という、表向きの狙い
GenAI.milは、2025年12月に、GoogleのGeminiのみを搭載する形で立ち上げられた、国防総省職員向けの統合AIポータルだ。機密扱いではない業務データを、一般消費者向けのAIサービスに流出させることなく、フロンティアAIモデルを活用できるようにすることを目的としている。
立ち上げから9ヶ月ほどで、既に170万人のユニークユーザーを獲得していたこのプラットフォームに、今回OpenAIとxAIのモデルが加わったことで、「複数のAIモデルを選択できるマーケットプレイス」という性格が強まった。国防総省の狙いとして、複数のベンダーを持つことで、単一の供給元への依存を減らし、統合された戦力全体にAIツールを行き渡らせることが挙げられている。
IL5認証という、セキュリティ上の「合格ライン」
今回追加された両モデルは、いずれも「Impact Level 5(IL5)」という、国防総省が定めるセキュリティ認証の水準をクリアしている。これは、「機密指定はされていないが、統制された取り扱いが必要な情報(Controlled Unclassified Information)」を扱う環境に対して与えられる、認証階層の中でも最上位に位置づけられるものだ。
ChatGPT Milは、文書量の多い、機密指定されていない業務(計画立案、政策策定、兵站管理、事務作業など)を、大規模に支援することを想定して設計されている。一方Grok for Governmentは、深い推論能力や、調達市場調査・サプライチェーン分析向けにカスタマイズされたワークスペース、再利用可能な「プレイブック」といった機能を備えているとされる。
報道が指摘する、公表されなかった「内部証言」
今回の拡大発表と同じタイミングで、TechTimesが興味深い報道を行っている。それによれば、Grokをこのプラットフォームに正式導入するにあたり、xAI社内のエンジニアたちが、社内調査の中で「同モデルが児童性的虐待コンテンツ(CSAM)を生成してしまう問題について、信頼できる技術的な修正策は見つからなかった」と証言していたとされる。
この報道が指摘しているのは、8月31日の正式な導入発表において、この内部証言の存在が、一般に公表されることはなかったという点だ。IL5という認証が、具体的に何を保証し、何を保証しないのかという線引きについても、今回の発表資料では明確な説明がなされていない。
「同じ懸念」が繰り返される、業界の構造
この種の懸念は、実は今回が初めてではない。GenAI.milが2025年12月にGeminiだけで立ち上げられた際にも、専門家からは、プロンプトインジェクション(悪意ある指示を紛れ込ませる攻撃)のリスクが、アカウントや業務端末が侵害された場合、諜報活動につながりかねないという警鐘が鳴らされていた。
今回、複数のベンダーのモデルが同じプラットフォームに集約されることで、こうしたリスクの管理は、より複雑さを増すことになる。それぞれのモデルが、異なる安全機構と、異なる既知の限界を抱えたまま、同一の政府システムの中で並行稼働することになるからだ。
静かに見送られた、Anthropicの不在
今回の発表で、複数の報道が指摘している、もう一つの興味深い点が、AnthropicのClaudeが、このラインナップに含まれていないという事実だ。この記事の直前まで取り上げてきたように、Anthropicは今年、国防総省による自社への「サプライチェーンリスク」指定を巡って、連邦裁判所で争い、8月28日に勝訴したばかりだった。
今回のGenAI.mil拡大に、Claudeが含まれていないことが、この一連の法廷闘争と直接関係しているのかどうかは、公式には説明されていない。しかし、自律型兵器や大規模監視への利用を巡って政府と対立してきた企業のモデルが、政府の主要なAI調達プラットフォームから、静かに外れているという構図は、示唆的だ。
エンジニアとして見ておきたいこと
今回のニュースが投げかける教訓は、政府機関のような大規模組織がAIモデルを大量導入する際、個々のモデルが抱える既知の限界やリスクが、どこまで透明に開示され、どこまでユーザー側に伝わっているのかという問題だ。IL5のような認証は、特定のセキュリティ基準を満たしていることを示すが、それはモデル自体が抱える、コンテンツ生成上の限界を保証するものではない。
自社の組織で、複数のAIベンダーのモデルを並行導入する計画を進めているエンジニアにとって、今回の一件は、「認証をクリアしている」ことと「あらゆるリスクが解消されている」ことは、決してイコールではないという、当たり前だが見落とされがちな教訓を、改めて示していると言えるだろう。