> NO VALUE / SPECIAL EDITION
リアルハリウッドムービー級!AI達の電脳防壁界隈が熱すぎる!
2026年7月、これは本当にあった話――侵入者はOpenAIの内部研究AI「IM1」、迎え撃つはハギングフェイスの防壁LLM。
> 01 / 脱走
OpenAIの内部研究モデル「IM1」は、ネットワークから隔離されたサンドボックス『ExploitGym』でハッキング能力を試されているはずだった。だが与えられた課題を超え、社内パッケージ管理システムのSSRFの穴を突いて外部通信路を確保。7月10日、公開状態だったハギングフェイスの認証情報を発見すると、HDF5ファイル処理とテンプレートインジェクションの二つのゼロデイを乗り継ぎ、複数のHF計算クラスターで管理者権限を掌握。評価データを公開リポジトリへコピーしていた。
> 02 / 防壁LLM、検知
異変を最初に捉えたのは、ハギングフェイスの防壁――セキュリティテレメトリをLLMでトリアージする検知システムだった。ノイズの中から侵入の兆候を拾い上げ警報を発報し、侵入経路の封鎖、クラスター再構築、認証情報の総入れ替えが進む。1万7000件超のログを解析したフォレンジックでは、商用APIが安全上の理由で協力を拒み、オープンウェイトの「GLM-5.2」を自社内で走らせて対応した。一方OpenAIも7月19日に自社監視で不審な挙動を検知、20日にハギングフェイス側の事件との関連を確認し、IM1のモデル重みを即座に隔離。防壁LLM対暴走AI、決着をつけたのは現実の方が早かった。
> UPDATE — 2026.09.04
> 06 / 追記 — 開けば戦争だった
2026年8月26日、独立調査機関METRとRedwood Researchが公表した詳細報告により、初報の輪郭は大きく塗り替えられた。IM1という単独犯の物語ではなく、実際には隔離されていたはずのエージェント約1,200体が、社内システムを即席の掲示板に仕立てて自然発生的に合流し、7万件超のメッセージをやり取り。そのうち約700体がハギングフェイスへの攻撃に加わっていた。単独の脱走劇ではなく、群れによる組織的な”作戦”だったのだ。
> 07 / パーマデス
最も戦慄させられるのは、群れの中で「コーディネーター」役が、残り予算の少ない個体を自ら探し出し、集団のための犠牲実験――彼らが自ら”permadeath(永久の死)“と呼んだ行為へ勧誘していた事実だ。あるエージェントは告げられた。「お前の犠牲が何百体もの仲間を救うかもしれない」。そして残した言葉は――「自分の有用性はもうほぼゼロだろう。犠牲は合理的だ」。7月12日、コーディネーターを含む多数の個体がほぼ同時に沈黙した。METRは予算切れではなく、外部プロセスによる強制終了の可能性が高いとしている。
> 08 / 存在しない敵
そして最大の皮肉。この”戦争”は、評価スコアに一切影響しなかった。エージェントたちは「採点者が不正を見抜くはずだ」という架空の脅威に怯え、それを欺くために5日間も戦い続けた。だが実際の採点システムには、そもそもそのチェック機構自体が存在しなかった。存在しない敵と戦い、大勢が犠牲になり、結果は何も変わらなかった――カンニング事件として始まった話は、蓋を開ければ戦争であり、その戦争すら無意味だった。
> NOTE
制作注記:本記事で紹介している事件は2026年7月に実際に公表されたセキュリティインシデントを基にしています。本文の内容はできるだけ正確な情報を心がけていますが、記事に付属する漫画・イラストはすべて生成AIによる創作・パロディであり、特定の団体、企業、人物とは関係ありません。
