GPT-5.5-Cyber完全体:OpenAIがAIセキュリティエンジニアをCodexに組み込む
OpenAIがDaybreakセキュリティ計画を拡張し、GPT-5.5-Cyber完全体(CyberGym 85.6%でMythos 5を上回る)、Codex Securityプラグインのアップデート、Patch the Planetオープンソース修復計画を発表。脆弱性の発見からパッチ適用までを一本のラインでつなぎます。


GPT-5.5-Cyber完全体:OpenAIがAIセキュリティエンジニアをCodexに組み込む
OpenAIがDaybreakセキュリティ計画を拡張し、GPT-5.5-Cyber完全体(CyberGym 85.6%でMythos 5を上回る)、Codex Securityプラグインのアップデート、Patch the Planetオープンソース修復計画を発表。脆弱性の発見からパッチ適用までを一本のラインでつなぎます。
OpenAIはサイバーセキュリティの路線をDaybreak(暁)と名付けられた計画としてまとめ上げ、本日一気に3つの成果を公開しました。GPT-5.5-Cyberの完全体バージョン、Codex Securityプラグインのアップデート、そしてオープンソースエコシステム向けの**Patch the Planet(地球にパッチを当てる)**計画です。中心的な物語は一言でいえます——AIはすでに、防御側の「脆弱性発見からパッチ適用まで」というクローズループ全体を完走する助けができるのであり、脆弱性レポートをさらに量産することではない、と。
GPT-5.5-Cyber完全体はCyberGymで**85.6%**を達成し、Anthropic Mythos 5の83.8%と通常版GPT-5.5の81.8%を上回りました。これはOpenAIが計測した単一モデルとしての最高CyberGymスコアです。
CyberGym 85.6%、Mythos 5の83.8%とGPT-5.5の81.8%を上回る。
GPT-5.5-Cyberとは何か
これは高度で認可済みのサイバーセキュリティ業務向け専用モデルです。汎用版より高い能力を持ち、不要な拒答もより少なくなっています。プレビュー版の段階では主に「専門ワークフローでの誤拒否」の解決を扱いましたが、今回の更新で、大規模コードベース上で継続的に深い分析を行えるようさらに進みました。
1つのサイバータスクの標準的なクローズループは次のように回ります:
- セキュリティ関連コンポーネントの特定
- 脆弱性を含むコードが実際に到達可能かの追跡
- 管理された環境での潜在的問題の検証
- パッチの開発とテスト
- 人間によるレビュー用の証拠準備
GPT-5.5-Cyberの目標は脆弱性レポートをもう1枚増やすことではなく、防御側が修復のクローズループ全体を完走するのを助けることです。
3つの実際のセキュリティベンチマークでGPT-5.5を全面的に上回る。
3つのベンチマークで圧勝
- CyberGym(ソフトウェア環境で既知の脆弱性を再現できるか):Cyber 85.6% vs 通常 81.8%
- ExploitGym(既知の脆弱性を動作するエクスプロイトに変える):Cyber 39.5% vs 通常 25.95%
- SEC-bench Pro(長期間の脆弱性発見 + PoC生成):Cyber 69.8% vs 通常 63.1%
Codex Security:セキュリティエンジニアをすべての開発者のすぐそばに
GPT-5.5-Cyberが矛だとすれば、Codex Securityはすべての開発者の手元に差し出される盾です。OpenAIはこれをCodexワークフローに直接統合しており、すぐに使える能力の連なりは次のとおりです:
- チームのコードと脅威モデルの理解(なければ自動生成)
- 脆弱性の特定と、影響を受けるコードが到達可能かの判断
- 証拠の収集と検証手順の提供
- 的を絞ったパッチの開発と、修正結果の検証
どの発見を調査し、どの変更を適用し、どの情報を共有するかといった重要な意思決定は、依然として人間が握ります。

コードベース全体、その一部分、あるいは特定の変更やコミットをスキャン可能。
規模を示すデータがものを言います:3月のクラウドプレビュー公開以来、Codex Securityは3000万コミット以上をスキャンし、3万以上のコードベースをカバー。人間のレビュアーは7万件以上の発見を修正済みとマークし、さらに50万件以上の発見が自動的に修正済みと判定されました。
プラグインは既存の発見(スキャナー、セキュリティ勧告、バグバウンティレポート、チケット)のトリアージと検証にも対応し、大規模なパッチ自動生成で、チームが蓄積した脆弱性を迅速に整理するのを助けます。結果はSARIFファイルやCodeQLクエリで他のツールに取り込め、Codex CLIと組み合わせて自動化パイプラインを回せます。
Patch the Planet:オープンソースの修正を本当に届ける
脆弱性の発見も重要ですが、世界を本当に守るのは修正を届けることです。Patch the PlanetはOpenAIとTrail of Bitsの共同発起で、HackerOne、Califと協力しながら、専門のセキュリティリサーチャーに資金を提供してCodex Securityと上位モデルを装備させ、オープンソースのメンテナーと直接協業してもらいます。
プロジェクトの核は専門家レベルの人手によるセキュリティレビューです。現実は厳しく、広く使われているオープンソースプロジェクトの**94%**では、1年間の新規コードの90%以上を10人未満の開発者が保守しています。AIは脆弱性発見を速くし、その結果メンテナーに何千何万というレポートを押し付けることになる——しかも大半は低品質な誤検知です。

第1弾として30以上のオープンソースプロジェクトが参加済み。cURL、Go、Python、Sigstore、pyca/cryptographyを含みます。
仕組みはこうです:リサーチャーはメンテナーへの提出前に重複除去と検証を済ませ、ノイズの山ではなくきれいなパッチをメンテナーの前に届けます。プロジェクトに参加すると、ChatGPT Pro、Codex Securityへの条件付きアクセス権、そしてコア開発・自動化・リリースワークフロー向けのAPIクレジットが得られます。
最初の5日間スプリントでは、すでに19プロジェクトで数百件のレビュー待ち問題が浮かび上がり、数十のパッチがマージされました。
横で発覚した気まずい問題:Codexログがディスクに猛烈に書き込む
注目すべきことに、同じ日にCodex自身から「エピック級のバグ」が発覚しました。複数の開発者の報告によると、Codexはストリーミングタスクや長時間実行の際、約5MB/s(実測ピーク16MB/s)の速度でローカルの~/.codex/logs_2.sqliteへTRACEログを猛烈に書き込み続け、1年間の推定書き込み量は640TB——コンシューマー向けSSD1枚の公称書き込み寿命を使い果たすに十分な量です。
しかもこれは「サイレント」に起こります。ログが繰り返し書き込まれては削除されるため、ファイルサイズは一見平凡ですが、フラッシュメモリに実際に叩き込まれる書き込み量は見た目をはるかに超えます。関連issueは4月から存在するのに、コアの書き込みレート問題は今も未修正です。Codexを高強度で使う開発者は、自分のディスクの健全性をチェックしておくのが堅実な一手です。
誰に向くか
- 認可を受けた防御側 / セキュリティチーム:GPT-5.5-Cyberは認可済みの高度な防御業務向けで、信頼できるアクセス機構経由の申請が必要
- 開発チーム:GPT-5.5 + Codex Securityを日常の起点に、セキュリティエンジニアの能力をすべての開発者のワークフローに組み込む
- オープンソースメンテナー:Patch the Planetが専門家レビュー + パッチを提供し、AI時代に急増する脆弱性レポートに小さなチームが耐えるのを支援
- 企業向けセキュリティ製品プロバイダー:Daybreak Cyber Partner Program(セキュリティ大手30社近くが参加済み)経由でモデルの能力を自社製品に統合
💡 ヒント:大多数の防御側にとって、適切な始点はGPT-5.5 + Trusted Access for Cyber + Codex Securityです。GPT-5.5-Cyberは、検証済みで、より強い能力とより緩やかなモデル挙動を必要とする防御側向けであり、同時により強固な検証・監視・スコープ管理を併せて設ける必要があります。
Daybreak計画の入口:openai.com/daybreak(パートナープログラムは申し込み受付中)
関連記事

Qwen-Image-3.0:Alibaba Qwen の第3世代画像生成モデル
4.5k token の超長入力、10px 級の小文字までクリアにレンダリング、12言語に対応。ポスター、試験問題、コマ割り漫画などの複雑なレイアウトを一発で出力できます。

Qwen 3.8 で Reddit 自動の海外顧客獲得ワークフローを組む
8ステップ完全自動フロー: Apify で投稿取得、Qwen 3.8 が採点/執稿/自己審査/振り返り。260 件の投稿から 22 件のチャンスをふるい出し、コストは 10 分の 1 に削減。

Qwen-Audio-3.0-TTS:感情を表現できる音声合成モデル
アリババ Qwen の新世代 TTS モデル。タグで笑い・呼吸・怒りを制御でき、48kHz の映像級サウンド。Speech Arena で世界首位に立った実力を解説します。

Qwen3.8-Max プレビュー版をいち早く試す方法
2.4T パラメータの Qwen フラッグシップのプレビュー版が Token Plan、Qoder、Qwen 公式サイトに登場。公式は総合性能を Fable 5 次点としています。

SenseNova U1 Pro でパノラマインフォグラフィックを作ってみた
SenseTime のフラッグシップ多モーダルモデル U1 Pro の実践チュートリアル。生のデータを、納品可能な 8K インフォグラフィックと戦況パノラマ図へ自動変換します。

Claude for Teachers:全米 K-12 教師に無料で提供される AI チューティングアシスタント
Anthropic が米国の認定 K-12 教師向けに無償公開した AI アシスタント。50 州のカリキュラム標準と接続し、授業準備のアライメント、習熟度別の層別指導、生徒データ分析の 3 つの機能を提供します。