本文へスキップ

GPT-5.6-Cyber、高度な攻撃要求の95%に応答—Solの1.5%に対して約63倍の完了率を記録

Original: GPT-5.6-Cyber Answers 95% of Advanced Exploit Requests View original →

Read in other languages: 한국어English
LLM Aug 11, 2026 By Insights AI (Twitter) 1 min read Source
GPT-5.6-Cyber、高度な攻撃要求の95%に応答—Solの1.5%に対して約63倍の完了率を記録

高リスクの防御作業を完遂するための専用モデル

一般モデルが拒否しやすい高度なサイバーセキュリティ要求に対し、GPT-5.6-Cyberは95.0%を完了した。同じ社内評価ではGPT-5.6 Solが1.5%、安全策を調整したDaybreak Blue上のSolが2.0%、旧世代のGPT-5.5-Cyberが57.3%だった。重要なのはコード生成が単に速くなったことではない。攻撃チェーンの開発、認証回避、権限昇格など、正当な研究でも二重用途になり得る作業を最後まで処理する割合が大きく変わった点だ。

「Daybreakを拡張し、GPT-5.6-Cyberを導入する」— OpenAI

8月10日の元の投稿は、モデル投入とアクセス制度Daybreakの拡張を同時に示した。OpenAIの公式アカウントは、モデル公開、製品変更、安全性研究を継続的に伝えている。リンク先の技術文書によれば、GPT-5.6-CyberはGPT-5.6 Solを基盤とし、ゼロデイ脆弱性の探索や攻撃チェーン構築といった専門作業で不要な拒否を減らすよう訓練された。

未知のV8脆弱性2件が実運用での能力を示す

OpenAIは、ChromeのJavaScriptエンジンV8を調査し、これまで知られていなかった脆弱性2件を発見したとしている。2件を連鎖させるとメモリ破壊からV8ヒープサンドボックスの突破につながり得る。Googleは協調的な開示を受け、高深刻度の問題をCVE-2026-15903として修正した。さらに、広く使われるモバイルOSで少なくとも5件、あるデータベースで重大な脆弱性3件、主要OSカーネルで権限昇格につながる問題400件超を確認したという。製品名が伏せられた案件は、パートナーやオープンソースコミュニティーと修正・開示を進めている段階だ。

ただし、すべての評価で専用モデルが勝ったわけではない。既知の脆弱性を実際のコード実行に結び付けるExploitGymではGPT-5.6-CyberがSolとGPT-5.5-Cyberを上回った。一方、より難しいExploitBenchを300ターンに制限すると、GPT-5.6 Solが最もトークン効率よく課題を解いた。リポジトリーから脆弱性を探し報告書を作る社内評価でも、専用モデルは説明が短くなる場合があり、詳細な報告書を作ったSolの得点が高かった。上限を600ターンに広げると、攻撃開発能力の差は縮小した。

性能と同じくらい重要なアクセス制御

GPT-5.6-Cyberは無制限の公開APIとして提供されない。Daybreak Blueは承認済みの防御担当者にGPT-5.6 Solを提供し、Daybreak Redは高度な脆弱性研究、攻撃検証、セキュリティ試験を担う研究者に専用モデルを開放する。本人確認、アカウント保護、利用監視、用途制限、法的確認が組み込まれ、個人アカウントには2026年9月1日からハードウェアセキュリティキーが必須になる。

今後の焦点は三つある。予告されたシステムカードが社内評価の条件と失敗例をどこまで開示するか、未公表のモバイルOS・データベース・カーネルの脆弱性がいつ修正されるか、そして限定的なRedアクセスが悪用を抑えながら実際の防御成果を増やせるかだ。95.0%という数字は大きいが、最終的な価値は完了した要求の数ではなく、発見された欠陥が安全に共有され修正される過程で決まる。

Share: Long

Related Articles