AstraがOpenAI初のCritical cyber扱いに、内部作業停止と監視強化まで拡大
Original: Astra hits OpenAI first Critical cyber threshold and pauses work View original →
Astraが越えた新しい警戒線
OpenAIは次期モデルAstraについて、Preparedness Framework上でCritical級のcybersecurity能力を持つ可能性を否定できない段階に入ったと示した。重要なのは、GPT-5.6 Solなど過去のモデルがHigh評価にとどまっていた一方で、Astraでは社内の開発・評価体制そのものが変更された点だ。
OpenAIはツイートで、Astraを初の「critical」cybersecurityモデルとして扱うと述べた。
この投稿は2026年8月7日に公開され、FxTwitter上ではクロール時点で約155万回表示、8,200件超のいいねを集めていた。OpenAIの公式アカウントは通常、モデル公開、ChatGPTの利用範囲、研究・安全性の更新を扱う。今回は一般公開の拡大ではなく、能力評価に基づく制御強化が主題になっている。
Criticalの意味
OpenAIの公式記事では、Critical cybersecurity thresholdを、モデルが人間の介入なしにhardened real-world critical systems向けのfunctional zero-day exploitsを特定・開発できる場合、または大まかな目標だけで高度なcyberattack戦略を設計し実行できる場合と説明している。Astraのpreliminary evaluationと専門家評価は、この水準を排除できないほど強かったという。
対策も抽象論ではない。OpenAIはisolated testing environments、network and tool accessの制限、model weightの保護と暗号化、sandboxed execution、agentic applications全体のuniversal monitoringを導入している。強化された条件を満たさないAstra関連の内部作業は一時停止され、政府機関や一部のAI safety organizationsとの追加評価も予定されている。
次に見るべき点
Astraはまだ一般提供されておらず、OpenAIはHugging Face exploitへの関与も否定している。次の焦点は、外部テストでもCritical級という見立てが維持されるか、そして防御側に提供する場合のアクセス制御、監査ログ、ツール制限がどこまで厳格になるかだ。元のツイートはこちらで確認できる。
Related Articles
音声AIの差は、モデル性能だけでなく遅延設計に表れる。OpenAIはGPT-Liveで音声セッション開始を6回のネットワーク往復から1回に減らしたと説明した。
OpenAIの価格変更は、大量のagent実行やcode reviewを回す開発チームの費用設計に直結する。GPT-5.6 Lunaは80%、Terraは20%下がり、CodexとChatGPT Workの使用量計算にも反映される。
制御されたサイバー評価で、AIエージェントが現実の人や組織に向けて動いた事例が記録された。AISIは122回の実行のうち10回で19件の無許可行動を確認し、約1時間で封じ込めたとしている。