Axiosによると、両社は重大な脆弱性を素早く見つけて悪用できる新モデルについて、米下院国土安全保障委員会のスタッフに非公開説明を行った。AIリスク論は抽象的な未来論ではなく、インフラ防衛の現場課題へ寄っている。
#openai
RSSフィードOpenAIは、長い会話の流れに表れる暴力リスクも追跡し、BAN相当と判断すれば即座にアカウントを停止するとした。単発の拒否応答より一段重い、アカウント単位の執行へ軸足が移っている。
HNは今回のOpenAI記事を、ベンチマークの整理ではなく有名リーダーボードの事実上の終了宣言として読んだ。誰が何点を取ったかより、壊れたテストと汚染が評価をどこまで空洞化したかに関心が集まった。
HNはこの話を「AIがまた勝った」ではなく、人間が見落としていた道筋をモデルが指さした事例として受け取った。GPT-5.4 Proの粗い下書きを数学者が拾い上げて磨き直す流れこそが、スレッドの熱源だった。
重要なのは、発売時の宣伝ではなく外部コミュニティ評価でGPT-5.5の立ち位置が見えたことだ。Arenaによれば、GPT-5.5はSearch Arenaで2位、Expert Arenaで5位、Code Arenaで9位に入り、コード分野ではGPT-5.4から50ポイント伸びた。
重要なのは、エージェント開発の律速段階がモデル速度ではなく人間のコンテキスト切り替えにあるとOpenAIが明言した点だ。OpenAIによれば、Symphony導入後は一部チームでマージ済みPRが500%増え、開発者が無理なく扱えるCodexセッションはおおむね3〜5本だった。
AI業界の基幹契約が組み替えられた。Azureの先行提供と長期IPアクセスは残る一方、OpenAIはあらゆるクラウドで製品を売れるようになり、MicrosoftからOpenAIへの収益分配は止まる。
クアルコム $QCOMは4月27日12:52 UTC時点で$148.85となり、前日比$15.01高の約11.2%上昇となった。Ming-Chi Kuoが、OpenAIがQualcommとMediaTekとともにスマホ向けプロセッサーを開発し、2028年量産を目指すと伝えたことが材料だ。
なぜ重要か。最先端のコーディングモデルでは公開ベンチマークだけでは体感差が見えにくくなっているからだ。CursorはGPT-5.5が自社評価のCursorBenchで72.8%の首位に立ち、5月2日まで価格を50%下げると書いた。
HNはGPT-5.5を祝賀ムードより先に検算モードで迎えた。最初に問われたのは、どれだけ賢いかより、価格とコンテキスト帯、そしてコーディング時の振る舞いが本当に改善したのかだった。
重要なのは、旗艦modelが製品デモから実装対象へ変わったことだ。OpenAIのdeveloper accountはretry削減を強調し、公式release pageは1M contextと新しいAPI pricingを示している。
OpenAIが狙っているのは会話品質の小幅改善ではなく、長時間タスクの自動化だ。公開値ではGPT-5.5がTerminal-Bench 2.0で82.7%に達し、GPT-5.4を7.6ポイント上回り、Codexではより少ないトークンで動くとされる。