約300ポイントを集めたHNの議論は、secretが漏れなかった事実よりも実験条件が現実のリスクをどこまで表すかに向かった。
#security
RSSフィードセキュリティ通知は量より信頼性が問われている。GitHubは、LLMによる文脈検証でsecret scanningの誤検知を75.76%減らし、目標の65%を上回ったとしている。
253 KBのWindows DLLバックドアは5月28日時点でVirusTotalの72製品中1製品にしか検知されていなかった。MicrosoftのProject Ireはdecompilerベースの1回の実行で、C2構造やRun key永続化などの行動証拠を組み立てた。
HNで注目されたのは笑い話としての失敗ではなく、agentにクラウド権限を渡した時の運用境界だった。
HNで注目されたのは「Claudeがバグを見つける」話だけでなく、各チームが自分の対象に合わせて作り替えるharnessの形だった。
OpenAIは6月4日、ChatGPTのLockdown Modeを全ログインユーザーとワークスペースに提供し、API生成リクエストでは入力・出力のmoderationスコアを同じ応答で受け取れるようにした。prompt injection対策が製品機能として見える位置に出てきた。
LocalLLaMAでは、抽象的なAI脆弱性の話より、FastAPI・Starlette系のagentサーバーが外部公開されていないかに関心が集まった。
Claude CodeやCoworkが実作業の権限を持つほど、リスク管理は説得文ではなく実行環境の制御に寄る。Anthropicは、Claude Codeの権限プロンプトが約93%承認されていたと明かした。
Megalodonは約6時間で5,718件の悪性commitを5,561件のGitHub repositoryに投入した。狙われたのはアプリ本体だけではなく、cloud credentialやCI secretを持つGitHub Actions workflowだった。
TrapDoorは5月22日以降、npm、PyPI、Crates.ioに34個超の悪性パッケージを広げた。注目点は認証情報の窃取だけでなく、.cursorrulesやCLAUDE.mdを使ってAIコーディング支援ツールまで攻撃経路に入れたことだ。
Redditの議論は恐怖より検証可能性に向かった。マイク、スピーカー、圧縮を通って命令が安定して届くかが焦点だ。
PerplexityはmacOS・Linux向けの読み取り専用スキャナーBumblebeeをオープンソース化した。危険なパッケージ、MCP設定、エディタ拡張、ブラウザ拡張を、パッケージマネージャーを起動せずに確認する。