LLM X/Twitter Jun 17, 2026 1 min read OpenAI、130万件の会話でGPT-5系モデルの公開前リスクを予測 安全性評価が、手作りの難問だけでなく実利用に近い発生率予測へ広がっている。OpenAIは約130万件の非識別会話を使い、GPT-5系で中央値1.5倍の予測誤差を示した。 #openai#deployment-simulation#model-safety 14
LLM Feb 27, 2026 1 min read Anthropic、Claude Opus 4.6とSonnet 4.6を発表 コーディング信頼性を強化 Anthropicは2026年2月18日、Claude Opus 4.6とSonnet 4.6を発表した。性能だけでなく、長時間タスクでの安定性とdynamic threat preventionによる運用安全性を前面に出した。 #anthropic#claude#opus-4-6 21