LLM X/Twitter Apr 16, 2026 1 min read AnthropicのOpus agent、weak-to-strong監督の差を97%まで回復 alignment研究そのものをAI agentが進める実験に、具体的な数字が出た。AnthropicはClaude Opus 4.6がweak-to-strong supervisionの性能差を97%まで回復したとしている。 #ai-safety#alignment#claude 22