LLM X/Twitter Apr 4, 2026 1 min read Anthropic、AIモデル間の行動差分を見つける“diff”ツールを公開 Anthropicは2026年4月3日、AIモデル間の行動差分を表面化させる新しいFellows研究を紹介した。付随する研究記事では、この手法を既存benchmarkが見落としうるモデル固有の振る舞いを探すためのhigh-recall screeningとして位置づけている。 #anthropic#model-diffing#ai-safety 32