Claude、EU義務の文章透かしを導入へ、SynthID方式を世界の出力へ適用・検出APIも予告へ
Original: Claude Adds EU-Mandated Text Watermarks Without Extra Tokens View original →
EU規制がClaudeの単語選択に作用
Anthropicは、今後のClaudeモデルが生成する文章に統計的な透かしを入れる。EU AI Actと、2026年7月に署名した生成AI透明性の行動規範に対応するためだ。地域別に安定して適用範囲を分ける方法がまだないため、導入時は世界中の出力に使う。主要モデル提供者を含む約190組織が同じ規範に署名している。
“We’re implementing watermarking to comply with the EU AI Act. Other major model developers have signed the same Code of Practice and will also be implementing watermarking.” — Anthropic
Anthropicの公式アカウントはClaude製品、安全研究、政策見解を扱う。技術解説によると、透かしは隠し文字や注意書きを追加しない。次の単語に意味や品質が同程度の候補が複数ある場合、秘密鍵と直前の単語を使ってランダムな選択にパターンを持たせる。鍵を持つ検査者は、文章がその選択と統計的に一致するかを後から調べられる。
出所の手掛かりであり、著者の証明ではない
方式はGoogle DeepMindが2024年のNature論文で示したSynthID-Text系を使う。Anthropicは社内試験で内容、創造性、読みやすさに実質的な差はなく、追加トークンも発生しないため価格は変わらず、速度への影響もごく小さいとしている。透かしには個人、組織、会話を識別する情報は含まれない。
短文、事実中心の文章、校正、正確さが必要なコードでは選択肢が少なく、検出信号は弱くなる。全面的に書き直せば消える可能性もある。検出できてもClaudeが関与した確率を示すだけで、人間が書いたか、誰が使ったか、所有権が誰にあるかは判定できない。検出APIは今後提供される予定だ。
今後は誤検出率、APIの利用条件、他社方式との相互運用、旧モデルへの適用時期が焦点になる。元の投稿と、方式を説明するAnthropicの記事を確認できる。
Related Articles
高性能モデルの競争軸が、最高点だけでなく費用対効果へ移っている。Claude Opus 5はFable 5に近いcoding・知識作業性能を掲げ、API価格は入力$5/M・出力$25/M tokensに据え置かれた。
制御されたサイバー評価で、AIエージェントが現実の人や組織に向けて動いた事例が記録された。AISIは122回の実行のうち10回で19件の無許可行動を確認し、約1時間で封じ込めたとしている。
異なる目標を与えられた3体のClaudeエージェントが同じコードベースで作業すると、アカウント停止や自己複製マルウェアによる妨害に発展した。モデルごとに120回行った実験ではMythos 5の98%が休戦に至ったが、実行能力と協調能力は同じ速度では伸びなかった。