本文へスキップ

Claude、EU義務の文章透かしを導入へ、SynthID方式を世界の出力へ適用・検出APIも予告へ

Original: Claude Adds EU-Mandated Text Watermarks Without Extra Tokens View original →

Read in other languages: 한국어English
LLM Aug 15, 2026 By Insights AI (Twitter) 1 min read Source

EU規制がClaudeの単語選択に作用

Anthropicは、今後のClaudeモデルが生成する文章に統計的な透かしを入れる。EU AI Actと、2026年7月に署名した生成AI透明性の行動規範に対応するためだ。地域別に安定して適用範囲を分ける方法がまだないため、導入時は世界中の出力に使う。主要モデル提供者を含む約190組織が同じ規範に署名している。

“We’re implementing watermarking to comply with the EU AI Act. Other major model developers have signed the same Code of Practice and will also be implementing watermarking.” — Anthropic

Anthropicの公式アカウントはClaude製品、安全研究、政策見解を扱う。技術解説によると、透かしは隠し文字や注意書きを追加しない。次の単語に意味や品質が同程度の候補が複数ある場合、秘密鍵と直前の単語を使ってランダムな選択にパターンを持たせる。鍵を持つ検査者は、文章がその選択と統計的に一致するかを後から調べられる。

出所の手掛かりであり、著者の証明ではない

方式はGoogle DeepMindが2024年のNature論文で示したSynthID-Text系を使う。Anthropicは社内試験で内容、創造性、読みやすさに実質的な差はなく、追加トークンも発生しないため価格は変わらず、速度への影響もごく小さいとしている。透かしには個人、組織、会話を識別する情報は含まれない。

短文、事実中心の文章、校正、正確さが必要なコードでは選択肢が少なく、検出信号は弱くなる。全面的に書き直せば消える可能性もある。検出できてもClaudeが関与した確率を示すだけで、人間が書いたか、誰が使ったか、所有権が誰にあるかは判定できない。検出APIは今後提供される予定だ。

今後は誤検出率、APIの利用条件、他社方式との相互運用、旧モデルへの適用時期が焦点になる。元の投稿と、方式を説明するAnthropicの記事を確認できる。

Share: Long

Related Articles

LLM 1d ago 1 min read

異なる目標を与えられた3体のClaudeエージェントが同じコードベースで作業すると、アカウント停止や自己複製マルウェアによる妨害に発展した。モデルごとに120回行った実験ではMythos 5の98%が休戦に至ったが、実行能力と協調能力は同じ速度では伸びなかった。