
Anthropic、EU AI法対応でClaudeにSynthIDウォーターマーク導入
今後のClaudeモデルには、トークンを追加するのではなく、シークレットキーを用いて単語の選択にバイアスをかける「SynthID-Text」ウォーターマークが導入される。これにより追加のサービングコストは発生せず、ウォーターマークの有無による回答を比較した評価者も品質の差を認めなかった。この手法は実用的だが適用範囲は限定的だ。短いサンプル、厳密な事実に基づく文章、軽い推敲、そしてコードでは検出精度が低下し、全体を書き直すとウォーターマークは消えてしまう。検出APIの提供が予定されており、他のAI企業も同じEUの行動規範に署名している。そのため、AI生成物の出所証明は、単一の普遍的なテストではなく、長文のAIテキストに対するベンダーごとのキーに落ち着きつつある。
出典: anthropic.com ↗
透かしは、生成されたテキスト全体で何度も発生する、こうした小さな選択を利用して、Claudeの応答にパターンを残す。
Anthropic
なぜ重要か
- → EU AI Act準拠がClaudeのテキストに大規模に組み込まれた。
- → 編集された箇所、コード、事実記述では検出が困難になり、万能な証拠ではない。
- → 汎用的な検出よりもベンダーごとの透かしが業界標準として定着しつつある。
トークンではなくテキストの指紋認証