Anthropicは8月15日、8月上旬に導入を明らかにしていたClaude生成テキストの電子透かしについて追加の技術詳細を公開するとともに、透かしの有無を第三者が確認できる「検出API」を今後提供する方針を明らかにしました。対象は2026年8月2日以降にリリースされたClaudeモデルで、Claudeアプリ・Platform API・Claude Code・Claude Cowork・Claude Tagなど対応する全製品に共通して適用されます。
透かしの仕組みは、Google DeepMindが2024年に学術誌Natureで発表した「SynthID-Text」に近い手法を採用しており、文章生成時の単語選択における乱数の使い方に統計的なパターンを織り込むことで、文章の内容や品質、読みやすさを変えずに検出可能な痕跡を残すとしています。これまでは透かしの存在自体が明らかにされるにとどまっていましたが、今回新たに、Anthropic以外の第三者がテキストを提出してClaudeが関与した可能性を判定できる検出APIを用意する方針が示されました。
この取り組みの背景には、EU AI法のうちAI生成コンテンツの透明性を定めた行動規範(Code of Practice)第50条(2)があり、同規範は事業者に対し第三者による検出手段の提供を求めています。Anthropicは2026年7月に他社とともにこの行動規範に署名しており、検出APIの提供はその義務を満たす取り組みの一環と位置付けられます。
一方でAnthropicは、この透かしが「Claudeが関与した可能性が高い」ことを示せるに過ぎず、文章全体をClaudeが生成したのか一部編集にとどまるのかや、人間が書いたのか別のAIが生成したのかまでは判別できないと説明しています。また、短文や言い換えの選択肢が少ない事実列挙的な文章では検出精度が下がるといった限界も認めており、万能な仕組みではない点は従来の説明と変わっていません。
出典: TechCrunch



