気になったワードを調べてみよう①【透かし編】
九月に入ってから、AIをネタにしたエッセイが増えたと思う。
エッセイジャンルでいくつもランクインしているのを見る限り、AIは現在書き手読み手両方に関心があるテーマなんだろう。まあそういう自分も書いているわけだけれど。
そして、それらの作品を読むとこういうワードに時々当たる。
「機械」
「透かし」
「AI〇%判定」
機械て。
100%間違いとは言わんけどAIはハードやのうてソフトやで。PC上で高度な情報処理ができる仕組みや。PCのほうがハードいうか機械なんや。
まあこれはいい。イメージ的に電力で動く人工物すべてが〝機械〟判定なのかもしれんし。知らんけど。
〝透かし〟や〝AI〇%判定〟はこういう使われ方をしている感じ。
「AI使うとデータに〝透かし〟とかついてわかるようになってるんでしょう? それでAIを使った小説をなろうで判定・検出して、ランキングとかで分離できたらいいな」
「データをAIチェッカーにかけると「AI生成率70%です」と出てくる」
文章自体はどう書こうと作者の自由なのでまったく問題ない。技術的なワードと願望をふんわり混ぜたような文章だと「これエビデンスあるのかな?」と思うことはあるけれど。
気になるのは技術的ワード。現実に存在するのか、実現可能なのかを検証したくなってしまう。
検証できそうなところをざっくり分離してみると、
・透かし
・AI使用小説の判定・検出
・なろうで分離
というところか。
このあたりの技術的なことは知識がないので、AIにソース付きの資料を出してもらって確認していく。以下は自分が資料を見ながらまとめたものになる。
(かなり端折っているので、興味のあるかたは是非検索してみてほしい)
* * *
まず〝透かし〟の話から。
〝透かし〟とはなんぞや?
推測するに、技術用語の〈digital watermark〉と思われる。
画像・音声などのデータ中に人の目には見えない(不可視)情報(信号)を付与して、対応する検出方法で存在を確認するもの。なので〝透かし〟と表現すると実態とは少し離れる感がある。どちらかというと「不可視信号」と表現するほうが近いかもしれない。
ただめんどくさいんでここは〝透かし〟としておく。
で、この技術。
調べた限りでは、Googleが開発した〈SynthID〉系の技術を、 OpenAI(ChatGPT他)、Anthropic(Claude)などのAI事業者がそれぞれ別の形式・実装で採用しているようだ。
ここで各技術について解説。
・C2PA Content Credentials
データの来歴を記録した暗号署名付き証明書。
データ〝ファイル〟に来歴情報を付与する仕組みなので、〝対応ツール〟で編集した場合は情報を足して引き継ぐことができる。コピペでテキストだけ取り出した場合はC2PAの情報はついてこない。
写真を例に取ると「〇〇のカメラで撮影され、〇〇の編集ソフトで〇〇の編集をして現在の画像になった」のかが記録される感じで、署名された来歴情報が改竄・破損していないか後から検証することができる。
AI専用の技術ではない。
・SynthID
画像・音声データ自体に〝透かし〟を付与する仕組み。
Google DeepMindの技術で、Google AIが生成した画像には生成時に入るようになっている。
コンテンツ自体に情報を付与する仕組みなので、画像などは軽い編集や圧縮などをかけても情報が失われにくい設計。
検出もSynthIDで行う。
・SynthID-Text
SynthIDのテキストバージョン。(ややこしいので分離)
テキストの場合、SynthIDとは違い生成時の単語選択に統計的偏り(パターン)を入れる方式になる。
コピペでテキストだけ取り出した場合や軽い編集程度なら比較的耐えるが、大幅な書き換えや別言語への翻訳などの大規模編集ではパターンが大きく崩れるので検出の信頼度が下がる。
・text watermark
Claudeでテキストを生成する際、単語選択に使う乱数をウォーターマーク用の暗号鍵などに基づくものにすることで、単語列に意図的に作られた統計的なパターンを残して、それを後から検出できる仕組み。まんま同じではないけどGoogleのSynthID-Text方式をベースにしている。
SynthID-Textと同じようにコピペでテキストだけ取り出した場合や軽い編集では情報が残るが、大規模改変すると検出精度が著しく下がる。
では、各AI事業者の〝透かし〟の実装と検証の有無。
・OpenAI
ChatGPTなどで生成された画像・音声に〈C2PA Content Credentials〉と〈SynthID〉を併用している。
テキストは未実装。(対応予定はあるらしい)
OpenAIにテキスト以外のデータの中を確認できる検証ページがあるみたいだ。ただし100%検出できるわけではないとのこと。
Geminiで生成されたデータにはSynthID(テキストはSynthID-Text)が付与されている。
一般向けにSynthIDの検出器を公開していないので、付与された情報を調べる手段はない。
(SynthID Detectorという検証ポータルでは画像・動画・音声は検証できる。限定テスト中で一般未公開)
GeminiにデータをアップロードしてSynthIDの有無を確認することは可能。ただしテキストは不可能とのこと。
・Anthropic
Claudeで生成したテキストデータに〈text watermark〉が実装されているが、一般公開された検出器はない。
(検出器〈Claude Watermark Detection API〉自体はあって、政府機関など限定した組織には提供されているようだ。アンソロの場合米政府が提供先の規制かけてるし、一般公開の予定はあるらしいけど実現可能かどうか不明)
まとめると、
OpenAI(ChatGPT他):生成テキストデータへのC2PA・SynthID適用は未実装
Google (Gemini):生成テキストデータにSynthID-Text適用、検出器は未公開
Anthropic(Claude):生成テキストデータにwatermark適用、検出器は限定公開
となる。
♯「検出器」と書いているけど、これはソフトウェアであってハードウェアではないですよ。念の為。
* * *
〝透かし〟は存在する。
〝透かし〟はそれ専用の検出器とセットで運用されるもので、一つの検出器であらゆるAIの生成物を検出できるというものではない。
〝透かし〟は大規模編集に弱く、検出精度が落ちる。
テキストに関しては〝透かし〟自体が未実装、もしくは検出器が一般未公開だったりで、現状一般人レベルで運用できる〝透かし〟は「無い」
そして〝透かし〟の検出はそのデータの「AI使用の可能性」を示すというだけであって、そのデータが「100%AIで生成されたものである」と証明できるものではない。
AIに質問すると資料を出して解説してくれるのはありがたいんだけど、「さっきの表現は適切ではありませんでした」とか言って言い回しを変えたり、重要な情報を後出ししたりするから「結局何が正しいんだよ!」となることがある。何度書き換える羽目になったことか。
あと専門用語を多用するな、人の理解力を過信するな、と言いたい。言わないけど。
そして、なろうでは生成小説の観点で語られることが多いけれど、本来AIって「便利な道具」という言葉で片付けてはいけない怖い技術なんだよなー、とサイバー戦争系ニュースを見ると思い出す。
「AI〇%判定」は次回。




