なぜ結果が読み取りにくくなったのか
生成画像は作成も公開も安価であるため、写真よりも速い速度でウェブ上に蓄積されます。ストックフォトサイト、コンテンツファーム、リストページ、ニュースアグリゲーターなどが、ラベル付き、あるいは多くの場合ラベルなしで公開しています。
検索エンジンは見つけたものをインデックス化します。画像は関連性、ページの権威、周囲のテキストに基づいてランク付けされますが、それらは画像がどのように作られたかを示していません。そのため、特定の主題の生成画像が、実在するすべての写真よりも上位にランク付けされることがあります。
これは、人々が実在のものの記録を求めているクエリにおいて最も重要です。歴史的な出来事、病状、野生動物、場所、製品、人物はすべて、説得力のある架空の画像が画像がないことよりも悪影響を及ぼすカテゴリーです。
これは、そもそも写真が期待されていないクエリではあまり問題になりません。イラストやコンセプト画像、背景を探している人は、生成された結果によって欺かれることはなく、むしろ好むこともあります。
ラベルが実際に証明していること
検索エンジンが画像をAI生成とマークする場合、そのマークは画像の分析からではなく、ほぼ常にファイル内のデータから来ています。生成ツールがマーカーを埋め込み、そのマーカーが残り、プラットフォームがそれを読み取ったということです。
そのため、ラベルは肯定的な信号としては強力ですが、否定的な信号としては無価値です。ラベルがある場合は、制作過程の何かが自らを宣言したことを意味します。ラベルがない場合は、ファイルが単に宣言を運んでいないだけであり、これはウェブ上の圧倒的多数の画像に当てはまります。
| 生成であることを証明する | 写真であることを証明する | 一般的 | |
|---|---|---|---|
| AIラベルが表示されている | Yes マーカーが残っている | No | No 実際には稀 |
| ラベルが表示されていない | No 何も言及していない | No 何も言及していない | Yes ほぼすべての画像 |
| Content Credentialが存在する | Yes 暗号的 | Yes カメラが署名した場合 | No ウェブ上では一般的ではない |
| フルファイルでのピクセルチェック | Partly 確実な証明ではなく、確率である | Partly 確実な証明ではなく、確率である | Yes ほぼすべてのものに機能する |
2行目が人々を誤解させる点です。ラベルのない検索結果ページは写真のページではありません。何も宣言しなかったページであり、それがウェブの通常の状態です。
実際のファイルにアクセスする
検索結果ページには検索エンジンが生成したサムネイルが表示されます。公開時の画像ではありません。サイズ変更と再エンコードによってチェックツールが読み取る要素の多くが失われ、本物の写真が尺度の上位へ押し上げられてしまいます。
-
ソースページを開く
結果グリッドから作業するのではなく、その画像を発行したサイトにアクセスしてください。
-
画像をフルサイズで表示する
ページに合わせて縮小されたバージョンではなく、公開されているファイルを確認するために、新しいタブで開いてください。
-
そのURLをコピーする
それを直接チェッカーに貼り付けてください。これにより、保存と再エンコードのステップを自分で行う必要がなくなります。
-
スコアだけでなくマップを読む
写真の被写体と生成された背景を混ぜた合成画像は、単一の数値ではなく、分裂したヒートマップとして表示されます。
-
発行元を確認する
指定された写真家、代理店のクレジット、または日付付きのニュースページは、ピクセル分析では得られない裏付けとなります。
画像を再利用しようとしている場合
その画像を公開するものに使用する場合、状況は一変します。実際の出来事を説明するために記事やレポート、プレゼンテーションで使用された生成画像は、どれほど魅力的であっても事実誤認です。
これはライセンスの問題でもあります。生成画像の権利はいくつかの法域で未確定であり、検索エンジンで見つかった画像には、ソースページで許可されていない限り、ライセンスは一切ありません。検索結果は許可ではありません。
公開するあらゆるものについては、証拠能力について主張を行っている場所から調達してください:ポリシーを持つストックライブラリ、代理店、連絡可能な写真家などです。これはチェックのステップではなくワークフローの変更であり、拡張性のある唯一の方法です。
特に注意が必要なカテゴリー
歴史的画像や報道画像は、これによって最も大きな損害を受ける分野です。実際の出来事の生成画像が一度公開されてインデックス化されると、サイト間でコピーされ、元の文脈を失い、人々がその出来事を検索した際に見つけるものになってしまいます。
歴史的なものについては、検索からの前進ではなく、アーカイブへの遡行を行ってください。博物館、新聞アーカイブ、ライブラリのコレクションには、検索結果ページにはない管理の連鎖(chain of custody)があり、その連鎖こそが実際の証拠となります。
同じことが医療、科学、野生生物の画像にも当てはまります。もっともらしい架空の画像が誰かに真実ではないことを教える可能性があります。これらの分野ではピクセルよりも発行元が重要であり、ピクセルチェックは補足であって代用ではありません。
これが研究に与える影響
画像検索を研究ツールとして使用している人は誰でも、かつては信頼できた参照元を静かに失いました。場所、種、装置、医療プレゼンテーションを検索すると、その写真が返ってきましたが、今では混合した結果が返り、その混合は真実によって並べ替えられていません。
生成画像の方が写真よりも明確なことが多いため、この欠陥は巧妙です。器官のレンダリング図、珍しい鳥のきれいなイラスト、機械の整った画像は、実際の写真よりも読みやすい場合がありますが、専門家以外には見抜けない誤りを含んでいる可能性もあります。
教育や参照作業においては、修正はチェックの習慣ではなく、ソーシングのルールです。博物館、大学、機関、ジャーナルなど、コレクションを保有する機関から画像を取得してください。検索には時間がかかりますが、検索エンジンにはない「由来」を持っています。
カジュアルな利用においては重要度は低く、そうでないふりをするのは有用ではありません。スライドに貼るビーチの画像を探している人は、生成されたビーチであっても害を受けることはなく、検証の努力はそれが間違っていた場合の結果に従うべきです。