AIが推奨する「最高のソフトウェア」、実は機械が書いた偽物かも?

膨大なデータページが生成されるデジタル環境を形象化したイメージ
AI Summary

わずか3つのウェブサイトがAI検索エンジンを標的に、21万ページを超える「最高のソフトウェア」ページを大量生産しており、Perplexityがそれを根拠に回答を提供している事実が明らかになりました。

想像してみてください。あなたは新しいプロジェクトを開始し、「最高の業務管理ツール」は何かを、AIベースの回答型検索サービスであるPerplexityに尋ねます。AIは瞬時に、非常にそれらしい推奨リストを表示します。私たちは通常、AIが徹底的に検証されたデータに基づいて回答すると信じているため、この推奨をそのまま信頼して選択しがちです。しかし、もしあなたが読んでいるその「最高のソフトウェア」情報が、実は人間の経験が全く反映されていない、数十万の自動生成ページの一つだったらどうでしょうか?

最近、技術調査機関Trellnerの衝撃的な報告書が公開されました。わずか3つのウェブサイトが、AI検索エンジンの上位に表示されることを目的として、なんと215,128ページもの「最高のソフトウェア(best software)」推奨ページを大量生産していた事実が明らかになったのです [出典: 215128страниц «bestsoftware» для ИИ-поиска: отчёт Trellner]。

なぜこのようなことが起きるのか?

AI検索は情報収集の方法を完全に変えてしまいました。しかし今回の事件は、AIが私たちに提供する回答が、常に人間の「知性」に基づいているわけではない可能性を示唆しています。実際、PerplexityのようなAIプラットフォームがソフトウェアの推奨を行う際、引用する情報の約60%は訪問者数が非常に少ない、あまり知られていないウェブサイトから来ています [出典: 215128страниц «bestsoftware» для ИИ-поиска: отчёт Trellner]。

簡単に言えば、私たちが日常的に利用しているAIが、実力ある専門家の意見を聞いているのではなく、検索エンジンの弱点を突いて数十万ページを作成した「自動化された工場」のデータを、さも事実であるかのように根拠としている確率が高いということです。これは、AIが推奨する情報の質が、私たちが期待するものよりはるかに不透明である可能性があることを警告しています。

例えるなら

この現象を図書館に例えてみましょう。あなたが図書館で「最高の料理本」を探していると仮定します。書架に並んだ10冊の本のうち、6冊が実は料理をしたこともない人が書いた「偽物の本」だったらどうでしょうか?しかし、図書館の司書(AI)は、その本の内容が本物か偽物かを見極めず、ただタイトルがそれらしく、ページ数が多いという理由だけであなたに勧めているようなものです。

「検索エンジン最適化(SEO)」という技術を悪用し、キーワードを無差別に詰め込んだこうした「AI向けページ(made-for-AI pages)」には、人間の実際の経験や洞察は全く含まれていません [出典: Measure ChatGPT Visibility: Track LLM SEO Performance]。私たちはAIを賢い秘書として雇いましたが、その秘書はインターネット世界の無名の「広告看板」だけを読んで、私たちに回答しているのかもしれません。

現在の対応と限界

AI検索モデルごとにデータを扱う基準は少しずつ異なります [出典: Measure ChatGPT Visibility: Track LLM SEO Performance]。現在、Perplexityは広範なウェブデータに基づいて回答を構成していますが、その過程で380を超えるソフトウェアカテゴリーの情報が、訪問者数上位10万位以下のサイトから引用されています [出典: Hacker News – Telegram]。

幸いな点は、AIプラットフォーム側もこうした「ゴミデータ」を識別する技術を継続的に高度化していることです。人間の実際の経験や価値が乏しく、キーワードを詰め込んだだけのページは、徐々にAIプラットフォームでも信頼できない情報と見なされ、回答の根拠として採用されなくなる可能性が高いです [出典: Measure ChatGPT Visibility: Track LLM SEO Performance]。

AIを賢く活用する方法

今後は「誰がこの記事を書いたのか」という情報の出所が、より一層重要になるでしょう。単に検索結果の上位に表示されるだけでなく、実際のユーザーのレビューや、検証された専門家の分析が含まれた情報だけが、AI検索エンジンの回答窓口で生き残ることになります。

ユーザーである私たちにとって、AIが推奨した内容を盲信するのではなく、その回答の下部に付いた「引用元(citation)」をクリックして、どのサイトがこの情報を提供したのかを確認する習慣が不可欠です。AIはあくまでツールに過ぎず、そのツールが導き出した結果が真実かどうかを判断する最終的な責任は、依然として私たち自身にあるからです。

参考資料

  1. 215128страниц «bestsoftware» для ИИ-поиска: отчёт Trellner
  2. Measure ChatGPT Visibility: Track LLM SEO Performance
  3. Hacker News – Telegram
  4. Hacker News Mirror
  5. progscrape: trellner.com
  6. [Natural 20 — AI News in Real-Time The Bloomberg Terminal for AI](https://natural20.com/c/2px2gq)
AD
この記事の理解度チェック
Q1. 今回の報道で、AI検索サービスを標的に大量生成された「最高のソフトウェア」ページは合計で何ページですか?
  • 約10万ページ
  • 約21万5千ページ
  • 約50万ページ
報道によると、3つのウェブサイトが合計で215,128ページを生成しました。
Q2. Perplexityがソフトウェア推奨の根拠として使用する資料のうち、訪問者数ベースで10万位以下のあまり知られていないサイトの割合はどの程度ですか?
  • 約20%
  • 約60%
  • 約90%
調査結果によると、Perplexityによる推奨の約60%が、訪問者数ベースで上位10万位以内に入らないサイトから来ています。
Q3. AIプラットフォームはどのようなコンテンツを無視する傾向がありますか?
  • 人間の価値がない自動生成コンテンツ
  • 高品質なニュース記事
  • 有名なブログ記事
AIプラットフォームは、人間の実際的な経験や価値が乏しく、キーワードを詰め込んだだけのページは無視する可能性が高いです。