AI 検索エンジン: 時間をかける価値はあるか? (ChatGPT、Perplexity、Gemini)

調査によると、お気に入りのチャットボットは検索ではパフォーマンスが低いようです。

私たちは皆、最近の AI ツールが多くのことを可能にしていることを知っています。しかし、これらのツールはインターネット検索にどれほど役立つのでしょうか?

それは重要な質問であり、多くの意味合いを伴います。なぜなら、Future(TechRadarの発行元)の調査によると、米国の回答者のほぼ3分の1が、Googleなどの従来の検索エンジンの代わりにAIを使用していると答えているからです。

ChatGPT や他のチャットボットに頼る人もいます。一方、Perplexity など、研究や調査用に特別に設計された AI ツールを使用する人もいます。私たちが AI ツールを積極的に選択しなくても、検索結果の上部に表示される小さな Google の概要のように、AI はいずれにしても検索に表示されます。

つまり、AI を活用した検索はどこにでもあるのです。しかし、本当の疑問は残ります。それは本当に良いことなのでしょうか?研究者たちはそのことを疑問に思い始めているが、最初の評価はそれほど良いものではないとだけ言っておきましょう。

人工知能技術、ビジネスマンがChatGPTに接続されたグローバルインターネットの仮想グラフを示しています。 AIとチャットします。

ChatGPT は新しい Google でしょうか?そんなに急がなくても...

人々は研究のために AI ツールを使用するかもしれません。しかし、そうすべきだというわけではありません。

最近のテストでは、OpenAI の ChatGPT、Google の Gemini、Anthropic の Claude、Perplexity AI という 4 つの優れた AI チャットボットを比較し、検索の処理能力を検証しました。

結果は…まちまちでした。完全な失敗というわけではなく、全員が何らかの関連情報を取得することに成功しましたが、正確さは高くありませんでした。そして、その情報をどのように要約したのでしょうか?それらは混乱を招いたり、役に立たなかったりすることがよくあります。

これらの結果は、トウ・デジタルジャーナリズムセンターが実施したより包括的なテストを裏付けるものであり、 コロンビアジャーナリズムレビュー。彼らのチームは、ChatGPT、Perplexity、Copilot、Grok、Gemini を含む 8 つの主要な AI モデルをテストし、「不正確な情報を自信を持って提示すること、共有コンテンツの帰属を誤解させること、一貫性のない情報検索方法」という繰り返し発生する問題を発見しました。ああ。

全体として、AI モデルは 60% を超えるクエリに対して誤った回答を提供しました。 Perplexity は最も正確でしたが (これは調査ツールとしてのマーケティングと一致しています)、それでも 37% の回答が間違っていました。 Grok のパフォーマンスは最悪で、失敗率は衝撃的な 94% でした。ノーコメント。

タオ センターは、完全に正解から完全に不正解 (または無回答) までの尺度で結果を評価しました。最悪の例のいくつかは、AI が単純に… 物事を作り上げてしまう、完全な幻覚です。しかし、答えが完全に間違っていなかったとしても、ツールがニュースや検索結果を再表示する仕組みには依然として大きな問題がありました。

情報源のない研究は研究とは言えません。

根本的な問題は、このように情報を再構成することにあります。 AI テクノロジーが誤った情報を提供しないとしても、役に立たない、そしてしばしば誤解を招くような方法でコンテンツを要約したり、再構成したりします。タオセンターは次のように説明しています。

「従来の検索エンジンは一般的に仲介者として機能し、ユーザーをニュースサイトや高品質のコンテンツに誘導しますが、生成検索ツールは情報を自ら分析して再パッケージ化し、元のソースへのトラフィックの流れを遮断します。」

「これらのボットのチャット出力は、情報の品質に関する深刻な根本的な問題を覆い隠すことが多い。これらのシステムがニュースコンテンツにどのようにアクセスし、表示し、引用するかを早急に評価する必要がある。」

最も明白な問題の 1 つは、AI ツールがソースを引用する頻度がいかに低いかということです。たとえば、ChatGPT は間違った記事にリンクしたり、Web サイトのホームページに移動したり、引用を完全にスキップしたりすることがよくあります。

これは主に 2 つの理由で問題となります。まず、コンテンツが使用されているにもかかわらず、パブリッシャーはトラフィックを失います。

第二に、事実確認が難しくなります。 AI の結果を検証する唯一の方法の 1 つは、元のソースを参照することですが、元のソースが提供されていない場合は、検証が難しくなります。

では、AI が明確な情報源なしで情報を提供してくれた場合、特に結局すべてを Google で確認することになるのであれば、それを研究に使う価値は本当にあるのでしょうか。そうではないかもしれない。

はい、AI ツールは常に改善されています。そして確かに、Perplexity のように、他のものよりもパフォーマンスが優れているものもあります。しかし、最高のものであっても、やはり人間の監督が必要です。現在、研究段階においては、ロボットは自律的に動作する準備ができていません。

トップボタンに移動