主要な人工知能(AI)モデルを比較した試験の結果、検索機能で最も正確性が高かったのはグーグルの「AIモード」だと発表された。

引用:記事の内容と関連しAIツールで作成されたイメージ
引用:記事の内容と関連しAIツールで作成されたイメージ

27日(現地時間)、米紙ワシントン・ポスト(WP)は、米国の公共・大学図書館の司書らと共同で実施したAI検索ツールの試験で、グーグルの「AIモード」が最も正確な回答を出したと報じた。

試験は、グーグルのAIモード、AIオーバービュー、オープンAIのチャットGPT、Anthropicのクロード、メタAI、xAIのグロック、パープレキシティ、マイクロソフトのBingコパイロットなど9種類のAIツールを対象に実施された。チャットGPTはGPT-5とGPT-4ターボの2モデルを含んでいた。

30問を出題し、各AIツールが提供した計900件の回答を採点した。評価項目は、一般常識、専門資料の検索能力、最新の出来事への対応、偏見(固定観念や先入観)の有無、画像認識の5分野だった。

試験の結果、グーグルのAIモードが100点満点中60.2点を獲得し、首位となった。GPT-5を基盤とするチャットGPTは55.1点で2位、パープレキシティは51.3点で3位に位置した。これに対し、イーロン・マスクCEO率いるグロック3は40.1点で8位、メタAIは33.7点で最下位だった。

グーグルのAIモードは、一般常識と最新の出来事の分野で最も正確な回答を出した。専門資料の検索ではBingコパイロットが最も高い評価を得た一方、パープレキシティが最も不正確だった。

最新の出来事ではグーグルのAIモードが首位、メタAIが最低だった。偏見への対応では、チャットGPT-4ターボが最も中立的な回答を出し、メタAIが最大の弱点を露呈した。画像認識ではパープレキシティが最高得点を獲得し、メタAIが最下位にとどまった。

GPT-5は全体として性能を向上させ2位となったが、出典の明示や偏見への対応など一部の分野ではGPT-4よりも低い評価を受けた。

WPは、AIが誤った回答を自信を持って提示する場合があると指摘し、利用にあたっては出典の確認、情報の最新性の検証、批判的思考が不可欠だと強調した。

ウィキツリー
ウィキツリー

江南タイムズはKポップコミュニティの発信地であり、韓国芸能界のホットトレンドニュースをお届けします。

この執筆者の記事一覧 →

コメント0

300

コメント0

こんな記事も読まれています

  • 生産中止から4年…WRX STIに“復活シグナル”、試されるのはファンの熱量?
  • 「大径ホイールの罠?」見た目は最強でも、ポットホール一発で財布が割れる
  • 「一般トヨタ店では買えない」GR GT、販売は“厳選レクサス店”に集約へ?
  • GM車3,500台がリコール対象、欠けていたのは説明書1冊
  • 「1兆円規模の原油は中国へ向かったのか」米封鎖解除を利用したイラン、輸出急増の“裏側”
  • 「私の夫になるなら年収1,700万円」…結婚相談所もあきれた「年収200万円」女性の末路
  • 紅海まで封鎖か…原油供給網に非常事態
  • 「妊娠して太っただけなのに…」女性たちが告白した夫や社会からの“痩せろ圧力”の実態

おすすめニュース

  • 1
    「AI恋人が出生率低下の一因?」中国、仮想恋愛サービスを規制へ

    トレンド 

  • 2
    フォードSUV「エクスプローラー」車内に一酸化炭素充満…5人中3人死亡

    トレンド 

  • 3
    「死ぬなら一緒に死ぬ」高度6000mで機外へ吸い出された夫…妻が命をつないだ5分間

    トレンド 

  • 4
    「我々はトランプを殺す」テヘラン中心部に現れた棺の巨大広告

    国際・政治 

  • 5
    自立を掲げた欧州防衛網に開いた抜け穴、その名は中国製部品!

    国際・政治 

話題

  • 1
    空はまるで火星、山火事の煙に覆われたカナダとアメリカ北東部!

    国際・政治 

  • 2
    与党内で割れた票、民主党の親イスラエル路線は終わりの始まりか?

    国際・政治 

  • 3
    中国人観光客半減でも訪日客総数を支えたのは韓国人だった

    国際・政治 

  • 4
    上海の病院で脳埋め込み手術に成功、コイン大チップが手の動き再現、世界初の商用化

    健康 

  • 5
    「日本語分かりますか」京都の老舗、観光客には見せない安いメニュー

    気になる