主要な人工知能(AI)モデルを比較した試験の結果、検索機能で最も正確性が高かったのはグーグルの「AIモード」だと発表された。

引用:記事の内容と関連しAIツールで作成されたイメージ
引用:記事の内容と関連しAIツールで作成されたイメージ

27日(現地時間)、米紙ワシントン・ポスト(WP)は、米国の公共・大学図書館の司書らと共同で実施したAI検索ツールの試験で、グーグルの「AIモード」が最も正確な回答を出したと報じた。

試験は、グーグルのAIモード、AIオーバービュー、オープンAIのチャットGPT、Anthropicのクロード、メタAI、xAIのグロック、パープレキシティ、マイクロソフトのBingコパイロットなど9種類のAIツールを対象に実施された。チャットGPTはGPT-5とGPT-4ターボの2モデルを含んでいた。

30問を出題し、各AIツールが提供した計900件の回答を採点した。評価項目は、一般常識、専門資料の検索能力、最新の出来事への対応、偏見(固定観念や先入観)の有無、画像認識の5分野だった。

試験の結果、グーグルのAIモードが100点満点中60.2点を獲得し、首位となった。GPT-5を基盤とするチャットGPTは55.1点で2位、パープレキシティは51.3点で3位に位置した。これに対し、イーロン・マスクCEO率いるグロック3は40.1点で8位、メタAIは33.7点で最下位だった。

グーグルのAIモードは、一般常識と最新の出来事の分野で最も正確な回答を出した。専門資料の検索ではBingコパイロットが最も高い評価を得た一方、パープレキシティが最も不正確だった。

最新の出来事ではグーグルのAIモードが首位、メタAIが最低だった。偏見への対応では、チャットGPT-4ターボが最も中立的な回答を出し、メタAIが最大の弱点を露呈した。画像認識ではパープレキシティが最高得点を獲得し、メタAIが最下位にとどまった。

GPT-5は全体として性能を向上させ2位となったが、出典の明示や偏見への対応など一部の分野ではGPT-4よりも低い評価を受けた。

WPは、AIが誤った回答を自信を持って提示する場合があると指摘し、利用にあたっては出典の確認、情報の最新性の検証、批判的思考が不可欠だと強調した。

ウィキツリー
ウィキツリー

江南タイムズはKポップコミュニティの発信地であり、韓国芸能界のホットトレンドニュースをお届けします。

この執筆者の記事一覧 →

コメント0

300

コメント0

こんな記事も読まれています

  • 生産中止から4年…WRX STIに“復活シグナル”、試されるのはファンの熱量?
  • 「大径ホイールの罠?」見た目は最強でも、ポットホール一発で財布が割れる
  • 「一般トヨタ店では買えない」GR GT、販売は“厳選レクサス店”に集約へ?
  • GM車3,500台がリコール対象、欠けていたのは説明書1冊
  • 「全面戦争の瀬戸際」米軍が7日連続でイラン空爆…広がる報復の連鎖
  • 「主役の座を狙った代償か」トランプ氏のW杯行動が波紋…FIFAが下した“静かな判断”
  • フーシ反乱軍、サウジに海上封鎖を宣言
  • プーチンのお膝元に緊張走る…モスクワ近郊を襲ったドローン攻撃

おすすめニュース

  • 1
    自立を掲げた欧州防衛網に開いた抜け穴、その名は中国製部品!

    国際・政治 

  • 2
    空はまるで火星、山火事の煙に覆われたカナダとアメリカ北東部!

    国際・政治 

  • 3
    与党内で割れた票、民主党の親イスラエル路線は終わりの始まりか?

    国際・政治 

  • 4
    中国人観光客半減でも訪日客総数を支えたのは韓国人だった

    国際・政治 

  • 5
    上海の病院で脳埋め込み手術に成功、コイン大チップが手の動き再現、世界初の商用化

    健康 

話題

  • 1
    「日本語分かりますか」京都の老舗、観光客には見せない安いメニュー

    気になる 

  • 2
    欧州がウクライナに派兵すれば即攻撃対象に?ロシアが最後通牒

    国際・政治 

  • 3
    「習近平の方がマシ?」米国の同盟国まで中国支持に回った?好感度調査で逆転

    国際・政治 

  • 4
    「捕れるほど赤字になる?」クロマグロ急増、日本漁師を悩ませる“異例の事態”

    トレンド 

  • 5
    「日本人には理解しがたい」W杯惨敗で殺害予告、入店拒否まで…韓国中から追われた元代表監督

    スポーツ