【G検定過去問風テスト】シングルモーダルとマルチモーダルの違い

※本記事では、アフィリエイトプログラムより教材を紹介しています。

📝 問題

テキスト(文字)、画像、音声、動画など、種類(モダリティ)の異なる複数のデータを組み合わせて統合的に理解・処理するAI技術として、最も適切なものを1つ選べ。

  • A)シングルモーダルAI
  • B)マルチモーダルAI
  • C)エキスパートシステム
  • D)強化学習モデル
🔍 ここをクリックして正解を見る
  • 正解: B)マルチモーダルAI

💡 合格に近づく!徹底解説

  • 重要度: ★★★

■ 1分で分かる!この問題の要点

  • シングルモーダル: 1種類のデータ(テキストだけ、画像だけなど)を扱うAI。
  • マルチモーダル: 2種類以上の異なるデータを組み合わせて同時に処理するAI。

■ 初学者向け解説(例え話や背景)

人間の感覚に例えると分かりやすいです。文字を読むだけで会話する従来のAIは、いわば「文字のやり取りだけでコミュニケーションを図る人」(シングルモーダル)のようでした。それに対し、現在の最新AIは、目で見たり、耳で音を聞いたり、言葉を話したりといった「五感を同時にフル活用して世界を理解する人」(マルチモーダル)へと進化しています。この大きな違いがAIの応用範囲を劇的に広げました。


■ 選択肢の解説

  • A) シングルモーダルAI(×): テキストだけや画像分類だけなど、1種類のモダリティのみを扱うAIのことです。
  • B) マルチモーダルAI(○): テキストや画像、音声など、異なる複数のモダリティを組み合わせて統合的に処理する技術です。正解です!
  • C) エキスパートシステム(×): 専門家の意思決定ルールをプログラム化して問題解決を行う、第2次AIブームで登場したシステムです。
  • D) 強化学習モデル(×): エージェントが環境との相互作用を通じて、試行錯誤しながら報酬が最大化する行動を学ぶ機械学習の手法です。

👉 次の問題&解説テキスト

お疲れ様です!
この調子で次の問題に挑戦しますか?
それとも、立ち止まって詳しい解説を確認しますか?