用語解説 / 第2章 生成AI(ジェネレーティブAI) / データセット

データセットとは

学習のために集めたデータのまとまりのこと。

生成AIパスポート公式シラバス(2026年2月試験より適用)第2章「生成AI(ジェネレーティブAI)」の収載語です。

まず1問、解いてみる

答えを開く前に、自分の言葉で説明してみてください。

AIの学習のために集められた、大量のデータのまとまりを何と呼ぶ?

  • Aデータセット
  • Bパラメータ
  • Cコンテキスト
  • Dアーキテクチャ
答えと解説を開く

正解A データセット

答えはデータセット。AIの学習のために集めた、データのまとまりのことです。たとえばGPTモデルは、インターネット上の膨大な文章のデータセットで事前学習されています。データの質と量は、できあがるAIの出来を大きく左右します。

この問題を含む一問一答で続きを解く

同じ選択肢に並んだ語(区別して覚える)

当サイトの問題で、データセットと同じ選択肢の欄に並んだ語です。

  • アーキテクチャ=モデル全体の構造の設計(設計図)のこと。
  • パラメータ=学習で調整されるモデル内部の数値。モデルの知識量の目安としても使われる。
  • 学習済みモデル=学習を終えて、そのまま使える状態になったAIの中身。
  • 特徴量=AIが判断の手がかりにする、データの性質を数値にしたもの。
  • エキスパートシステム=専門家の知識をルール化し、コンピューターに判断させる仕組み。
  • ハイパーパラメータ=学習の進め方を、人があらかじめ決めておく設定の値。
  • 重み=入ってきた情報をどれくらい重視するかを表す、学習で調整される数値。

ありがちな誤解と訂正

当サイトの問題「AIの学習のために集められた、大量のデータのまとまりを何と呼ぶ?」の誤答の選択肢から。

×パラメータ

パラメータ=学習で調整されるモデル内部の数値。モデルの知識量の目安としても使われる。

この問題の正解=「データセット」

同じ問題に登場した語

当サイトでの登場(実測)

当サイトの問題バンク321問のうち、データセットは4問に登場します。 内訳=意味を直接問う問題1問・ひっかけ役(誤答の選択肢)3問。

登場した単元=第1章 AI(人工知能)・第2章 生成AI(ジェネレーティブAI)

※この数字は当サイトの問題バンク内の集計です。本試験の出題頻度ではありません。

演習に進む

用語の選定=GUGA「生成AIパスポート試験シラバス」(2026年2月試験より適用)収載の詳細キーワードに準拠。 定義・解説・問題=すべて当サイト(パスポーン)が執筆したオリジナルで、この頁の文はすべて当サイトの問題データからの逐語です。 当サイトはGUGA非公認の独立した学習サイトです。

最終更新:(運営:Meritorious)