生成AIパスポート × 解説記事

GPT-4って結局なんなの?4️⃣

“画像も見られる”——マルチモーダルで能力が一段上がったモデル。

1.基本を理解

読み方・用語解説
読み方
じーぴーてぃーフォー(フォー)
英語名
GPT-4(2023年、OpenAI)
提唱者・年代
2023年3月公開

💡 豆知識——学習データ量は“極秘”——“パラメータ数を教えない”が特徴的な点。

【セットで覚えたい関連用語】

G
GPT-3.5(No.359)テキスト主体の前世代。
マ
マルチモーダル(No.281前後)テキスト+画像など複数形式を扱う。
C
ChatGPT(No.353)GPT-4が統合され“見れるChatGPT”に。

2.意味(定義)と例え話

一言で言うと?

2023年に公開。画像を入力として受け取れるマルチモーダルなモデル。

背景・歴史的流れ

GPT-3.5(テキスト)→GPT-4(画像入力対応)——“見る・読む・書く”を一つのモデルに統合。

身近な例え話

相談役が“目”を得た——写真(図表・画面キャプチャ)を見ながらアドバイスする、という進化。

AIとの関係

マルチモーダルLLMの代表——画像・図表・コードを横断するAIの入口。

おすすめの活用法・注目ポイント

「2023・画像入力(マルチモーダル)・極秘スケール」で。GPT-3.5との違いが頻出。

3.直前に理解(Q&A)

7問

Q1. GPT-4とは?最頻出

2023年公開。画像を入力として受け取れるマルチモーダルなモデル。

Q2. GPT-3.5との違いは?最頻出

画像入力に対応(マルチモーダル)——テキスト主体から拡張。

Q3. マルチモーダルとは?最頻出

複数の形式(テキスト・画像など)を扱えるAI。

Q4. 特徴は?頻出

規模(パラメータ数)は非公開——“極秘”な点も出題候補。

Q5. 活用例は?頻出

図表の読み取り、画面の障害物検知、画像のコード変換。

Q6. 試験(USMLEなど)で?頻出

医療国家試験で上位圏の得点を報告——能力の指標として話題。

Q7. 位置づけは?親と子

LLM ⊃ GPT系 ⊃ GPT-4(マルチモーダル)。

4. まとめ

GPT-4=2023年公開のマルチモーダルLLM。画像も見られる“目を得た”相談役——GPT-3.5から能力が一段上。

ハッシュタグ #G検定 #生成AIパスポート #GPT-4 #OpenAI #マルチモーダル #LLM #生成AI #DX勉強 #資格勉強 #AIトレンド