本文へスキップ

Reasoning Model(推論モデル)

この記事は6で読めます

ざっくり言うと

Reasoning Model(推論モデル)とは、答えを返す前に、内側で考える時間を取るタイプのLLM(大量の文章を学習した言語モデル)です。

ふだんのチャットAIが暗算でパッと答える人だとすれば、推論モデルは紙に書いて計算してから答える人にあたります。

数学やコード、込み入った手順の問題にぐっと強くなる代わりに、返事は遅くなり、費用も増えます。

推論型モデル、熟考型といった呼び方も見かけますが、指しているものは同じです。

ただし、内側の下書きがそのまま全部見えるとは限りません。私たちに分かるのは、いつもより時間をかけて慎重に解いているらしい、というところまでです

イメージ

正確には

推論モデルとは、答えを書き出す前に、内部の推論ステップ(reasoning / thinking)へ計算リソースを使うよう訓練・設計されたLLMのことです。問題を一気に解かず、複数のステップに分けて解きます。

2024年以降、主要なAI各社が相次いでこのタイプを投入してきました。公式ドキュメントでの呼び方と説明は、次のとおりです。

提供元機能・シリーズ名公式の説明(要約)
OpenAIGPT-5.6 Solなどのreasoning models回答前にreasoning tokensを使い、計画・代替案の検討・複数ステップの問題解決を行うモデル群。ChatGPTでは対象プランのMedium / High / Extra HighをGPT-5.6 Solが担う
AnthropicClaude APIのThinking回答前に思考用の処理を行う機能。Opus 5では既定で有効になり、effortで思考を含む応答全体の深さを調整する
GoogleGeminiのThinking応答前に内部で推論ステップを生成し、複雑な問題ほど深く考えるよう設定できる機能

呼び名は会社ごとにばらばらです。それでも、答える前に内側で考えるステップを挟む、という方向は共通しています。

2026年7月27日に確認したClaude Platformの仕様では、Opus 5、Sonnet 5、Fable 5、Mythos 5などはThinkingが既定で有効です。Opus 5ではeffortlowからmaxまで選び、思考を含む応答全体へかける労力を調整します。

これはClaude API(プログラムからAIを呼び出す窓口)の仕様です。ふだん使うClaudeアプリで選べるモデルやモードは、契約プランや画面の提供状況によって変わります。

推論(Inference)とは別の言葉です

名前が似ていて混ざりやすいのが、推論(Inference)です。2つは、指しているものの種類が違います。

  • 推論(Inference)
    学習を終えたモデルが、入力から答えを計算する工程を指します
  • 推論モデル(Reasoning Model)
    答える前に内側で考えるステップを挟む、モデルの種類を指します

推論モデルが答えを書くときも、そこで動いているのは推論(Inference)です。名前は似ていても、片方は工程を、もう片方はモデルの種類を指しています。ここを押さえておけば、製品紹介やニュースを読むときに迷いません。

もともとは、人がプロンプトでお願いしていた

Chain-of-Thought(CoT・連鎖推論)は、人がプロンプトで「ステップバイステップで考えて」と頼むテクニックでした。推論モデルは、そうした段階的な問題分解に近い処理を、内部のreasoning / thinkingとして扱えるように設計されています。


  • 人が「ステップバイステップで考えて」と書き、モデルに途中式を出させていました

  • モデルが内側の推論ステップに計算リソースを使い、そのうえで答えます

OpenAIのAPIドキュメントでは、reasoning modelsは回答前にreasoning tokensを使い、複雑な複数ステップの課題やツール利用に強いモデルとして説明されています。

なお、APIでも、生のreasoning tokensがそのまま見えるわけではありません。対応モデルでは、要約として確認できる場合があります。

使う場面

こんな仕事のときに呼んでください

注意点

使い分けの目安はかんたんです。軽い仕事はふだんのモデルに、重い仕事は推論モデルに任せましょう。主要サービスでは画面上で切り替えられることが多いので、仕事の重さに応じて選んでください。

迷ったときは、まずふだんのモデルで短く試してみましょう。答えが浅い、条件を見落とす、計算が怪しい。そう感じたところで推論モデルへ切り替えると、無駄が少なくて済みます。

関連用語

やってみよう

よくある質問

Q. 推論モデルとは何ですか?
A. 答えを返す前に、内側で考える時間を取るタイプのLLMです。数学やコード、込み入った手順の問題に強くなる代わりに、返事は遅くなり、費用も増えます。
Q. 推論モデルと推論(Inference)は同じものですか?
A. 別の言葉です。推論(Inference)は学習を終えたモデルが入力から答えを計算する工程を指し、推論モデルは答える前に考えるステップを挟むモデルの種類を指します。
Q. 推論モデルは、どんな仕事に向いていますか?
A. すぐ答えがほしい仕事より、一度まちがえると手戻りが大きい仕事です。条件の多い比較、コードのバグ原因さがし、計算を含む判断、複数の資料の食い違いチェックなどが当てはまります。
Q. 推論モデルを使えば、答えは正しくなりますか?
A. 正しくなるとは限りません。じっくり考えても、元の知識がまちがっていれば結論もまちがいます。大事な数字・固有名詞・日付・法律は、発表元の公式ページで見比べてください。

公開: 更新: ✓ 公式情報と照合:

参考ソース

判断クイズ

遅くて高い推論モデルを、どの仕事で呼ぶか決められますか?

3問です。答えるとその場で解説が出ます。全問終えたら、「回答を記録する」で学習の記録に残せます。

1. 取引先へ送る短いお礼メールの下書きを頼みます。推論モデルへ切り替えますか?
2. 同僚に「推論モデルって、推論(Inference)を使うモデルのこと?」と聞かれました
3. 推論モデルにじっくり考えさせて、補助金の申請期限を調べてもらいました。次にすることは?

全問に答えると、回答を記録できます。

残るのは「答えたかどうか」だけで、正解数は保存されません。この端末の中だけに残り、別の端末には引き継がれません。

この教科書は無料で全文公開しています。仕事で使えるところまで進みたい方は、実習と資料がそろった生徒プランをどうぞ。

生徒プランを見る(14日間無料)

あわせて読みたい