# モデルの選び方

> エージェントが使うモデルを選び、推論レベルを設定します。1つのメッセージに限って、その両方を切り替えることもできます。

すべての[実行](/ja/docs/work/runs/)は、モデルによって動いています。endue には複数のプロバイダーのモデルをそろえたカタログがあり、エージェントが使うモデルを選べます。既定のモデルとして設定することも、1つのメッセージだけに使うこともできます。

## 使いどころ

エージェントの*推論*に問題があるときに、モデルを変更します。長いタスクで手順を抜かしたり、本当に単純な作業なのに遅くて高くついたりする場合です。エージェントの仕事ぶりが悪いのではなく、そもそも違う仕事をしているなら、まず[システムプロンプト](/ja/docs/build/system-prompt/)を直しましょう。大きなモデルでも、あいまいな指示には同じように忠実に従ってしまいます。

## カタログ

モデルの選択メニューには、利用できるモデルが、選択を実際に左右する情報とともに表示されます。コンテキストウィンドウ、100万トークンあたりの入力と出力の料金、受け付ける入力（テキスト、画像、ファイル）、そしてツール呼び出しに対応しているかどうかです。

**確認すべきなのはツール呼び出しです**。endue のエージェントは、ツールを呼び出すことで作業します。ツール呼び出しに対応していないモデルは、すでに知っていることから答えることはできても、メールを検索したり、アウトプットを書き出したり、コネクターを使ったりはできません。そうしたモデルには、モデルの選択メニューでその旨が表示されています。

## 推論レベル

一部のモデルには、**推論レベル**の設定があります。回答する前にどれだけ考えるかを決めるものです。推論レベルを上げるとトークンの消費が増え、時間もかかります。その代わり、序盤の判断ミスが実行の残りを無駄にしてしまうような、複数のステップからなる作業で効果を発揮します。

おおよその目安は次のとおりです。

| 作業 | 推論レベル |
| --- | --- |
| 形式の変換、情報の抽出、分類、短い回答 | 低 |
| 数回のツール呼び出しを含む、日常的な複数ステップのタスク | 中 |
| 序盤のミスが積み重なる長い作業の連鎖（調査、計画、デバッグ） | 高 |

<Screenshot
  name="studio-model"
  alt="モデルセクション。未設定の場合はプラットフォームの既定モデルが使われる既定のチャットモデルと、オフになっている別のフォールバックモデルのスイッチがあります。"
/>

## エージェント別・メッセージ別・ルーティン別

モデルを設定できる場所は3つあり、下にあるものほど優先されます。

- **エージェントの既定モデル**：[エージェントビルダー](/ja/docs/build/agent-builder/)で設定します。特に指定がなければ、これが使われます。
- **1つのメッセージ**：入力欄から指定します。安価なエージェントとの会話の中で、難しい質問を1つだけしたいときに便利です。
- **[ルーティン](/ja/docs/automate/routines/)**：独自のモデルを固定できるので、エージェントを調整し直しても、スケジュールされたジョブのコストは変わりません。

<Aside type="tip" title="安価なエージェントを基本に、ときどき上位モデルへ">
  高速なモデルをエージェントの既定にして、必要な少数のメッセージだけでより強力なモデルを使うほうが、すべてを最も強力なモデルで実行するよりもたいてい安く済みます。日常的な90%の作業では、エージェントの反応も速く感じられます。
</Aside>

## リクエストごとにモデルを選ぶ

エージェントの**自動選択**をオンにすると、メッセージごとにモデルを選ぶ必要がなくなります。判定用モデルがリクエストの難しさを3段階で評価し、各段階で使うモデルをあなたが指定します。[エージェントビルダー](/ja/docs/build/agent-builder/)のモデル設定で変更できます。

| 段階 | 使用するモデル |
| --- | --- |
| 軽いリクエスト（あいさつ、短い事実、1行の書き直し） | 軽いリクエスト用に選んだモデル |
| 標準的なリクエスト（説明、要約、通常の文章やコード） | エージェントの既定モデル |
| 難しいリクエスト（複数段階の分析、長く正確な文章、複雑なコード） | 難しいリクエスト用に選んだモデル |

軽いリクエスト用と難しいリクエスト用のどちらか一方だけを設定しても構いません。空欄の段階では既定モデルを使います。

- **オフ**：難しさを判定しません。
- **観察**：難しさを判定しますが、モデルは変えません。各返信の「Auto would use」に候補モデルが表示されます。
- **オン**：判定結果に応じてモデルを選びます。入力欄のモデル選択は**Auto**から始まり、各返信に使ったモデルが表示されます。

保存する前に**試す**欄へ文を入力すると、判定された段階と使われるモデルを確認できます。判定の確信度が設定したしきい値未満、判定が時間内に返らない、選ばれたモデルがプランや残りの利用枠で使えない場合は、既定モデルで応答します。返信は判定を待ち続けません。

添付ファイルのあるメッセージや、難しいリクエストの直後のメッセージは、軽いモデルに下げません。「続けて」は短くても、続ける作業まで簡単とは限らないためです。

入力欄でモデルを手動で選ぶと、その会話では選んだモデルを使い続けます。自動選択に戻すには**Auto**を選びます。プロジェクトに独自の既定モデルがある会話では、そのモデルに従います。

<Aside type="note" title="判定のためにメッセージが送信されます">
  観察またはオンにすると、現在のメッセージと直前のメッセージの冒頭が、OpenRouterを経由して米国のTypeSafeに送られます。難しさの判定にだけ使われます。オフから切り替える際に画面で確認を求められます。
</Aside>

自動選択は人が送ったメッセージにだけ適用されます。[ルーティン](/ja/docs/automate/routines/)と音声会話は判定されず、それぞれ設定したモデルで実行されます。

## コスト

プランの利用枠を消費するのはモデルの使用で、カタログ内のモデルの料金には10倍以上の開きがあります。モデルの選択メニューには、モデルごとの入力と出力の料金が表示されます。使用量の測り方と確認場所については[プランと使用量](/ja/docs/account/plans-and-usage/)を、代わりにプロバイダーへ直接支払いたい場合は[自分のキーを使う](/ja/docs/account/bring-your-own-key/)を参照してください。

## 制限事項

- すべてのモデルが、すべての機能に対応しているわけではありません。ツール呼び出し、画像入力、推論レベルへの対応はモデルによって異なり、正しい情報はモデルの選択メニューで確認できます。
- モデルを変更しても、エージェントのプロンプト、メモリ、紐付けは変わりません。
- 進行中の実行は、開始時のモデルのまま進みます。モデルの切り替えは次の実行から反映されます。
- コンテキストウィンドウの大きさは、モデルによって異なります。あるモデルに収まる非常に長い会話が、別のモデルには収まらないこともあります。

## 関連項目

<CardGrid>
  <LinkCard
    title="プランと使用量"
    href="/ja/docs/account/plans-and-usage/"
    description="何が使用量を消費するのか、どれだけ使ったかをどこで確認できるのか。"
  />
  <LinkCard
    title="自分のキーを使う"
    href="/ja/docs/account/bring-your-own-key/"
    description="endue の認証情報の代わりに、自分のモデルの認証情報を使う。"
  />
  <LinkCard
    title="endue のしくみ"
    href="/ja/docs/get-started/how-it-works/"
    description="モデルが動かしているループと、モデル選びが重要な理由。"
  />
</CardGrid>
