コンテンツにスキップ

モデルの選び方

Markdown で表示

すべての実行は、モデルによって動いています。endue には複数のプロバイダーのモデルをそろえたカタログがあり、エージェントが使うモデルを選べます。既定のモデルとして設定することも、1つのメッセージだけに使うこともできます。

エージェントの推論に問題があるときに、モデルを変更します。長いタスクで手順を抜かしたり、本当に単純な作業なのに遅くて高くついたりする場合です。エージェントの仕事ぶりが悪いのではなく、そもそも違う仕事をしているなら、まずシステムプロンプトを直しましょう。大きなモデルでも、あいまいな指示には同じように忠実に従ってしまいます。

モデルの選択メニューには、利用できるモデルが、選択を実際に左右する情報とともに表示されます。コンテキストウィンドウ、100万トークンあたりの入力と出力の料金、受け付ける入力(テキスト、画像、ファイル)、そしてツール呼び出しに対応しているかどうかです。

確認すべきなのはツール呼び出しです。endue のエージェントは、ツールを呼び出すことで作業します。ツール呼び出しに対応していないモデルは、すでに知っていることから答えることはできても、メールを検索したり、アウトプットを書き出したり、コネクターを使ったりはできません。そうしたモデルには、モデルの選択メニューでその旨が表示されています。

一部のモデルには、推論レベルの設定があります。回答する前にどれだけ考えるかを決めるものです。推論レベルを上げるとトークンの消費が増え、時間もかかります。その代わり、序盤の判断ミスが実行の残りを無駄にしてしまうような、複数のステップからなる作業で効果を発揮します。

おおよその目安は次のとおりです。

作業推論レベル
形式の変換、情報の抽出、分類、短い回答低
数回のツール呼び出しを含む、日常的な複数ステップのタスク中
序盤のミスが積み重なる長い作業の連鎖(調査、計画、デバッグ)高
モデルセクション。未設定の場合はプラットフォームの既定モデルが使われる既定のチャットモデルと、オフになっている別のフォールバックモデルのスイッチがあります。
元のサイズで表示

エージェント別・メッセージ別・ルーティン別

Section titled “エージェント別・メッセージ別・ルーティン別”

モデルを設定できる場所は3つあり、下にあるものほど優先されます。

  • エージェントの既定モデル:エージェントビルダーで設定します。特に指定がなければ、これが使われます。
  • 1つのメッセージ:入力欄から指定します。安価なエージェントとの会話の中で、難しい質問を1つだけしたいときに便利です。
  • ルーティン:独自のモデルを固定できるので、エージェントを調整し直しても、スケジュールされたジョブのコストは変わりません。

リクエストごとにモデルを選ぶ

Section titled “リクエストごとにモデルを選ぶ”

エージェントの自動選択をオンにすると、メッセージごとにモデルを選ぶ必要がなくなります。判定用モデルがリクエストの難しさを3段階で評価し、各段階で使うモデルをあなたが指定します。エージェントビルダーのモデル設定で変更できます。

段階使用するモデル
軽いリクエスト(あいさつ、短い事実、1行の書き直し)軽いリクエスト用に選んだモデル
標準的なリクエスト(説明、要約、通常の文章やコード)エージェントの既定モデル
難しいリクエスト(複数段階の分析、長く正確な文章、複雑なコード)難しいリクエスト用に選んだモデル

軽いリクエスト用と難しいリクエスト用のどちらか一方だけを設定しても構いません。空欄の段階では既定モデルを使います。

  • オフ:難しさを判定しません。
  • 観察:難しさを判定しますが、モデルは変えません。各返信の「Auto would use」に候補モデルが表示されます。
  • オン:判定結果に応じてモデルを選びます。入力欄のモデル選択はAutoから始まり、各返信に使ったモデルが表示されます。

保存する前に試す欄へ文を入力すると、判定された段階と使われるモデルを確認できます。判定の確信度が設定したしきい値未満、判定が時間内に返らない、選ばれたモデルがプランや残りの利用枠で使えない場合は、既定モデルで応答します。返信は判定を待ち続けません。

添付ファイルのあるメッセージや、難しいリクエストの直後のメッセージは、軽いモデルに下げません。「続けて」は短くても、続ける作業まで簡単とは限らないためです。

入力欄でモデルを手動で選ぶと、その会話では選んだモデルを使い続けます。自動選択に戻すにはAutoを選びます。プロジェクトに独自の既定モデルがある会話では、そのモデルに従います。

自動選択は人が送ったメッセージにだけ適用されます。ルーティンと音声会話は判定されず、それぞれ設定したモデルで実行されます。

プランの利用枠を消費するのはモデルの使用で、カタログ内のモデルの料金には10倍以上の開きがあります。モデルの選択メニューには、モデルごとの入力と出力の料金が表示されます。使用量の測り方と確認場所についてはプランと使用量を、代わりにプロバイダーへ直接支払いたい場合は自分のキーを使うを参照してください。

  • すべてのモデルが、すべての機能に対応しているわけではありません。ツール呼び出し、画像入力、推論レベルへの対応はモデルによって異なり、正しい情報はモデルの選択メニューで確認できます。
  • モデルを変更しても、エージェントのプロンプト、メモリ、紐付けは変わりません。
  • 進行中の実行は、開始時のモデルのまま進みます。モデルの切り替えは次の実行から反映されます。
  • コンテキストウィンドウの大きさは、モデルによって異なります。あるモデルに収まる非常に長い会話が、別のモデルには収まらないこともあります。