コンテンツにスキップ

プランと使用量

Markdown で表示

endue が計測するのは、実際にお金がかかるもの、つまりモデルの使用量です。エージェント、会話、アウトプット、コネクターなど、それ以外のものは操作ごとには課金されません。

すべての実行は、会話、エージェントのプロンプト、ツールの結果をモデルに送り、モデルが応答します。送信と受信の両方がカウントされます。

そのため、使用量を左右するのは次の要素です。

要因影響
どのモデルか群を抜いて大きな要因です。カタログ内の価格差は10倍を超えます
推論レベルレベルが高いほど、応答する前に多くのトークンを使います
実行のステップ数ツールの結果はそのたびにモデルに戻されます
会話の長さ長い会話はステップのたびに読み直されます
ルーティン見ているかどうかに関係なく、独自のスケジュールで実行されます

プランの利用枠は、一度に使い切れる月単位の残高ではなく、ローリング方式の1週間単位で計測されます。その週の利用枠を使い切ると、期間が先へ進むまで実行は拒否されます。

計画を立てるうえで、押さえておきたい点が2つあります。

  • 使用が集中した1日だけで、1か月分を使い切ることはできません。
  • 短い間隔のルーティンに高価なモデルを組み合わせるのが、上限に達する最もよくあるパターンです。見ていない間も着実に使い続けるためです。

効果の大きい順に、おおよそ次のとおりです。

  1. 作業に合ったモデルを選ぶ。日常的な作業には速くて安いモデルを、難しい少数のメッセージには強力なモデルを使います。モデルの選び方を参照してください。
  2. ルーティンごとにモデルを固定する。スケジュールされた作業のコストを予測しやすくなります。
  3. 推論レベルを下げる(複数のステップを必要としない作業の場合)。
  4. 話題が変わったら新しい会話を始める。長い会話はステップのたびに送り直されます。
  5. エージェントに不要な組み込みツールグループをオフにする。提示されるツールはどれも、ステップのたびにコンテキストとして読み込まれます。
  6. ルーティンの間隔を広げる。1時間ごとの実行が、4時間ごとの4倍のコストに見合うことはめったにありません。

モデルプロバイダーに直接支払いたい場合は、自分のキーを接続してください。endue はそのモデルの呼び出しにそのキーを使います。自分のキーを使うを参照してください。

  • 使用量はエージェントごとではなく、アカウントごとに計測されます。ダッシュボードのエージェント別の表示はその合計の内訳であり、個別の利用枠ではありません。
  • 週の利用枠を使い切ると、実行は拒否されます。進行中の作業が巻き戻されることはありませんが、新しい実行は始まりません。
  • 使用量画面の数値は、精算が済むまでの短い間、実行より遅れて反映されることがあります。
  • 自分のキーで行った実行は、使用量の台帳にまったく記録されません。