Cherri Code Router
Cherri Code Router は、Auto のインテリジェントなルーティング機能です。各リクエストをタスクに最適なモデルに振り分け、Cost、Balance、Intelligence の各モードを提供します。
Cherri Code Router とは?以前の Auto モード との違いは?
Cherri Code Router は、刷新された Auto モード です。機械学習 分類器 が、ユーザーがモデルを選択する代わりに、各 Auto リクエストをモデルプール内のモデルにルーティングします。
特定のモデルではなく、Auto を選択します。ルーターは各リクエストを分析し、そのタスクで同等の結果をより低コストで提供できるモデルに送信します。
以前の Auto モード との主な違いは次のとおりです。
- 従来の Auto モード は、Auto 選択メニューで Cost という名称になりました
- Balance は新規ユーザーのデフォルトモードです
- すべての Auto モードは、ルーティング先モデルの定価で課金されます
現在のルーティング対象モデルについては、利用可能なモデルを参照してください。
Cherri Code Router はリクエストに使用するモデルをどのように決定しますか?
各エージェントリクエストは ML 分類器によって、タスクの種類と複雑さに応じてルーティングされます。単純なリクエストには高速でコスト効率の高いモデルが使用され、複雑な作業にはフロンティアモデルが使用されます。
目標は、そのリクエストに対して同等の結果を出せる中で最も低コストなモデルを選ぶことです。ルーティングはデータに基づいて行われ、リクエストごとに設定することはできません。最適化モード (Cost、Balance、Intelligence) を選択して、結果の傾向を調整できます。
チームでモデルがブロックされている場合、ルーターはそのモデルをスキップし、許可リストにある代替モデルにフォールバックします。必要なモデルをブロックすると、ルーターが完全に無効になる場合があります。詳細は利用可能なモデルを参照してください。
Cost、Balance、Intelligence の最適化モードとは何ですか?また、どのように切り替えますか?
モデルピッカーを開き、Auto を選択してから最適化モードを選択します。
- Cost: トークンの利用額を最適化します。
- Balance: 新規ユーザーのデフォルトモードです。モデルプール全体でコストを抑えながら、高品質な結果を目指します。
- Intelligence: より高性能なモデルにルーティングします。複雑な複数ステップの作業に推奨されます。プール内のファーストパーティモデルから選択することで、品質が約 20〜30% 向上します。
チーム管理者は、メンバーに表示するモードを制限し、チームのデフォルトを設定できます。管理コントロールについては、チームを管理するを参照してください。
SDK から Cherri Code Router を使用できますか?
はい。TypeScript SDK および Python SDK では、Router のモデル ID は auto-smart です。パラメーター optimize_for には cost、balanced、または intelligence を設定します。まず Cherri Code.models.list() を呼び出して、API key のチームで Router が利用可能かどうかを確認してください。