モデルルーティング & フェイルオーバー

インテリジェントなモデルルーティングとフェイルオーバー

チームごとのデフォルトモデル設定、リクエストの複雑さに応じたルーティング、そしてプロバイダー障害時の即時フェイルオーバー。すべてのリクエストを、常に最適なモデルで処理します。

すべてのリクエストを 3 つのレベルで制御

Model Gateway は、チーム、リクエストの複雑さ、そしていま正常に稼働しているプロバイダーという 3 つの観点から、各リクエストを処理するモデルを決定します。

チームごとにデフォルトモデルを設定

営業チームには Claude Sonnet、エンジニアリングチームには GPT-5、プロダクトチームには Claude Opus など、チームの業務に合ったモデルを割り当てられます。ゲートウェイで一度設定すれば、そのチームが実行するすべてのエージェントに自動で適用され、変更するときも 1 か所で全員に反映できます。

チーム単位のデフォルト設定
すべてのエージェントに適用
変更は 1 か所で
チーム別デフォルトモデル 編集中
チーム デフォルトモデル 有効
営業 Claude Sonnet
エンジニアリング GPT-5
プロダクト Claude Opus · med
サポート Claude Haiku
チームごとに一度設定するだけ すべてのエージェントに適用

インテリジェントなルーティングがもたらすメリット

すべてのリクエストが最適なモデルで処理され、コストは自然と下がります。プロバイダーに障害が起きても、稼働が止まることはありません。

01 最適なモデル

選ぶ手間なく、最適なモデルへ

チームごとのデフォルト設定と複雑さに応じたルーティングで、各リクエストが自動的に適切なモデルへ届きます。エンジニアがエージェントごとにモデル選択のロジックを組み込む必要はありません。

02 コスト削減

何もしなくても、コストは下がる

より安価なモデルでも同じ正しい回答が得られるなら、リクエストは自動的にそちらへルーティングされます。モデル間で最大 178 倍にもなるコスト差を、そのまま削減効果として生かせます。

03 稼働率

障害発生中も稼働率 100%

常時ヘルスチェックと即時フェイルオーバーで、プロバイダーの性能が低下してもエージェントは応答し続けます。コンテキストも保持されるため、回答が変わることはありません。

CData Labs 調査
178×

正確で安全な回答はそのままに、処理するモデル次第でコストは最大 178 分の 1 に。

低価格モデルからフロンティアモデルまで 22 のモデルを対象に、実際に稼働している企業システムへの 1,000 件を超える実務の質問で検証しました。精度と安全性を Connect AI のデータレイヤーが担うことで、どのモデルも同じ正しい回答を返し、違いは価格だけでした。

レポートを入手する

モデルだけでなく、データまで理解したルーティング

デフォルト設定、複雑さに応じたルーティング、フェイルオーバーはいずれも、コンテキストを保持するレイヤーで動作します。そのため、モデルが切り替わっても回答は変わりません。

チーム別デフォルト · 適用済み 4 チーム
チームデフォルトモデル有効
営業Claude Sonnet
エンジニアリングGPT-5
プロダクトClaude Opus · med
一度設定するだけすべてに適用

チームのモデルを 1 か所で変更すれば、そのチームが実行するすべてのエージェントに反映されます。

正答 1 件あたりのコスト(エコノミー vs フロンティア)
エコノミーモデル
1×
ミドルクラスモデル
~40×
フロンティアモデル
178×
回答は同じ。違うのは価格だけで、その差は最大 178 倍。

CData Labs が、稼働中の Salesforce、Snowflake、ServiceNow 環境で 22 モデルを検証した結果です。

プロバイダーの稼働状況 & フェイルオーバー 監視中
Anthropic · Claude 正常
OpenAI · GPT-5 オフライン
Google · Gemini 正常
再ルーティング済み · コンテキストを保持
常時ヘルスチェック即時フェイルオーバー

22 モデル中 21 モデルが、ガバナンスの効いた同じツールを通じて同一の結果を返しました。そのため、フェイルオーバーしても回答は変わりません。

FAQ

ルーティングに関するよくある質問

よりスマートにルーティング。止まらない AI を。

デフォルト設定から、複雑さに応じたルーティング、プロバイダー間のフェイルオーバーまで、すべて Model Gateway で。コンテキストも保持したまま実現します。