インテリジェントなモデルルーティングとフェイルオーバー
チームごとのデフォルトモデル設定、リクエストの複雑さに応じたルーティング、そしてプロバイダー障害時の即時フェイルオーバー。すべてのリクエストを、常に最適なモデルで処理します。
すべてのリクエストを 3 つのレベルで制御
Model Gateway は、チーム、リクエストの複雑さ、そしていま正常に稼働しているプロバイダーという 3 つの観点から、各リクエストを処理するモデルを決定します。
チームごとにデフォルトモデルを設定
営業チームには Claude Sonnet、エンジニアリングチームには GPT-5、プロダクトチームには Claude Opus など、チームの業務に合ったモデルを割り当てられます。ゲートウェイで一度設定すれば、そのチームが実行するすべてのエージェントに自動で適用され、変更するときも 1 か所で全員に反映できます。
Connect AI がリクエストを見極めてルーティング
Connect AI は、定義済みのルーティングルールと各リクエストの評価結果をもとに、十分な品質で処理できるモデルの中から最もコストの低いモデルへリクエストを送ります。たとえば、単純な検索はエコノミーモデルへ、複数システムにまたがる分析はフロンティアモデルへと振り分けられます。
プロバイダーが止まっても、リクエストは止まらない
ゲートウェイはプロバイダーの稼働状況を常に監視しています。性能低下やオフラインを検知すると、処理中のリクエストも新しいリクエストも、コンテキストを保ったまま即座に正常なモデルへ切り替わります。回答の内容は変わらず、プロバイダーの障害中もエージェントは止まりません。
インテリジェントなルーティングがもたらすメリット
すべてのリクエストが最適なモデルで処理され、コストは自然と下がります。プロバイダーに障害が起きても、稼働が止まることはありません。
選ぶ手間なく、最適なモデルへ
チームごとのデフォルト設定と複雑さに応じたルーティングで、各リクエストが自動的に適切なモデルへ届きます。エンジニアがエージェントごとにモデル選択のロジックを組み込む必要はありません。
何もしなくても、コストは下がる
より安価なモデルでも同じ正しい回答が得られるなら、リクエストは自動的にそちらへルーティングされます。モデル間で最大 178 倍にもなるコスト差を、そのまま削減効果として生かせます。
障害発生中も稼働率 100%
常時ヘルスチェックと即時フェイルオーバーで、プロバイダーの性能が低下してもエージェントは応答し続けます。コンテキストも保持されるため、回答が変わることはありません。
正確で安全な回答はそのままに、処理するモデル次第でコストは最大 178 分の 1 に。 CData Software による社内テストに基づく結果です(2026年第3四半期)。第三者機関による独立した検証は行われていません。実際のコスト差はモデルによって異なり、テストは本番環境のアカウント構成を模した、既知のデータセットを含むサンドボックスアカウントを使用して実施されました。結果は実運用環境でのパフォーマンスを代表するものではなく、結果は変動する可能性があります。各組織は、購入または導入の意思決定を行う前に、独自に検証を実施する必要があります。
低価格モデルからフロンティアモデルまで 22 のモデルを対象に、実際に稼働している企業システムへの 1,000 件を超える実務の質問で検証しました。精度と安全性を Connect AI のデータレイヤーが担うことで、どのモデルも同じ正しい回答を返し、違いは価格だけでした。
レポートを入手するモデルだけでなく、データまで理解したルーティング
デフォルト設定、複雑さに応じたルーティング、フェイルオーバーはいずれも、コンテキストを保持するレイヤーで動作します。そのため、モデルが切り替わっても回答は変わりません。
チームのモデルを 1 か所で変更すれば、そのチームが実行するすべてのエージェントに反映されます。
CData Labs が、稼働中の Salesforce、Snowflake、ServiceNow 環境で 22 モデルを検証した結果です。
22 モデル中 21 モデルが、ガバナンスの効いた同じツールを通じて同一の結果を返しました。そのため、フェイルオーバーしても回答は変わりません。
よりスマートにルーティング。止まらない AI を。
デフォルト設定から、複雑さに応じたルーティング、プロバイダー間のフェイルオーバーまで、すべて Model Gateway で。コンテキストも保持したまま実現します。