Frontal が公開されました。お知らせを読む

すべてをひとつのゲートウェイで。

エンタープライズのワークロード向けに構築された統合ゲートウェイで、AI モデルへの接続・ルーティング・アクセス統制を実現します。

すべてのモデルに宛先はひとつ

コードはゲートウェイを呼ぶだけです。どのプロバイダーが応じるかはゲートウェイが決め、何が起きたかを記録します。

  • 宛先はひとつのエンドポイント

    API もキーもリクエスト形式も一つ。プロバイダーの切り替えがコード変更でなくなります。

  • モデルはポリシーが選ぶ

    コスト、レイテンシ、リージョン、能力で振り分け、プロバイダーが劣化したら切り替えます。

  • 明細を受け取る

    呼び出しごとに、到達したモデル、費用、所要時間、依頼元が記録されます。

ゲートウェイが肩代わりするもの

二つ目のモデル、二つ目のプロバイダー、二つ目のチームが加わった瞬間に発生する作業です。

  • 切り替えはこちらの仕事

    プロバイダーが遅くなるか失敗すると、ポリシー上の次の候補がデプロイなしで引き取ります。

  • 効く支出上限

    チーム単位・キー単位の上限をゲートウェイで強制します。請求書で気づくのでは遅すぎます。

  • プロバイダーの鍵は一か所に

    アプリが持つのはゲートウェイの鍵だけ。プロバイダーの資格情報はゲートウェイから出ません。

  • 同じ作業は二度課金されない

    同一のリクエストはキャッシュから返り、ヒット率が費用の隣に表示されます。

ゲートウェイが対応する範囲

プロバイダー
Anthropic、OpenAI、Google、Mistral、および自社で運用する OpenAI 互換エンドポイント。
ルーティング
重み付け、コスト、レイテンシ、リージョン固定の各ポリシーと、順序付きのフェイルオーバー。
上限
キー単位・チーム単位・モデル単位のレートおよび支出の上限。
キャッシュ
完全一致とプロンプト前方一致。ルートごとに設定できます。
記録
すべてのリクエストをモデル、トークン、費用、レイテンシ、呼び出し元とともに保持します。

本番をここに通す前に

すべてのモデル呼び出しの前段に単一の部品が立つとき、プラットフォームチームが確認することです。

呼び出しを一つ向けてみる

ベース URL を変えてリクエストを送り、下されたルーティング判断を読んでください。

当サイトでは既定でクッキーを使わずにトラフィックを計測しています。同意いただくと、セッションをまたいで訪問を記録でき、分析の精度が高まります。