複数のモデルソースに対応する1つのエンドポイント
ホスト型プロバイダー、自社キー、自社GPUを単一のOpenAI互換エンドポイント経由でルーティングし、エージェントがモデルソースをまたいで1つのAPIキーを使えるようにします。
Experiential Labsは、ホスト型プロバイダー、自社キー、自社GPUへのリクエストを1つのOpenAI互換エンドポイントで振り分けるオープンソースAIゲートウェイ。アクセス制御、帰属、予算、モデルルーティングとキャッシュのインテリジェンス層を提供します。
Experiential Labsは、複数のモデルプロバイダーを1つのOpenAI互換エンドポイントの背後に配置するオープンソースAIゲートウェイです。単一のAPIキーとルーティング層を中心に構築されており、ホスト型プロバイダー、自社所有のキー、自社所有のGPUに対応できます。
このゲートウェイは、プロバイダーの料金をルーティングされたトークンに適用しながら、エージェントトラフィックのルーティング、アクセス、帰属を制御する手段として位置付けられています。また、観測された利用状況に基づいて、モデルの変更、キャッシュの機会、モデルのトレーニングや最適化を提案できるインテリジェンス層も備えています。ゲートウェイ全体を自社インフラ上でセルフホストすることも可能です。
ホスト型プロバイダー、自社キー、自社GPUを単一のOpenAI互換エンドポイント経由でルーティングし、エージェントがモデルソースをまたいで1つのAPIキーを使えるようにします。
組織、チーム、個人、エージェント、ツールの各レベルで予算、ハード上限、モデル許可リスト、キーのスコープを設定し、ゲートウェイでリクエストを制限します。
すべてのリクエストについて、ルート、フォールバック、トークン、コストを記録し、コンソールとUsage APIでエージェント、個人、モデル、日ごとに利用状況を確認できます。
インテリジェンス層を使用して、より安価または高速なモデルルートを推奨し、キャッシュの機会を特定し、観測されたトラフィックに基づくプロンプト単位の最適化を支援します。
繰り返し使用するトークンのプロンプトキャッシュを有効にし、同じプロンプトとワークフローを維持したまま、繰り返しコンテンツの実効トークンコストを削減します。
ゲートウェイを自社インフラ上で実行するか、ホスト型サービスを利用できます。コアはオープンソースとして提供され、セルフホスティングの方法はサイトに記載されています。
エージェント、アプリ、社内ツールを単一のベースURLに接続し、各アプリ内ではなくゲートウェイでモデル選択、プロバイダーのフェイルオーバー、コストの帰属を行います。
組織ポリシー、上限、許可リストを使用して、複数のプロバイダー間でリクエストをルーティングしながら、チーム、エージェント、キーを計画した予算内に収めます。
繰り返し使用するプロンプトをキャッシュ経由でルーティングし、トラフィックパターンに応じて、より安価なルートや負荷の低い設定をインテリジェンス層に提示させます。
マネージドデプロイではなく、自社インフラ上でエンドポイント、予算、ルーティング、Usage APIを運用したい場合に、ゲートウェイをセルフホストします。
ケーススタディのパターンを活用して、自社のワークフローに合わせてモデルをトレーニングまたは蒸留し、他のモデルトラフィックと同じエンドポイントの背後で提供します。
ゲートウェイはOpenAI互換の/v1エンドポイントを公開します。料金ページによると、セルフホスト型ゲートウェイは`uvx --from experiential exp run`で自社インフラ上で実行でき、サイトには標準的なチャット完了リクエストの例も掲載されています。
ホスト型プロバイダー、BYOK、ローカルまたはセルフホスト型モデルを1つのエンドポイントで利用し、ルーティング、予算、アクセス制御、帰属を実現したいチーム向けに位置付けられています。料金ページでは、SSO、SCIM、高度なRBAC、プライベートネットワーキング、データレジデンシーなどのエンタープライズ制御についても説明されています。
ゲートウェイは、モデルを提供できる正常なデプロイメントの中から最も安価なものを通じてリクエストをルーティングします。インテリジェンス層は、観測されたトラフィックに基づいて、モデルの切り替え、キャッシュの機会、プロンプト単位の最適化も提案できます。
サイトによると、ルーティングにはプロバイダーの定価が適用され、ルーティングされたトークンへの上乗せは0%です。ルーティングされたトークンとインテリジェンス機能の両方でクレジットが使用され、クレジットがなくなるとリクエストは上限で停止します。
はい。料金ページによると、BYOKとローカルモデルはProおよびEnterpriseに含まれ、ホームページでは独自のファインチューニング済みモデルとセルフホスト型モデルを同じキーの背後に配置できると説明されています。
AakarDev AIは、AIプロバイダーのアクセス管理、プロジェクト別設定、ログ、分析を1つのダッシュボードで管理できるチーム向けツールです。BYOKに対応し、OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AIをサポートします。
ByteAskは、C/C++向けのターミナル起点AIコーディングエージェント。リポジトリを編集し、コンパイラやデバッガ、サニタイザ、テストで変更を検証してから差分を表示。無料枠あり。
CreateOS Sandboxは、FirecrackerマイクロVM上でコードやエージェントのワークロードを実行できる分離型コンピュート環境です。SDK、CLI、MCPで制御可能。
hobは、エージェントのセッション、ターミナル、履歴、後続作業を、既存のツールやプロバイダーに合わせて整理できる独立したコーディングエージェント向けワークスペース。ローカルでの制御を重視する開発者に最適。
Ably Chatは、カスタムのリアルタイムチャットアプリを構築できるチャットAPIプラットフォームです。ルーム単位のメッセージ、入力中表示、プレゼンス、リアクション、メッセージ更新に対応し、利用量ベースの料金も選べます。
Manta AIは、URLからアプリの挙動を把握し、回帰を検出し、スクリプトやセレクタ管理なしでテストを生成できる自律型Webアプリテストツールです。