多個模型來源共用單一端點
透過單一相容 OpenAI 的端點路由託管供應商、自有金鑰與自有 GPU,讓代理程式能使用一組 API 金鑰存取不同模型來源。
Experiential Labs 是開放原始碼 AI 閘道,將多個模型供應商置於單一相容 OpenAI 的端點後方。產品以單一 API 金鑰與路由層為核心,可搭配託管供應商、客戶自有金鑰及客戶自有 GPU。
網站將此閘道定位為一種控管代理程式流量路由、存取與歸因的方式,同時讓路由代幣採用供應商價格。它也加入智慧層,能根據觀察到的使用情況建議模型變更、快取機會,以及模型訓練或最佳化;此外,您可以選擇在自己的基礎架構上自託管整個閘道。
透過單一相容 OpenAI 的端點路由託管供應商、自有金鑰與自有 GPU,讓代理程式能使用一組 API 金鑰存取不同模型來源。
在組織、團隊、人員、代理程式或工具層級設定預算、硬性上限、模型允許清單與金鑰範圍,讓請求在閘道層受到限制。
為每個請求標註路由、備援、代幣與成本,接著在主控台與使用量 API 中依代理程式、人員、模型或日期檢視使用量。
使用智慧層根據觀察到的流量,建議更便宜或更快速的模型路由、找出快取機會,並支援逐提示最佳化。
為重複代幣啟用提示快取,在維持相同提示與工作流程的同時,降低重複內容的有效代幣成本。
將閘道執行於您自己的基礎架構,或使用託管服務;核心功能以開放原始碼提供,網站也有自託管文件。
讓代理程式、應用程式或內部工具指向單一基礎 URL,讓模型選擇、供應商故障轉移與成本歸因在閘道處理,而非由每個應用程式個別處理。
使用組織政策、上限與允許清單,讓團隊、代理程式或金鑰維持在規劃的預算內,同時仍可讓請求路由至多個供應商。
將重複提示透過快取進行路由,並在流量模式符合條件時,讓智慧層找出更便宜的路由或較低工作量的設定。
當您希望將端點、預算、路由與使用量 API 部署在自己的基礎架構,而非使用託管部署時,可自託管閘道。
依照案例研究中的模式,使用自己的工作流程訓練或蒸餾模型,接著讓它與其餘模型流量一樣,透過同一端點提供服務。
閘道會提供相容 OpenAI 的 /v1 端點。定價頁面指出,自託管閘道可以使用 `uvx --from experiential exp run` 在您自己的基礎架構上執行,網站也展示了標準聊天完成請求的範例。
其定位是為了滿足團隊需求:透過單一端點使用託管供應商、BYOK 及本機或自託管模型,並提供路由、預算、存取控制與歸因功能。定價頁面也描述了企業控制功能,例如 SSO、SCIM、進階 RBAC、私有網路與資料落地。
閘道會將請求路由至能提供指定模型的最低成本健康部署;智慧層也能根據觀察到的流量,建議切換模型、採用快取機會,以及進行逐提示最佳化。
網站表示,路由會採用供應商的牌價,路由代幣不加價 0%。路由代幣與智慧功能共用點數,點數用完時,請求會在上限處停止。
可以。定價頁面指出,Pro 與 Enterprise 方案包含 BYOK 和本機模型;首頁則表示,您自行微調及自託管的模型可以使用同一組金鑰。
AakarDev AI 讓團隊透過單一儀表板管理 AI 供應商權限、專案設定、日誌與分析,支援 BYOK 工作流程,並可連接 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AI。
ByteAsk 是專為 C 與 C++ 打造的終端機優先 AI coding agent,先編輯儲存庫再用真實編譯器、除錯器、sanitizer 與測試驗證變更,並提供免費方案與付費方案。
CreateOS Sandbox 是以 Firecracker micro-VM 執行程式與 agent 工作負載的隔離運算環境,支援私有網路、SDK、CLI 與 MCP 程式化控制。
hob 是一個獨立的 coding agents 工作區,整合 agent sessions、終端機、歷史紀錄與後續工作,並維持你既有的工具與供應商設定。適合想保有本機路由、歷史與工作區結構控制權的開發者。
Ably Chat 是一個聊天 API 平台,適合打造自訂即時聊天應用程式。支援聊天室訊息、輸入中提示、在線狀態、表情回應與訊息更新,並提供依使用量計費選項。
Manta AI 是一款自動化網頁應用測試工具,從 URL 即可開始探索、建立行為地圖,並以自然語言產生測試與回歸檢查,無需撰寫腳本或維護 selector。