统一路由多种模型来源
通过单一托管式网关,将请求发送到公共模型提供商、自定义端点和自托管模型。
ngrok.ai 是一款托管式 AI 网关,用于路由、保护并管理发往大型语言模型的流量。该网站将其描述为适用于每个模型的单一网关,覆盖公共提供商、自定义端点以及你自行运行的模型。
其主要目的是让团队将应用指向一个单一 URL,继续使用他们已熟悉的 SDK,并在不重建基础设施的情况下添加访问控制、可观测性、路由和回退行为。
通过单一托管式网关,将请求发送到公共模型提供商、自定义端点和自托管模型。
在受支持的 SDK 中将网关用作基础 URL,并通过更换 API 密钥来路由请求,而无需重构应用。
无需公网 IP 或入站端口即可私密连接本地模型,同时保持其可通过网关访问。
为应用或开发者分配单独的访问密钥,并限制每个密钥可调用的提供商和模型。
跟踪路由流量中的 token、延迟、错误和支出,以便了解网关的使用情况。
定义健康替代项,并在模型或密钥变慢或失败时重新路由或重试请求。
将应用指向一个单一网关 URL,并通过受支持的 SDK 路由请求,而不是分别连接每个模型提供商。
先将流量发送到自托管模型;当本地模型不可用或不适用时,再回退到公共提供商。
无需暴露公网 IP 或开启入站端口,即可通过网关让私有模型保持可访问。
为应用或开发者创建单独的访问密钥,并限制每个密钥可调用的模型或提供商。
查看 token、延迟、错误和支出,以了解路由流量的行为以及成本来源。
它被设置为一个托管式网关。来源说明你只需将基础 URL 更改为 https://gateway.ngrok.ai 并替换 API 密钥,然后通过该网关路由请求。
来源展示了 OpenAI SDK、Anthropic SDK 和 Vercel AI SDK 的示例,并说明该网关可通过 API、Terraform、CLI 或自定义工具调用。但所提供页面未公开完整的集成目录。
该网关可路由到公共提供商以及你自己运行的模型。来源还提到,本地 LLM 也可通过网关访问,无需公网 IP 或入站端口。
产品描述称,你可以查看汇总后的 routed 调用中的 token、延迟和错误。它还说明提供商仪表板会显示支出,而网关增加了应用、开发者和模型级别的访问控制。
定价文本称,路由、可观测性及其他功能采用统一的固定费用;使用 ngrok 密钥时,每百万 token 另收 0.05 美元,并加上推理成本。它还说明没有订阅或承诺。
AakarDev AI 帮助团队在一个仪表板中管理 AI provider 访问、项目级设置、日志和分析,支持 BYOK 工作流,并涵盖 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI 和 Perplexity AI。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。
hob 是面向编码 agent 的独立工作区,可将 agent 会话、终端、历史记录和后续工作围绕你已在用的工具与提供商有序管理,适合重视本地路由、历史和工作区结构控制的开发者。
Ably Chat 是用于构建自定义实时聊天应用的 chat API 平台,支持房间消息、输入指示、在线状态、表情回应与消息更新,并提供按使用量计费选项。
Manta AI 是面向团队的自治式网页应用测试工具,可从 URL 自动探索应用、映射行为、捕捉回归,并用自然语言生成测试,无需脚本或维护选择器。