面向多个提供商家族的单一网关
通过单一基础 URL 在 OpenAI、Anthropic 和 Google 之间路由请求,同时保留 Claude Code 或 Cursor 等应用所需的模型家族约束。
IQ Routing 是一款面向通过 OpenAI、Anthropic 或 Google 风格端点调用大语言模型的应用的模型路由网关。它位于聊天机器人、RAG 流程、agent 循环和金融工作负载之前,并将每个请求发送到仍满足质量要求的最低成本模型。
该产品旨在在不更改 agent 代码路径的情况下减少模型支出。网站将其描述为可直接接入现有 SDK 和端点的一层,其路由决策基于提示复杂度、实时成本与延迟信号,以及在模型或提供商路径失败时的回退处理。
定价和文档页面显示其支持三类在线提供商、BYOK 运行、响应缓存、团队预算、审计日志,以及仅限特定方案的控制项,如告警和组织范围访问。Enterprise 还提供本地部署或 VPC 等部署选项,并可按需提供 SOC2 证据包等支持材料。
通过单一基础 URL 在 OpenAI、Anthropic 和 Google 之间路由请求,同时保留 Claude Code 或 Cursor 等应用所需的模型家族约束。
按复杂度对每个提示进行分类,并在请求不需要旗舰模型时选择更便宜的模型层级;若某个选项失败,则可立即回退。
使用 auto、frontier 等别名以及其他路由模式来控制解析器搜索的范围,并通过首选模型和允许模型列表来约束梯度。
按输入、输出、缓存和思考 token 跟踪支出,并提供每次请求的详细信息,说明一次调用为何产生相应费用。
通过精确与语义响应缓存,避免重复请求被重复计费,包括面向 agent 循环和流式重放的会话级缓存。
在付费方案中应用每团队预算、每密钥限制、审计日志、告警和组织范围访问控制。
将低复杂度的分类、检索、清理或验证步骤路由到更便宜的模型,同时将最强模型保留给工作流中真正需要它的部分。
将 IQ Routing 放在聊天机器人或 RAG 服务之前,使应用可以使用单一基础 URL,而路由器在后台处理模型选择。
使用每团队预算、审计日志和组织范围访问控制,跟踪共享环境中谁花了多少钱,并让计费记录更易于审查。
依赖网关响应缓存,在无需再次调用提供商的情况下返回完全相同或语义相似的重复请求,这在用户用稍有不同的措辞提出相同问题时非常有用。
当网关需要在云、VPC 或本地环境中运行,而不仅仅是作为托管服务时,采用 Enterprise 部署选项。
IQ Routing 位于 OpenAI、Anthropic 和 Google 风格端点之前,将每个请求路由到仍满足质量要求的最低成本模型层级。它旨在与聊天机器人、RAG 流程、agent 循环和金融工作负载配合使用。
该产品被设计为即插即用的网关。网站说明它可在你已经使用的 OpenAI 或 Anthropic SDK 后面工作,任何 OpenAI 或 Anthropic 风格的端点都可以指向同一个基础 URL。
是的。定价页面显示有 Free、Team 和 Enterprise 方案。Free 为自助式并支持 BYOK,Team 为每月 70 美元按月计费,Enterprise 为按年定制定价,并提供本地部署或 VPC 部署选项。
文档说明所有方案都采用自带密钥(bring-your-own-key),因此你连接自己的提供商凭证并直接向提供商付款。计费文档还指出,402 响应表示你的 BYOK 密钥上的提供商额度已耗尽。
计费文档描述了一个网关响应缓存,可在不再次调用提供商的情况下返回完全相同或语义相似的重复请求。网站还说明,一次测得的生产环境缓存命中返回时间约为 11 毫秒,且无需额外成本。
AakarDev AI 帮助团队在一个仪表板中管理 AI provider 访问、项目级设置、日志和分析,支持 BYOK 工作流,并涵盖 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI 和 Perplexity AI。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。
hob 是面向编码 agent 的独立工作区,可将 agent 会话、终端、历史记录和后续工作围绕你已在用的工具与提供商有序管理,适合重视本地路由、历史和工作区结构控制的开发者。
Ably Chat 是用于构建自定义实时聊天应用的 chat API 平台,支持房间消息、输入指示、在线状态、表情回应与消息更新,并提供按使用量计费选项。
Manta AI 是面向团队的自治式网页应用测试工具,可从 URL 自动探索应用、映射行为、捕捉回归,并用自然语言生成测试,无需脚本或维护选择器。