Benchspan icon

Benchspan

Benchspan 是一款 AI agent 安全平台,可发现 agent、实时阻止提示注入和数据外泄,并支持上线前红队测试,适用于生产环境中的 agent 团队,提供 Python 和 TypeScript SDK。

Benchspan

面向 AI agent 的实时安全防护

Benchspan 是一款面向生产环境的 AI agent 安全平台。它将 agent 发现、运行时防护和上线前红队测试结合在一起,帮助团队了解正在运行哪些 agent、检查它们在做什么,并在风险行为产生影响之前将其阻止。

该产品围绕间接提示注入及相关的 agent 威胁构建,例如数据外泄、未授权工具访问、越狱和工具滥用。Benchspan 表示它以内联方式位于请求路径上,评估每个提示、工具调用和响应,并利用已确认的威胁基于你的流量重新训练其分类器。

核心能力

Agent 清单与发现

可自动发现环境中的 agent,包括已批准的、自建的和影子 agent,然后按框架、系统提示和工具模式进行指纹识别。

可追踪性与审计证据

通过工具调用链路关联、按 agent 的活动流、会话回放,以及可用于审计的 PDF 或 CSV 导出,追踪每个 agent 会话。

实时运行时防护

在请求链路中以 inline 方式运行专门训练的分类器和策略引擎,在 agent 执行前识别提示注入、外泄、越狱和工具滥用。

策略控制与响应动作

支持允许、阻止和升级处理决策,以及基于阈值的策略、自定义规则和 Agent Alignment 钩子,用于允许工具、输出规则和意图声明。

运营集成

提供向 Slack、PagerDuty、webhooks 和 SIEM 的外发告警,帮助团队将已确认或可疑活动路由到现有事件工作流中。

红队测试与验证

提供上线前的对抗性测试,附带可复现的发现、修复指导以及修复后的重新测试,并映射到 OWASP Agentic Top 10 和 MITRE ATLAS。

团队使用 Benchspan 的常见方式

  • 梳理环境中的 agent 使用情况

    安全团队和平台团队可以发现环境中的每个 agent,包括影子 agent,并通过会话和工具调用保持可追踪的清单。

  • 保护生产环境中的 agent 流量

    运行面向客户或内部 agent 的团队可以将 Benchspan 放在请求链路中,对提示、工具调用和响应进行检查,并实时阻止可疑行为。

  • 对新版本进行红队测试

    在发布新的 agent 或进行重大变更之前,安全团队可以开展对抗性测试,发现间接提示注入和其他 agent 特有问题。

  • 为事件响应和审计提供数据

    运维团队可以通过导出、会话回放以及到 Slack、PagerDuty、webhooks 或 SIEM 的通知钩子,将已确认的威胁转化为告警和审计证据。

Pros and Cons

Pros

  • 在一个平台中覆盖了三个相邻需求:可观测性、运行时防护和上线前红队测试。
  • 专门围绕间接提示注入和 agent 特有的攻击路径设计,而不是通用的聊天机器人攻击。
  • 包含具体的审计和工作流功能,例如会话回放、按 agent 追踪、导出和外发告警。
  • 提供有文档说明的免费层,每月 50,000 次请求,且无需信用卡即可开始使用。

Cons

  • 所提供 URL 上的定价页面返回 404,因此无法从给定来源确认商业包装。
  • 来源页面未提供受支持框架、云环境或部署边界的完整公开列表。

FAQ

Benchspan 是做什么的?

Benchspan 被定位为面向生产环境中运行的 AI agent 的安全平台。它会对 agent 进行目录化管理、在请求链路中检查请求,并可在 agent 执行前阻止提示注入、数据外泄、越狱以及未授权的工具使用。

Benchspan 如何融入现有技术栈?

来源说明 Benchspan 提供 Python 和 TypeScript SDK,并表示该平台位于请求路径上。它还描述了自动发现 agent 和按会话追踪的能力,但所提供页面未公布完整的集成列表。

团队可以使用该平台的哪些部分?

Benchspan 的产品旨在单独使用或组合使用:AI Observability 用于清单管理和可追踪性,AI Security 用于实时阻断,AI Red Teaming 用于上线前测试。这些产品被呈现为面向 agent 环境的协同层。

是否有免费层或公开定价?

所提供 URL 下的定价页面返回 404,因此来源未能确认当前方案或商业条款。首页确实说明有免费层,每月 50,000 次请求,且无需信用卡即可开始使用。

买家在采用前应核实哪些限制?

已发布的材料强调生产流量、实时防护以及上线前的对抗性测试。它们没有在所提供的来源页面中给出受支持框架、云环境或部署限制的完整列表。

Quick Facts

类别
AI agent 安全平台
主要关注点
提示注入、数据外泄、未授权工具访问
产品
AI Observability、AI Security、AI Red Teaming
提到的 SDK
Python 和 TypeScript
来源域名
benchspan.com
入门方案
免费层,每月 50,000 次请求,永久有效