Koreshield icon

Koreshield

Koreshield 是面向 AI 客服工作流的运行时安全层,可在模型处理或工具调用前检查客户输入、检索上下文与拟执行操作,帮助团队检测威胁、审查证据并分阶段执行策略。

Koreshield

面向 AI 客服工作流的运行时安全

Koreshield 是面向 AI 客服工作流的运行时安全层。它会在客户输入、检索上下文和拟执行操作成为可信指令或可执行工具调用前对其进行评估,并在每个边界分别作出决策。

团队可以先在实时流量旁以检测模式运行,审查决策证据和误报,并在了解工作流的回退行为后转为强制执行。该产品旨在将安全决策置于靠近客服工作流的位置,而不是替代组织的授权系统。

面向 AI 客服工作流的运行时安全控制

客户输入检查

在消息、附件和外部控制的文本到达模型前进行检查,帮助识别指令覆盖及其他不可信的客户内容。

检索上下文筛查

筛查工单、CRM 备注和 RAG 文档,避免外部控制的材料被当作系统权威指令。

拟执行操作检查

在操作执行前,根据信任、审批和授权限制评估拟执行的工具调用。

检测与强制执行模式

在检测模式下伴随实时流量运行,记录威胁而不中断请求;随后使用强制执行模式阻止违反策略的请求。

决策证据

记录每项决策的原因,并保留请求证据,以便审查预期行为、漏检和误报。

服务端工作流部署

使用服务器端扫描密钥,并将配合 PostgreSQL 的 FastAPI 安全服务连接到托管控制台或现有客服基础设施。

Koreshield 的适用场景

  • 可衡量的生产发布

    在生产客服流量旁运行检查而不阻止请求,然后在更改策略或启用强制执行前审查检测结果和误报。

  • 客户输入保护

    在客户消息和附件到达客服模型或影响其响应前,检查其中是否存在指令覆盖。

  • 知识与检索保护

    筛查 CRM 备注、中毒工单和 RAG 文档,避免检索材料在生成答案期间无提示地继承系统权限。

  • 操作门控工作流

    在执行前,根据信任、审批和授权限制评估退款、账户或其他拟执行的工具操作。

  • 跨团队验证

    使用保留的证据和决策原因,与安全、客服和工程相关方一起验证良性及对抗性客服案例。

Pros and Cons

Pros

  • 覆盖三个不同的信任边界:客户输入、检索上下文和拟执行操作。
  • 支持从非阻断式检测到策略强制执行的分阶段发布。
  • 提供决策原因和保留的证据,便于验证与审查。
  • 提供托管式 Starter 和 Growth 计划,并针对特定的部署与证据要求提供定制化 Enterprise 方案。

Cons

  • 该网站表示,Koreshield 不会替代授权系统,也不承诺覆盖所有攻击。
  • 目前不检查任意文件和图像。
  • 文档所述的部署需要配合 PostgreSQL 的 FastAPI 安全服务;未提供其他平台的集成详情。

FAQ

Koreshield 如何部署?

Koreshield 旨在靠近客服工作流运行。文档所述的部署边界是一个配合 PostgreSQL 的 FastAPI 安全服务,可连接托管控制台或组织自有的客服基础设施。

团队应如何推出 Koreshield?

文档所述的发布流程是创建服务器端扫描密钥,在实时流量旁运行检测模式,审查证据、漏检和误报,并仅在了解回退行为后启用强制执行。

Koreshield 会为受检请求返回哪些内容?

Koreshield 会记录每项决策的原因,并可保留与受检请求相关的证据。演示还介绍了包括决策结果、严重性、置信度和保留证据在内的输出。

Koreshield 会检查 AI 客服工作流的哪些部分?

它会独立评估工作流中的三个边界:模型执行前的客户输入、工单或 RAG 文档等检索上下文,以及执行前的拟执行工具操作。

Koreshield 明确有哪些限制?

该网站表示,Koreshield 不会替代授权系统,不承诺覆盖所有攻击,目前不检查任意文件或图像,也不会让高风险代理实现自主运行。

Quick Facts

类别
AI 安全 / 开发者工具
主要工作流
AI 驱动的客户支持
信任边界
客户输入、检索上下文、拟执行操作
部署边界
配合 PostgreSQL 的 FastAPI 安全服务;托管控制台或自有客服基础设施
发布模式
检测与强制执行
评估
7 天,无需银行卡,最多 10,000 个受保护请求