客户输入检查
在消息、附件和外部控制的文本到达模型前进行检查,帮助识别指令覆盖及其他不可信的客户内容。
Koreshield 是面向 AI 客服工作流的运行时安全层。它会在客户输入、检索上下文和拟执行操作成为可信指令或可执行工具调用前对其进行评估,并在每个边界分别作出决策。
团队可以先在实时流量旁以检测模式运行,审查决策证据和误报,并在了解工作流的回退行为后转为强制执行。该产品旨在将安全决策置于靠近客服工作流的位置,而不是替代组织的授权系统。
在消息、附件和外部控制的文本到达模型前进行检查,帮助识别指令覆盖及其他不可信的客户内容。
筛查工单、CRM 备注和 RAG 文档,避免外部控制的材料被当作系统权威指令。
在操作执行前,根据信任、审批和授权限制评估拟执行的工具调用。
在检测模式下伴随实时流量运行,记录威胁而不中断请求;随后使用强制执行模式阻止违反策略的请求。
记录每项决策的原因,并保留请求证据,以便审查预期行为、漏检和误报。
使用服务器端扫描密钥,并将配合 PostgreSQL 的 FastAPI 安全服务连接到托管控制台或现有客服基础设施。
在生产客服流量旁运行检查而不阻止请求,然后在更改策略或启用强制执行前审查检测结果和误报。
在客户消息和附件到达客服模型或影响其响应前,检查其中是否存在指令覆盖。
筛查 CRM 备注、中毒工单和 RAG 文档,避免检索材料在生成答案期间无提示地继承系统权限。
在执行前,根据信任、审批和授权限制评估退款、账户或其他拟执行的工具操作。
使用保留的证据和决策原因,与安全、客服和工程相关方一起验证良性及对抗性客服案例。
Koreshield 旨在靠近客服工作流运行。文档所述的部署边界是一个配合 PostgreSQL 的 FastAPI 安全服务,可连接托管控制台或组织自有的客服基础设施。
文档所述的发布流程是创建服务器端扫描密钥,在实时流量旁运行检测模式,审查证据、漏检和误报,并仅在了解回退行为后启用强制执行。
Koreshield 会记录每项决策的原因,并可保留与受检请求相关的证据。演示还介绍了包括决策结果、严重性、置信度和保留证据在内的输出。
它会独立评估工作流中的三个边界:模型执行前的客户输入、工单或 RAG 文档等检索上下文,以及执行前的拟执行工具操作。
该网站表示,Koreshield 不会替代授权系统,不承诺覆盖所有攻击,目前不检查任意文件或图像,也不会让高风险代理实现自主运行。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。
Codex Plugins 将可复用技能、应用集成和 MCP 服务器打包为工作流,可在 Codex 应用中安装或通过 Codex CLI 使用,帮助扩展连接服务任务、复用指令和团队共享流程。
Wallie 是一款开源 AI 直播助手,能观看屏幕、聆听聊天并以可配置人设生成实时解说。支持本地运行、使用自有密钥,适合无真人出镜内容、自动化直播和实时互动。
AakarDev AI 帮助团队在一个仪表板中管理 AI provider 访问、项目级设置、日志和分析,支持 BYOK 工作流,并涵盖 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI 和 Perplexity AI。
Trigger.dev chat agent 是面向开发者的持久化 AI 聊天后端,支持有状态对话在刷新、崩溃和长轮次中持续运行,并与 AI SDK `useChat` 流程无缝连接,运行于托管基础设施,单轮无超时。
Whirr 是一款安静的 macOS 菜单栏应用,可将 Claude Code 活动镜像到刘海区域,让你无需打开终端窗口也能一眼查看代理进度。