客戶輸入檢查
在訊息、附件與外部控制的文字抵達模型前進行檢查,協助識別指令覆寫及其他不受信任的客戶內容。
Koreshield 是 AI 客服工作流程的執行階段安全層。在客戶輸入、擷取內容與建議動作成為受信任的指令或可執行的工具呼叫前,Koreshield 會進行評估,並在每個邊界分別做出決策。
團隊可以先在即時流量旁以偵測模式開始,檢視決策證據與誤報,並在了解工作流程的備援行為後轉為強制執行。此產品旨在將安全決策加入客服工作流程附近,而非取代組織的授權系統。
在訊息、附件與外部控制的文字抵達模型前進行檢查,協助識別指令覆寫及其他不受信任的客戶內容。
檢查客服票券、CRM 備註與 RAG 文件,避免外部控制的資料被視為具系統權威的指令。
在動作執行前,根據信任、核准與授權限制評估建議的工具呼叫。
在偵測模式下與即時流量並行運作,記錄威脅而不中斷請求;接著使用強制模式停止違反政策的請求。
記錄每個決策的原因,並保留請求證據,以檢視預期行為、漏報與誤報。
使用伺服器端掃描金鑰,將搭配 PostgreSQL 的 FastAPI 安全服務連接至託管主控台或現有的客服基礎架構。
在不中斷請求的情況下,讓檢查與正式環境的客服流量並行運作,接著在變更政策或啟用強制執行前檢視偵測結果與誤報。
在客戶訊息與附件抵達客服模型或影響其回應前,檢查其中是否存在指令覆寫。
檢查 CRM 備註、遭污染的客服票券與 RAG 文件,避免擷取資料在產生回答時無聲地取得系統權威。
在執行退款、帳戶或其他建議的工具動作前,根據信任、核准與授權限制進行評估。
使用保留的證據與決策原因,與安全性、客服及工程利害關係人一起驗證正常與對抗性客服案例。
Koreshield 的設計是在接近客服工作流程的位置執行。文件所述的部署邊界是搭配 PostgreSQL 的 FastAPI 安全服務,連接至託管主控台或組織自有的客服基礎架構。
文件所述的推出方式是建立伺服器端掃描金鑰,在即時流量旁以偵測模式執行,檢視證據、漏報與誤報,並僅在了解備援行為後啟用強制執行。
Koreshield 會記錄每個決策的原因,也能保留與受檢請求相關的證據。示範內容也說明輸出包括決策、嚴重性、信心度與保留的證據。
它會獨立評估工作流程中的三個邊界:模型執行前的客戶輸入、票券或 RAG 文件等擷取內容,以及執行前的建議工具動作。
網站指出,Koreshield 不會取代授權系統、不承諾涵蓋所有攻擊,目前也不會檢查任意檔案或圖片,且不會讓高風險代理程式自主運作。
CreateOS Sandbox 是以 Firecracker micro-VM 執行程式與 agent 工作負載的隔離運算環境,支援私有網路、SDK、CLI 與 MCP 程式化控制。
Codex Plugins 將可重用技能、應用程式整合與 MCP 伺服器打包成可安裝到 Codex app 或在 Codex CLI 使用的工作流程,方便延伸 Codex 的連線服務任務、重複使用指令與團隊共享流程。
Wallie 是開源 AI streamer,可觀看你的螢幕、聆聽聊天室,並以可設定的人設即時生成直播評論;支援本機執行與自有金鑰,適合無真人出鏡、自治直播與即時互動。
AakarDev AI 讓團隊透過單一儀表板管理 AI 供應商權限、專案設定、日誌與分析,支援 BYOK 工作流程,並可連接 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AI。
Trigger.dev chat agent 是專為開發者打造的持久化 AI 聊天後端,支援有狀態對話、刷新與當機後續接、長時間回合,並可搭配 AI SDK `useChat` 與託管基礎架構,單回合無逾時。
Whirr 是一款安靜的 macOS 選單列 app,可將 Claude Code 活動同步到 Mac 瀏海區域,讓你無需開著終端機也能即時查看 agent 進度。