Koreshield icon

Koreshield

Koreshield 是 AI 客服工作流程的執行階段安全層,檢查客戶輸入、擷取內容與建議動作,協助團隊偵測威脅、檢視證據並分階段執行政策。

Koreshield

AI 客服工作流程的執行階段安全性

Koreshield 是 AI 客服工作流程的執行階段安全層。在客戶輸入、擷取內容與建議動作成為受信任的指令或可執行的工具呼叫前,Koreshield 會進行評估,並在每個邊界分別做出決策。

團隊可以先在即時流量旁以偵測模式開始,檢視決策證據與誤報,並在了解工作流程的備援行為後轉為強制執行。此產品旨在將安全決策加入客服工作流程附近,而非取代組織的授權系統。

AI 客服工作流程的執行階段安全控制

客戶輸入檢查

在訊息、附件與外部控制的文字抵達模型前進行檢查,協助識別指令覆寫及其他不受信任的客戶內容。

擷取內容篩選

檢查客服票券、CRM 備註與 RAG 文件,避免外部控制的資料被視為具系統權威的指令。

建議動作檢查

在動作執行前,根據信任、核准與授權限制評估建議的工具呼叫。

偵測與強制模式

在偵測模式下與即時流量並行運作,記錄威脅而不中斷請求;接著使用強制模式停止違反政策的請求。

決策證據

記錄每個決策的原因,並保留請求證據,以檢視預期行為、漏報與誤報。

伺服器端工作流程部署

使用伺服器端掃描金鑰,將搭配 PostgreSQL 的 FastAPI 安全服務連接至託管主控台或現有的客服基礎架構。

Koreshield 的適用場景

  • 經過衡量的正式環境推出

    在不中斷請求的情況下,讓檢查與正式環境的客服流量並行運作,接著在變更政策或啟用強制執行前檢視偵測結果與誤報。

  • 客戶輸入保護

    在客戶訊息與附件抵達客服模型或影響其回應前,檢查其中是否存在指令覆寫。

  • 知識與擷取內容保護

    檢查 CRM 備註、遭污染的客服票券與 RAG 文件,避免擷取資料在產生回答時無聲地取得系統權威。

  • 動作閘控工作流程

    在執行退款、帳戶或其他建議的工具動作前,根據信任、核准與授權限制進行評估。

  • 跨團隊驗證

    使用保留的證據與決策原因,與安全性、客服及工程利害關係人一起驗證正常與對抗性客服案例。

Pros and Cons

Pros

  • 涵蓋三個不同的信任邊界:客戶輸入、擷取內容與建議動作。
  • 支援從非阻斷式偵測到政策強制執行的分階段推出。
  • 提供決策原因與保留的證據,以供驗證與檢視。
  • 提供託管式 Starter 與 Growth 方案,並針對特定的部署與證據需求提供自訂 Enterprise 方案。

Cons

  • 網站表示它不會取代授權系統,也不承諾涵蓋所有攻擊。
  • 目前不會檢查任意檔案與圖片。
  • 文件所述的部署需要搭配 PostgreSQL 的 FastAPI 安全服務;未提供其他平台的整合細節。

FAQ

Koreshield 如何部署?

Koreshield 的設計是在接近客服工作流程的位置執行。文件所述的部署邊界是搭配 PostgreSQL 的 FastAPI 安全服務,連接至託管主控台或組織自有的客服基礎架構。

團隊應如何推出 Koreshield?

文件所述的推出方式是建立伺服器端掃描金鑰,在即時流量旁以偵測模式執行,檢視證據、漏報與誤報,並僅在了解備援行為後啟用強制執行。

Koreshield 會為受檢請求回傳哪些內容?

Koreshield 會記錄每個決策的原因,也能保留與受檢請求相關的證據。示範內容也說明輸出包括決策、嚴重性、信心度與保留的證據。

Koreshield 會檢查 AI 客服工作流程的哪些部分?

它會獨立評估工作流程中的三個邊界:模型執行前的客戶輸入、票券或 RAG 文件等擷取內容,以及執行前的建議工具動作。

Koreshield 宣稱有哪些限制?

網站指出,Koreshield 不會取代授權系統、不承諾涵蓋所有攻擊,目前也不會檢查任意檔案或圖片,且不會讓高風險代理程式自主運作。

Quick Facts

類別
AI 安全性/開發者工具
主要工作流程
AI 驅動的客服
信任邊界
客戶輸入、擷取內容、建議動作
部署邊界
搭配 PostgreSQL 的 FastAPI 安全服務;託管主控台或自有客服基礎架構
推出模式
偵測與強制執行
評估方案
7 天、免信用卡、最多 10,000 個受保護請求
Koreshield - AI Tool, Features, Use Cases & Alternatives | UStack