Koreshield icon

Koreshield

KoreshieldはAIサポート業務向けのランタイムセキュリティ層です。顧客入力、取得コンテキスト、実行予定アクションを検査し、脅威検知や証拠確認、段階的なポリシー適用を支援します。

Koreshield

AIサポート業務向けのランタイムセキュリティ

KoreshieldはAIサポート業務向けのランタイムセキュリティ層です。顧客入力、取得コンテキスト、実行予定アクションを、それらが信頼された指示や実行可能なツール呼び出しになる前に評価し、各境界で個別に判定します。

チームはライブトラフィックと並行して検知モードから開始し、判定の証拠や誤検知を確認したうえで、ワークフローのフォールバック動作を理解できた段階で強制へ移行できます。この製品は、組織の認可システムを置き換えるのではなく、サポートワークフローの近くにセキュリティ判定を追加するよう設計されています。

AIサポート業務向けのランタイムセキュリティ制御

顧客入力の検査

メッセージ、添付ファイル、外部から制御されるテキストをモデルに到達する前に検査し、指示の上書きやその他の信頼できない顧客コンテンツの特定を支援します。

取得コンテキストのスクリーニング

チケット、CRMメモ、RAGドキュメントをスクリーニングし、外部から制御される情報がシステム権限のある指示として扱われないようにします。

提案アクションのチェック

アクションを実行する前に、提案されたツール呼び出しを信頼性、承認、認可の制限に照らして評価します。

検知モードと強制モード

検知モードではライブトラフィックの横で実行してリクエストを中断せずに脅威を記録し、その後、強制モードでポリシーに違反するリクエストを停止します。

判定の証拠

各判定の理由を記録し、想定どおりの動作、見逃し、誤検知を確認するためのリクエスト証拠を保持します。

サーバー側ワークフローのデプロイ

サーバー側のスキャンキーを使用し、FastAPIセキュリティサービスとPostgreSQLをホスト型コンソールまたは既存のサポートインフラストラクチャに接続します。

Koreshieldの適用領域

  • 段階的な本番導入

    リクエストをブロックせずに本番サポートトラフィックの横で検査を実行し、その後、ポリシーを変更したり強制を有効にしたりする前に検知内容と誤検知を確認します。

  • 顧客入力の保護

    サポートモデルに到達したり、その応答に影響を与えたりする前に、顧客メッセージと添付ファイルの指示上書きをチェックします。

  • ナレッジと検索結果の保護

    CRMメモ、汚染されたチケット、RAGドキュメントをスクリーニングし、回答生成中に取得情報が暗黙的にシステム権限を持たないようにします。

  • アクション制御ワークフロー

    実行前に、返金、アカウント操作、その他の提案されたツールアクションを信頼性、承認、認可の制限に照らして評価します。

  • チーム横断の検証

    保持された証拠と判定理由を使用して、セキュリティ、サポート、エンジニアリングの関係者とともに、通常のサポートケースと敵対的なサポートケースを検証します。

Pros and Cons

Pros

  • 顧客入力、取得コンテキスト、提案アクションという3つの異なる信頼境界をカバーします。
  • ブロックしない検知からポリシー適用まで、段階的な導入に対応します。
  • 検証とレビューのために、判定理由と保持された証拠を提供します。
  • ホスト型のStarterおよびGrowthプランを提供し、指定されたデプロイ要件と証拠要件にはカスタムEnterpriseプランで対応します。

Cons

  • サイトでは、認可システムの代替ではなく、攻撃を完全にカバーすることを約束していないと説明されています。
  • 現時点では任意のファイルや画像は検査されません。
  • 文書化されたデプロイにはPostgreSQLを使用するFastAPIセキュリティサービスが必要です。その他のプラットフォームとの統合に関する詳細は提供されていません。

FAQ

Koreshieldはどのようにデプロイしますか?

Koreshieldはサポート業務の近くで実行されることを想定しています。文書化されたデプロイ境界は、FastAPIセキュリティサービスとPostgreSQLで構成され、ホスト型コンソールまたは組織独自のサポートインフラストラクチャに接続されます。

チームはKoreshieldをどのように導入すべきですか?

文書化された導入手順は、サーバー側のスキャンキーを作成し、ライブトラフィックの横で検知モードを実行し、証拠、見逃し、誤検知を確認したうえで、フォールバック動作を理解できた段階でのみ強制モードを有効にするというものです。

Koreshieldは検査したリクエストに対して何を返しますか?

Koreshieldは各判定の理由を記録し、検査したリクエストに関連する証拠を保持できます。デモでは、判定、重大度、信頼度、保持された証拠などの出力も説明されています。

KoreshieldはAIサポート業務のどの部分を検査しますか?

3つのワークフロー境界を独立して評価します。モデル実行前の顧客入力、チケットやRAGドキュメントなどの取得コンテキスト、そして実行前の提案されたツールアクションです。

Koreshieldにはどのような制限がありますか?

サイトでは、Koreshieldは認可システムの代替ではなく、攻撃を完全にカバーすることを約束しておらず、現時点では任意のファイルや画像を検査せず、高リスクエージェントを自律化するものでもないと説明されています。

Quick Facts

カテゴリー
AIセキュリティ / 開発者ツール
主なワークフロー
AIを活用したカスタマーサポート
信頼境界
顧客入力、取得コンテキスト、提案アクション
デプロイ境界
PostgreSQLを使用するFastAPIセキュリティサービス、ホスト型コンソールまたは独自のサポートインフラストラクチャ
導入モード
検知と強制
評価
7日間、カード不要、最大10,000件の保護対象リクエスト

Koreshieldの代替品

CreateOS Sandbox icon

CreateOS Sandbox

CreateOS Sandboxは、FirecrackerマイクロVM上でコードやエージェントのワークロードを実行できる分離型コンピュート環境です。SDK、CLI、MCPで制御可能。

Codex Plugins icon

Codex Plugins

Codex Plugins は、再利用可能なスキル、アプリ連携、MCPサーバーを Codex app や Codex CLI で使えるワークフローにまとめます。接続サービスの作業や共有チームワークフローを拡張できます。

Wallie icon

Wallie

Wallieは、画面を見てチャットを聞き、設定したペルソナでライブ解説を生成するオープンソースAI streamer。自分のキーでローカル実行でき、顔出しなし配信や自律配信、リアルタイム反応に最適です。

AakarDev AI icon

AakarDev AI

AakarDev AIは、AIプロバイダーのアクセス管理、プロジェクト別設定、ログ、分析を1つのダッシュボードで管理できるチーム向けツールです。BYOKに対応し、OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AIをサポートします。

Trigger.dev chat agent icon

Trigger.dev chat agent

Trigger.dev chat agentは、リフレッシュやクラッシュ、長時間の会話も維持できる、開発者向けの耐久性あるAIチャットバックエンドです。AI SDKのuseChatに対応し、ターンにタイムアウトがありません。

Whirr icon

Whirr

Whirrは、Claude Codeの動作をMacのノッチに静かに表示するmacOSメニューバーアプリです。ターミナルを開かずに進捗を確認できます。

Koreshield - AI Tool, Features, Use Cases & Alternatives | UStack