構造化されたモデレーション結果
重大度レベルをNONEからSEVEREまで設定し、0.0から2.0までの連続的な重大度スコアとともに、不適切表現と有害性を個別に判定して返します。
gg-friggin-ezは、不適切表現、有害性、敵意、嫌がらせ、個人攻撃についてユーザー生成テキストをスクリーニングするオープンソースのNode.jsパッケージです。リートスピーク、挿入された空白、反復文字、ローマ字表記、コード混在、異なる文字体系の混在など、単純なキーワードリストを回避しうるコンテンツ向けに設計されています。
このパッケージは、会話形式の応答を生成するのではなく、System 1の判定モデルを使用します。デフォルトのTypeSafe AI Jev構成では、不適切表現や有害性のフラグ、重大度、検出言語、難読化の種類、推奨アクション、計測リクエストレイテンシなどのモデレーションシグナルを返します。開発者は、素早いチェックには真偽値ヘルパーを使用し、完全な結果が必要な場合はscreen()を呼び出せます。
重大度レベルをNONEからSEVEREまで設定し、0.0から2.0までの連続的な重大度スコアとともに、不適切表現と有害性を個別に判定して返します。
リートスピーク、文字間への空白挿入、文字の反復、記号による置換、ローマ字表記、コード混在、異なる文字体系の混在など、一般的な回避パターンを検出します。
ベンガル語、マラヤーラム語、ヒンディー語、タミル語、テルグ語、カンナダ語を含む英語およびインド系言語のコンテンツに対応し、READMEで説明されている翻字入力もカバーします。
isProfane()とisToxic()の便利な関数に加え、複数のモデレーションシグナルを返す単一リクエスト用のscreen()を提供します。
デフォルトのSystem 1モデルとしてTypeSafe AI Jevを使用し、screener設定を通じて別の分類器やカスタムスキーマを指定できます。
コンテンツをALLOW、SUSPICIOUS_REVIEW、AUTO_CENSOR、AUTO_BANに分類でき、自動処理と、判断が曖昧なケースのレビュー経路を併用できます。
メッセージを公開する前にモデレーションチェックを実行し、アクションと重大度のフィールドを使って、コンテンツの許可、レビュー対象としてのフラグ付け、検閲、ブロックを行います。
短い応答時間と難読化の検出が重要な、プレイヤーメッセージやゲーム内テキスト通信をスクリーニングします。
翻字された、またはコード混在した地域言語の不適切な表現を含む可能性があるコメント、レビュー、マーケットプレイス上の会話を評価します。
詳細な言語フィールドと難読化フィールドを使って、トラスト&セーフティのキューを支援し、ユーザーがどのようにフィルターを回避しているかを調査します。
カスタムスキーマを指定するか、screener設定を通じてデフォルトの分類器を置き換えることで、ドメイン固有のモデレーションワークフローを構築します。
npm、Yarn、pnpm、またはBunでパッケージをインストールします。Node.js 18以降、またはBunが必要で、ESM、CommonJS、TypeScript型定義をバンドルしたビルドを提供します。APIリクエストにはOpenRouter APIキーが必要で、環境変数から指定するか、createScreener()に渡せます。
個別の真偽値チェックにはisProfane()またはisToxic()を使用します。重大度、言語、検出された難読化、推奨アクション、計測レイテンシを含む完全なモデレーション結果が必要な場合は、screen()を使用します。
デフォルト設定ではTypeSafe AI Jevを使用します。また、system1オプションを通じて別のSystem 1分類器を指定できます。カスタムのスクリーニングスキーマにも対応しています。
READMEでは、ベンガル語、マラヤーラム語、ヒンディー語、タミル語、テルグ語、カンナダ語を含む英語およびインド系言語への対応が説明されています。ローマ字表記または翻字されたテキスト、コード混在、リートスピーク、文字間への空白挿入、文字の反復、異なる文字体系の混在を処理することを想定しています。
プロジェクトでは、デフォルトのJev構成でエンドツーエンドの標準的なレイテンシが約50~500ミリ秒と説明されています。ただし、実際のレイテンシはscreen()の結果として返され、推論リクエストやデプロイ環境の条件によって異なります。READMEには、isProfane()またはisToxic()を呼び出すたびに推論リクエストが発生することも記載されています。
Writecream AI Content Detector は、貼り付けた文章がAI作成か人間作成かを判定する無料のWebツールです。AI率を表示し、SEO、学術、出版、レビュー監査に役立ちます。
Winston AIは、テキストと画像のAI生成・重複コンテンツを検出するAIコンテンツ検出・盗用チェックツールです。教育機関、出版社などの原稿確認、結果共有、記録作成に役立ちます。
Verolは、ChatGPT、Claude、Gemini、Grok内でAIの幻覚と主張をリアルタイムに検証するChrome拡張です。研究者、法律専門職、ジャーナリスト、アナリスト向け。
Honestlyは、SNS投稿をブランド向けの構造化された製品シグナルに変換します。Reddit、TikTok、YouTube、Instagram、Xの検証済み意見をもとに、感情分析、トレンド追跡、アフィリエイト発見、商品ページでの社会的証明に対応します。
tata.runは、AI検出率を大幅に低下させるワンクリックの「AI削減」機能を提供する、プロフェッショナルな無料AIコンテンツ検出器です。
学术猹は网易有道が提供する论文一站式処理プラットフォーム。查重、查AI、降重、降AIに対応し、Word、PDF、TXTなどの形式と毎日の無料検査枠をサポート。