結構化審核結果
回傳分開的髒話與毒性判定,嚴重程度等級從 NONE 到 SEVERE,並提供 0.0 到 2.0 的連續嚴重程度分數。
gg-friggin-ez 是一個開源 Node.js 套件,用於篩選使用者生成文字中的髒話、毒性、敵意、騷擾及人身攻擊。它專為可能避開簡單關鍵字清單的內容而設計,包括 leetspeak、插入空格、重複字元、羅馬化語言、混合語言文字及混合文字系統。
此套件使用 System 1 決策模型,而非產生對話式回應。其預設的 TypeSafe AI Jev 設定會回傳髒話及毒性標記、嚴重程度、偵測到的語言、混淆類型、建議動作及測得的請求延遲等審核訊號。開發者可以使用布林輔助函式進行快速檢查,或在需要完整結果時呼叫 screen()。
回傳分開的髒話與毒性判定,嚴重程度等級從 NONE 到 SEVERE,並提供 0.0 到 2.0 的連續嚴重程度分數。
偵測常見的規避模式,例如 leet 語、分隔字元、重複字元、符號替換、羅馬化、混合語言及混合文字系統。
支援英文及印度語言內容,包括孟加拉文、馬拉雅拉姆文、印地文、泰米爾文、泰盧固文及卡納達文,並涵蓋 README 所述的轉寫輸入。
提供 isProfane() 和 isToxic() 便捷函式,以及可針對單一請求回傳多項審核訊號的 screen()。
使用 TypeSafe AI Jev 作為預設的 System 1 模型,並可透過 screener 設定使用不同的分類器或自訂結構。
可將內容分類為 ALLOW、SUSPICIOUS_REVIEW、AUTO_CENSOR 或 AUTO_BAN,在支援自動處理的同時,為模稜兩可的案例提供人工審查流程。
在發布訊息前執行審核檢查,利用動作和嚴重程度欄位來允許、標記待審查、審查或封鎖內容。
篩選玩家訊息及遊戲內文字通訊,適用於需要快速回應及混淆偵測的情境。
評估可能包含轉寫或混合語言區域語言辱罵內容的留言、評論或市集對話。
使用詳細的語言及混淆欄位支援信任與安全佇列,並調查使用者如何規避篩選器。
透過提供自訂結構或在 screener 設定中替換預設分類器,建立特定領域的審核工作流程。
使用 npm、Yarn、pnpm 或 Bun 安裝套件。此套件需要 Node.js 18 或更新版本,或 Bun,並提供 ESM、CommonJS 及內含 TypeScript 型別的建置版本。API 請求需要 OpenRouter API 金鑰,可透過環境變數提供,或傳入 createScreener()。
個別布林檢查請使用 isProfane() 或 isToxic()。如果需要完整的審核結果,請使用 screen(),其中包含嚴重程度、語言、偵測到的混淆方式、建議動作及測得的延遲。
預設設定使用 TypeSafe AI Jev,而套件支援透過 system1 選項提供其他 System 1 分類器,也支援自訂審核結構。
README 說明支援英文及印度語言,包括孟加拉文、馬拉雅拉姆文、印地文、泰米爾文、泰盧固文及卡納達文。此套件旨在處理羅馬化或轉寫文字、混合語言、leet 語、字元間插入空格、重複字元及混合文字系統。
專案說明使用預設 Jev 設定時,典型的端到端延遲約為 50–500 毫秒,但實際延遲會回傳在 screen() 結果中,並取決於推論請求及部署條件。README 也指出,每次呼叫 isProfane() 或 isToxic() 都會觸發一次推論請求。
Writecream AI Content Detector 是一款免費網頁工具,可檢查貼上的文字看起來是由 AI 還是人類撰寫,並提供 AI 內容百分比,適用於 SEO、學術、出版與評論審核。
Winston AI 是用於檢測 AI 生成內容與抄襲的工具,可審查文字與圖片是否疑似由機器生成或重複,適合教育、機構與出版工作者使用。
Verol 是一款 Chrome 擴充功能,可在 ChatGPT、Claude、Gemini 與 Grok 內即時偵測 AI 幻覺並查核主張,適合研究人員、法律專業、記者與分析師快速事實查核。
Honestly 將社群貼文轉為品牌可用的結構化產品訊號,支援情緒分析、趨勢追蹤、聯盟行銷探索,並可用來嵌入由 Reddit、TikTok、YouTube、Instagram、X 驗證意見組成的頁面社會證明。
tata.run 是一款專業的免費 AI 內容檢測器,提供一鍵「減少 AI」功能,以顯著降低 AI 檢測率。
學術猹是由网易有道推出的論文一站式處理平台,提供查重、查 AI、降重與降 AI 服務,支援常見文檔格式,並有每日免費檢測額度,適合論文提交前檢測與處理。