结构化审核结果
返回独立的脏话和毒性判定,严重程度从 NONE 到 SEVERE,并提供 0.0 到 2.0 的连续严重程度分数。
gg-friggin-ez 是一个开源 Node.js 包,用于筛查用户生成文本中的脏话、毒性、敌意、骚扰和人身攻击。它专为可能绕过简单关键词列表的内容而设计,包括 leet 文字、插入空格、重复字符、罗马化语言、混合语言文本和混合文字系统。
该包使用 System 1 决策模型,而不是生成对话式回复。其默认的 TypeSafe AI Jev 配置会返回脏话和毒性标记、严重程度、检测到的语言、混淆类型、建议操作以及测得的请求延迟等审核信号。开发者可以使用布尔辅助函数进行快速检查,也可以在需要完整结果时调用 screen()。
返回独立的脏话和毒性判定,严重程度从 NONE 到 SEVERE,并提供 0.0 到 2.0 的连续严重程度分数。
检测常见的规避模式,例如 leet 文字、分隔字符、重复字符、符号替换、罗马化、混合语言和混合文字系统。
支持英语和印度语言内容,包括孟加拉语、马拉雅拉姆语、印地语、泰米尔语、泰卢固语和卡纳达语,并覆盖 README 中所述的转写输入。
提供 isProfane() 和 isToxic() 便捷函数,以及用于单次请求并返回多个审核信号的 screen()。
默认使用 TypeSafe AI Jev 作为 System 1 模型,并可通过 screener 配置使用其他分类器或自定义架构。
可以将内容分类为 ALLOW、SUSPICIOUS_REVIEW、AUTO_CENSOR 或 AUTO_BAN,在支持自动处理的同时,也为模糊案例提供审核路径。
在发布消息前执行审核检查,利用操作和严重程度字段来允许、标记待审核、审查或屏蔽内容。
筛查玩家消息和游戏内文字通信,适用于响应时间短且混淆检测很重要的场景。
评估评论、评价或交易市场对话,其中可能包含转写或混合语言的地区性辱骂内容。
使用详细的语言和混淆字段来支持信任与安全审核队列,并调查用户如何规避过滤器。
通过提供自定义架构,或在 screener 配置中替换默认分类器,构建特定领域的审核工作流。
使用 npm、Yarn、pnpm 或 Bun 安装此包。它要求 Node.js 18 或更高版本,或使用 Bun,并提供 ESM、CommonJS 以及内置 TypeScript 类型声明构建。API 请求需要 OpenRouter API 密钥,可通过环境变量提供,也可传递给 createScreener()。
对于单独的布尔检查,请使用 isProfane() 或 isToxic()。当需要完整的审核结果时,请使用 screen(),其中包括严重程度、语言、检测到的混淆方式、建议操作和测得的延迟。
默认配置使用 TypeSafe AI Jev;该包支持通过 system1 选项提供其他 System 1 分类器。也支持自定义审核架构。
README 描述了对英语和印度语言的支持,包括孟加拉语、马拉雅拉姆语、印地语、泰米尔语、泰卢固语以及卡纳达语。该包旨在处理罗马化或转写文本、混合语言、leet 文字、字符间插入空格、重复字符和混合文字系统。
项目说明,在默认 Jev 配置下,典型端到端延迟约为 50–500 毫秒,但实际延迟会在 screen() 结果中返回,并取决于推理请求和部署条件。README 还指出,每次调用 isProfane() 或 isToxic() 都会触发一次推理请求。
Writecream AI Content Detector 是一款免费网页工具,可检测粘贴文本更像 AI 还是人工撰写,返回 AI 内容百分比,适用于 SEO、学术、出版和评论审核。
Winston AI 是一款 AI 内容检测与抄袭检查工具,可审核文本和图片中的疑似机器生成或重复内容,适合教育机构、出版社及其他需要查重、记录结果并共享报告的用户。
Verol 是一款 Chrome 扩展,可在 ChatGPT、Claude、Gemini 和 Grok 中实时检测 AI 幻觉并核查陈述,适合研究人员、法律从业者、记者和分析师进行更快的事实核查。
Honestly 将社交帖子转化为品牌可用的结构化产品信号,支持情绪分析、趋势追踪、联盟发现,并基于 Reddit、TikTok、YouTube、Instagram 和 X 的已验证观点提供页面社交证明。
tata.run 是一款专业的免费 AI 内容检测器,提供一键“减少 AI”功能,以显著降低 AI 检测率。
学术猹是网易有道推出的论文一站式处理平台,提供查重、查AI、降重和降AI服务,支持常见文档格式与每日免费检测额度,适合论文提交前检测与处理。