实时指拼识别
从摄像头输入中实时识别美国手语手指拼写的手势字母表(A–Z)。
signspell 是一个用于实时识别美国手语指拼的 Python 包。它专注于手势字母表,使用摄像头视频实时识别 A 到 Z 的字母。
该项目内置预训练模型、精美的摄像头界面,以及命令行和库两种入口。它面向希望立即运行实时识别,或将识别器嵌入自有代码并逐帧处理的用户。
从摄像头输入中实时识别美国手语手指拼写的手势字母表(A–Z)。
使用 MediaPipe 手部跟踪与基于 30 帧关键点序列训练的 LSTM 模型。
内置预训练模型和精美的摄像头界面,可立即使用。
可作为命令行工具运行,也可作为 Python 库导入。
支持在 CLI 中调整摄像头选择、置信度阈值以及镜像视图切换。
接受自定义模型路径,并对输入形状和输出类别有文档说明。
当你想把摄像头对准手语使用者的手,并获得实时的 A–Z 字母预测,用于指拼练习或演示时,可以使用 signspell。
当你想快速、无需编码地测试内置模型、切换摄像头或调整置信度阈值时,可以运行 CLI。
当你需要逐帧识别并希望将识别器集成到自定义 Python 代码中时,可以在自己的应用中导入该库。
当你已经有训练好的 `.h5` 模型,并且想用自己的权重来使用 signspell 的摄像头工作流时,可以加载自定义模型。
它是一个可通过 `pip install signspell` 安装的 Python 包。项目页面还显示了版本化发布 `1.0.1`。
该包可通过摄像头实时运行美国手语指拼识别。它可实时识别指文字母表(A–Z),并且可以从命令行启动或作为库导入。
项目页面说明 signspell 需要 Python 3.9–3.11,以及用于实时识别的摄像头。
可以。项目包含 `--model path/to/your_model.h5` 选项和 `Recognizer(model_path=...)` 构造函数,因此只要你的模型符合预期的输入和输出形状,就可以将其指向你自己的模型。
源码描述列出了界面的窗口内控制:`q` 退出,`c` 清空句子,`SPACE` 插入空格。
Snapmark 是一款 VS Code 扩展,可在将剪贴板截图粘贴到 AI 聊天前进行标注。支持模糊遮盖、编号标注与大图自动缩放。
Arduino VENTUNO Q 是面向 AI 和机器人应用的边缘 AI 计算机,单板集成 AI 推理与确定性控制,并支持 Arduino App Lab。
免费的 Person Pixelizer C++ 人物像素化项目,使用 OpenCV 和神经网络分割在视频中匿名化人物,适合开发隐私优先的实时视频或基于浏览器的计算机视觉应用。
Faceswapai.Online 是一款基于网页的 AI 换脸工具,支持照片和视频、单人及多人换脸流程;可免费试用,无需注册,另有按积分计费的 VIP 功能,适合更大或更长任务。
Vectorizer.AI 可将位图转换为 SVG、PDF、EPS、DXF 等可编辑矢量图,支持浏览器预览和开发者自动化工具,适合 logo、插画、草图和扫描件转换。
Recume 是一款基于网页的 AI 汽车扫描工具,可分析汽车部件照片或短视频,返回诊断、维修费用估算和后续指导,帮助车主在见技师前先快速了解车辆问题。