signspell icon

signspell

signspell 是一个用于通过摄像头实时识别美国手语指拼的 Python 包。可通过命令行或库调用,内置预训练模型和摄像头界面。

signspell

概览

signspell 是一个用于实时识别美国手语指拼的 Python 包。它专注于手势字母表,使用摄像头视频实时识别 A 到 Z 的字母。

该项目内置预训练模型、精美的摄像头界面,以及命令行和库两种入口。它面向希望立即运行实时识别,或将识别器嵌入自有代码并逐帧处理的用户。

功能

实时指拼识别

从摄像头输入中实时识别美国手语手指拼写的手势字母表(A–Z)。

基于序列的识别流程

使用 MediaPipe 手部跟踪与基于 30 帧关键点序列训练的 LSTM 模型。

内置模型和界面

内置预训练模型和精美的摄像头界面,可立即使用。

CLI 和库用法

可作为命令行工具运行,也可作为 Python 库导入。

运行时控制

支持在 CLI 中调整摄像头选择、置信度阈值以及镜像视图切换。

支持自带模型

接受自定义模型路径,并对输入形状和输出类别有文档说明。

使用场景

  • 实时字母识别

    当你想把摄像头对准手语使用者的手,并获得实时的 A–Z 字母预测,用于指拼练习或演示时,可以使用 signspell。

  • 快速命令行实验

    当你想快速、无需编码地测试内置模型、切换摄像头或调整置信度阈值时,可以运行 CLI。

  • Python 应用集成

    当你需要逐帧识别并希望将识别器集成到自定义 Python 代码中时,可以在自己的应用中导入该库。

  • 自定义模型工作流

    当你已经有训练好的 `.h5` 模型,并且想用自己的权重来使用 signspell 的摄像头工作流时,可以加载自定义模型。

Pros and Cons

Pros

  • 可实时识别 ASL 手势字母表。
  • 内置预训练模型和摄像头界面。
  • 既可通过 CLI 使用,也可通过 Python 导入。
  • 提供简单的运行时控制,可调摄像头、置信度和镜像显示。
  • 支持为高级用户加载自定义模型。

Cons

  • 项目页面仅说明基于摄像头的实时识别,因此并不适合离线或非视觉工作流。
  • 自定义模型必须匹配文档中规定的输入和输出形状,这限制了即插即用的灵活性。

FAQ

如何安装 signspell?

它是一个可通过 `pip install signspell` 安装的 Python 包。项目页面还显示了版本化发布 `1.0.1`。

signspell 是做什么的?

该包可通过摄像头实时运行美国手语指拼识别。它可实时识别指文字母表(A–Z),并且可以从命令行启动或作为库导入。

运行时有哪些要求?

项目页面说明 signspell 需要 Python 3.9–3.11,以及用于实时识别的摄像头。

我可以在 signspell 中使用自己的模型吗?

可以。项目包含 `--model path/to/your_model.h5` 选项和 `Recognizer(model_path=...)` 构造函数,因此只要你的模型符合预期的输入和输出形状,就可以将其指向你自己的模型。

摄像头界面有哪些控制?

源码描述列出了界面的窗口内控制:`q` 退出,`c` 清空句子,`SPACE` 插入空格。

Quick Facts

类别
Developer Tool
包名
signspell
版本
1.0.1
许可证
MIT License
Python 兼容性
Python 3.9–3.11
主要界面
摄像头界面、CLI 和库