基于 API 的语音生成
使用 Smallest.ai API 通过文本输入、所选语音、采样率和输出格式生成语音。主页包含一个直接的 `fetch` 示例,可返回音频数据以便保存或播放。
Lightning TTS 是 Smallest.ai 的文本转语音 API,通过面向开发者的端点将书面文本转换为生成语音。主页将其定位为一项低延迟服务,可用于构建语音代理、自动化呼叫、创建旁白音频,以及在无需录音棚设置的情况下克隆声音。
产品页面强调录音棚级输出、对多语言语音的支持,以及可直接从应用或服务中使用的工作流。一个示例 API 请求展示了文本输入、语音 ID、采样率和输出格式,而定价页面则确认了按量付费和企业选项,适合需要更高限额或生产部署功能的团队。
使用 Smallest.ai API 通过文本输入、所选语音、采样率和输出格式生成语音。主页包含一个直接的 `fetch` 示例,可返回音频数据以便保存或播放。
主页重点强调 Lightning TTS 的延迟低于 100 毫秒,使其更适合交互式使用,而不仅仅是离线渲染。
Smallest.ai 表示,Lightning TTS 可跨 70+ 种语言、口音和方言生成语音,并支持自动检测和句中代码混用。
网站称,可基于样本在 10 秒内创建声音克隆,无需录音棚设备。
该产品被定位为适用于制作录音室品质有声书、播客、游戏角色、语音代理、广告和无障碍工作流的生产级方案。
定价页面展示了付费 API 模式,包含按量付费和企业选项,并提供本地部署和合规功能等企业控制能力。
构建需要快速响应时间、并且在来回交互中听起来自然的对话式语音代理。
为播客、有声书和长篇口语内容生成旁白,页面强调录音棚级输出和自然的节奏。
为游戏或交互式媒体创建角色声音,网站强调动态语音和情感范围。
从文本输入和所选语音生成营销、媒体片头、广告和视频内容的配音。
使用产品在主页上的无障碍定位,创建可与屏幕阅读器和辅助工具配合使用的语音输出。
Lightning TTS 设计为直接通过 API 使用。主页展示了一个 JavaScript `fetch` 示例,它会向 Smallest.ai 端点发送 `text`、`voice_id`、`sample_rate` 和 `output_format`,然后将返回的音频写入文件。
定价页面列出了 Lightning V3.1 和 Lightning V3.1 Pro,主页上的 API 示例使用了 `output_format: "wav"`。除该示例之外的可用格式,提供的资料中未作详细说明。
主页说明 Lightning TTS 支持 70+ 种语言、口音和方言,并提到自动语言检测以及句中代码混用。另一个单独的功能面板也提到了 15 种语言,因此确切的语言数量可能会因模型或版块而异。
主页说明声音克隆可在 10 秒内生成可用于生产环境的克隆,无需录音棚或专业设备。定价页面列出了声音克隆功能可用,但没有提供单独的工作流程说明。
定价页面显示了按量付费方案和企业方案。页面还表明企业版包含自定义设置、优先支持、提示工程支持、本地部署、更高可靠性条款,以及 SSO、RBAC 和 SOC2 等合规选项。
蓝藻AI是一款在线AI配音与语音合成工具,可将文字转成语音,并支持自助声音克隆,适用于短视频、有声书等配音场景。
Noiz AI 是一款 AI 文本转语音、声音克隆与声音设计工具,可将文本生成逼真的语音,并在同一流程中调节情感等声音表现。
Gemini 3.1 Flash TTS 是 Google 的预览版文本转语音模型,可生成富有表现力的 AI 语音,并支持对风格、语速和表达方式进行细粒度控制,适用于 Gemini API、Google AI Studio、Vertex AI 和 Google Vids。
Ondoku 是一款基于浏览器的文字转语音软件,可将文本转换为可下载的 .mp3 语音,提供免费额度与付费方案,支持多语言朗读、图片朗读,并可按规则商用。
Typecast 是一款在线 AI 配音生成器,可将文本转换为自然逼真的语音,支持情感表达与多种超写实音色,适合在浏览器中快速制作口播音频。
魔音工坊 (Moying Gongfang) 是一个智能在线文本转语音 (TTS) 平台,它使用逼真的人声和各种口音,将书面文本转换为高质量的画外音。