单模型多语言 TTS
该产品基于单一模型生成英文、印地语和 Hinglish 语音,旨在处理代码混合文本而无需在系统之间切换。
Chariot 是一款 AI 文字转语音产品,基于单一模型可生成英文、印地语和 Hinglish 语音。它被定位为面向开发者的 TTS 系统,用于构建语音代理、产品配音以及其他需要自然发声并能响应上下文的应用。
该产品强调情感和上下文感知输出、低延迟流式传输,以及无需大量手动文本规范化的工作流程。网站说明首个音频大约在 75 毫秒内到达,开发者可根据应用选择 REST、流式传输或基于 WebSocket 的交付方式。
该产品基于单一模型生成英文、印地语和 Hinglish 语音,旨在处理代码混合文本而无需在系统之间切换。
Chariot 将其输出定位为具备情感和上下文感知能力,会从上下文中推断发音和口语形式,而不要求每个提示都手动规范化。
网站说明首个音频大约在 75 毫秒内到达,流式输出会在生成时开始,因此适合实时应用。
API 支持三种访问方式:REST 用于生成完整 WAV 文件,流式传输用于原始 16 位 PCM,WebSocket 用于按句子输出代理内容。
首页介绍了十二种工作室音色,并展示了按性别和口音筛选;同一模型可输出英文、印地语和 Hinglish 语音。
定价部分说明适用印度数据驻留和 DPDP 合规,且处理发生在印度、使用印度基础设施。
构建需要快速响应并保持自然节奏的对话式语音代理,使用流式或 WebSocket 输出进行按句子交付。
无需手动逐个拼写发音细节,即可生成英文、印地语或 Hinglish 的产品配音、广告或社交音频。
为应用或工作流添加语音输出,让文本以具备上下文感知的方式朗读出来,例如发票、通知、OTP 或支持回复。
面向需要在英文、印地语和 Hinglish 之间自然代码混合的印度语言受众,创建音频产品。
在工作流需要更多积分或商业使用权之前,先使用免费层进行原型验证。
Chariot 专为生成英文、印地语和 Hinglish 文本转语音而设计,基于单一模型。主页还说明它支持具备情感和上下文感知的输出以及实时流式传输。
主页说明首个音频大约在 75 毫秒内到达,API 也可以在生成时流式传输原始音频。网站还描述了一种按句子播报的 WebSocket 模式,适用于代理应用。
网站展示了十二种工作室音色,并在音色浏览器中提供女性、男性和口音分类筛选。除此之外,源文本未提供更详细的音色目录信息。
主页说明免费计划包含 10,000 积分,无需信用卡,且免费层可使用全部十二种音色。
主页说明从 Starter 计划开始包含商业使用权。定价部分列出了 Starter、Startup 和 Scale 三个层级,但源文本中仅明确说明了 Starter 的商业条款。
Gemini 3.1 Flash TTS 是 Google 的预览版文本转语音模型,可生成富有表现力的 AI 语音,并支持对风格、语速和表达方式进行细粒度控制,适用于 Gemini API、Google AI Studio、Vertex AI 和 Google Vids。
蓝藻AI是一款在线AI配音与语音合成工具,可将文字转成语音,并支持自助声音克隆,适用于短视频、有声书等配音场景。
Ondoku 是一款基于浏览器的文字转语音软件,可将文本转换为可下载的 .mp3 语音,提供免费额度与付费方案,支持多语言朗读、图片朗读,并可按规则商用。
Typecast 是一款在线 AI 配音生成器,可将文本转换为自然逼真的语音,支持情感表达与多种超写实音色,适合在浏览器中快速制作口播音频。
Noiz AI 是一款 AI 文本转语音、声音克隆与声音设计工具,可将文本生成逼真的语音,并在同一流程中调节情感等声音表现。
魔音工坊 (Moying Gongfang) 是一个智能在线文本转语音 (TTS) 平台,它使用逼真的人声和各种口音,将书面文本转换为高质量的画外音。