在线文字转语音
在浏览器中输入或粘贴文本,即可用所选语音朗读,无需安装桌面软件。页面同时提示可直接收听或下载为 .mp3 音频文件。
Ondoku 是一款在线文字转语音软件,主要用于把输入的文本转换成可收听、可下载的语音。首页说明它可在浏览器中直接使用,生成的语音可以下载为 .mp3 文件,也可以直接播放。
产品提供免费额度与付费方案两种使用方式。未注册用户每月可试用 1,000 字符,免费注册后可提升到 5,000 字符;付费方案按字符额度计费,页面列出了从 20 万字符/月到 100 万字符/月的多个档位。
从站点说明来看,Ondoku 面向需要快速生成语音内容的个人和组织,支持多语言朗读,并允许在遵守署名和禁止事项规则的前提下进行商用。首页与帮助文章还提到它支持图像朗读、历史记录、对话功能和共享功能等工作流。
在浏览器中输入或粘贴文本,即可用所选语音朗读,无需安装桌面软件。页面同时提示可直接收听或下载为 .mp3 音频文件。
首页提供“图片”入口,并在相关说明中提到支持从图像中读出内容,适合把图片中的文字转成语音再使用。
语音与语言选择范围较广。相关介绍页面称 Ondoku 支持 80 多种语言和方言,并提供 650 多名配音员/语音样本供试听。
控制项包括朗读速度和高低等基础语音参数,方便根据内容场景调整语速和音高。
页面强调输出的语音可下载为音频文件并用于商业用途;免费使用时需按规则署名,付费会员则无需署名。
高级语音合成 Beta 页面说明平台提供更新一代的 AI 语音合成,用于更自然的朗读体验。
在浏览器里输入文章、脚本或短文,立即生成可收听的语音,适合需要先听一遍再校对内容的人。
将朗读后的语音下载为 .mp3,用于视频配音、讲解音轨或其他需要音频文件的内容制作流程。
根据语言、方言或声音样本选择更合适的语音,适合处理多语言内容、学习发音或面向不同地区受众的材料。
在遵守署名规则的前提下,将生成语音用于博客、网站、视频或其他商业场景;付费会员可免署名。
把图片中的文字转为语音,并结合历史记录、共享或对话等功能处理重复任务,适合需要批量或持续管理内容的用户。
是。Ondoku 提供免费使用额度,未注册用户每月可试用 1,000 字符,免费注册后每月可朗读 5,000 字符。
可以。页面说明生成的语音可保存为 .mp3 音频文件,并且可以用于商业目的;但免费使用时需要按规则标注署名。
付费方案按月或按年计费,页面列出了 Basic、Value 和 Premium 三档;付费会员无需署名,且剩余字符不会结转到下个月。
可以。帮助页面说明登录后可在设置中取消订阅,也可以注销账号;取消后当前剩余字符可继续使用到下次更新日期。
支持。页面提供文本输入以及图片选择入口,并提到可以从图像中读出内容;另有相关页面介绍支持多语言和多种声音样本。
Gemini 3.1 Flash TTS 是 Google 的预览版文本转语音模型,可生成富有表现力的 AI 语音,并支持对风格、语速和表达方式进行细粒度控制,适用于 Gemini API、Google AI Studio、Vertex AI 和 Google Vids。
蓝藻AI是一款在线AI配音与语音合成工具,可将文字转成语音,并支持自助声音克隆,适用于短视频、有声书等配音场景。
Typecast 是一款在线 AI 配音生成器,可将文本转换为自然逼真的语音,支持情感表达与多种超写实音色,适合在浏览器中快速制作口播音频。
Noiz AI 是一款 AI 文本转语音、声音克隆与声音设计工具,可将文本生成逼真的语音,并在同一流程中调节情感等声音表现。
魔音工坊 (Moying Gongfang) 是一个智能在线文本转语音 (TTS) 平台,它使用逼真的人声和各种口音,将书面文本转换为高质量的画外音。
TADA 是 Hume AI 的开源语音语言模型,支持文本与语音一一对齐生成,更适合构建高速度、高可靠性的语音系统,适用于端侧部署与长文本语音应用。