文本转语音(TTS)是一种语音合成应用程序,它可以处理文本并用人类的声音朗读出来。人工智能(AI)的兴起带来了令人难以置信的各种文本转语音生成器。TTS 生成器在各个领域都得到广泛应用,它可以当小助手帮你念书、读邮件,它可以当教学辅助工具帮学生更好学习,它还可以为企业和个人创作者快速制作配音。市场上有许多优秀的文本转语音生成器,每个生成器都提供独特的功能和应用。下面我们就来介绍几款好用的文本转语音工具。
Amazon Polly 官网 [/buy]
优点
[pros] 支持多种文档
[pros] 可以集成到你自己的应用程序或网站中
[pros] 价格便宜,第一年有免费级别
缺点
[cons] 需要亚马逊账号
[cons] 不适合非技术人员
Amazon Polly 提供了50多种声音和25种语言供用户选择,你可以根据需要选择男性或女性的声音,选择不同的口音和语调。此外,它还支持 Speech Synthesis Markup Language (SSML),用户可以通过它来控制语音的语调、速度和音量。Amazon Polly 支持多种音频格式,包括 MP3、OGG 和 PCM,可以根据需要将语音保存为不同的格式。
Amazon Polly 不仅仅是一个文本转语音的工具,它还可以让你轻松地将语音合成功能整合到电子书、文章和其他媒体中。你只需通过 API 发送文本,它就会把音频流直接送回你的应用程序。
在定价方面,Amazon Polly 采取按使用量计费的方式,第一年每月免费提供500万个字符,免费级别用完后,每100万字符的语音或语音标记请求为4美元。如果你是一个开发者,需要一个强大的 API 来将文本转换为语音,那么 Amazon Polly 是一个不错的选择。与之相似的还有 Google Cloud Text-to-Speech 和 Microsoft Azure Text to Speech。
其他 TTS 工具
其实 TTS 工具还有很多很多,我自己在用的是 ReadAloud(Chrome 扩展)和 Audify (手机应用程序),它们都符合我的需求:1. 免费;2. 能为我阅读网页内容。如果你有制作视频音频、配音的需求,上面介绍的5种 TTS 工具和下面的更多选择,一定能找到适合的!
| Synthesia | ++ AI视频创作平台,一键制作视频 ++ 120+种语言,140+种AI形象 ++ 60+种模板 ++ 可以捏脸 ++ 每月30美元起 |
| Natural Reader | ++ 支持文本、PDF和20多种其他格式转换为口语音频 ++ 可直接从网页听取电子邮件、新闻、文章和 Google 文档 ++ 有在线应用程序、移动应用程序和Chrome扩展 ++ 语音风格可调,允许用户添加情绪和效果 ++ 免费版仅英文;Premium 版8种语言,无中文;Plus 版21种语言,包括中文 ++ 付费版每月10美元起 |
| Audify | ++ 可以朗读网页和电子书(ePub 和 PDF)中的文字 ++ 多种语言 ++ 可以更改朗读速度 ++ 夜间模式、蓝光过滤模式 ++ 免费,有 iOS 和 Android 版 |
| ReadAloud | ++ 免费 Chrome / Firefox / Edge 浏览器扩展 ++ 可听取当前网页内容多种语言,包括中文 ++ 语音不够自然 |
| Google Cloud Text-to-Speech | ++ 自定义语音(测试版) ++ WaveNet 声音 ++ 有语音调整,支持文本和 SSML ++ 免费试用期为90天,有使用限制 ++ 免费配额后的标准价格:4.00美元/百万字符(0至400万字符) ++ 免费配额后的 WaveNet 价格:16.00美元/百万字符(0至100万字符) |
| IBM Watson Text to Speech | ++ API云服务,可以将书面文本转换为音频 ++ 可集成到现有的应用程序或 Watson 助手中 ++ 9种语音,不支持中文 ++ 有免费级别 |
| Descript | ++ 可直接在编辑器里编辑音频和视频 ++ 多轨音频编辑 ++ 22种语言,无中文 ++ 免费版限制较多,收费版每月12美元起 |
| Notevibes | ++ 快速将文本转换为语音 ++ 25种语言,225+种声音 ++ 有免费版 ++ 收费版每月9美元起,120万字符限制 |
| Microsoft Azure Text to Speech | ++ Custom Neural Voice 功能开发出高度逼真的语音 ++ 可调整发音、音调、语速、暂停等语音参数 ++ 按使用量付费 |
| Voice Dream Reader | ++ 30+种语言,200+种声音 ++ 可阅读 PDF、文档 ++ 可扫描图像、识别文字并阅读 ++ 可线下阅读 ++ 仅限 iOS, Mac |
| From Text to Speech | ++ 网页版 TTS 工具,无需下载 ++ 8种语言,无中文 ++ 免费下载转换后的音频 |
| LOVO Studio | ++ 功能强大的 Genny 工具,提供高质量的 AI 生成的语音 ++ 100种语言,400+种语音 ++ 多达25+种情绪 ++ 14天免费试用 Pro 版 ++ 基础版每月19美元,Pro 版每月24美元 |
| Play.ht | ++ 829种声音,142种语言和方言 ++ 语音生成和音频分析功能 ++ 音频可下载为MP3和WAV文件 ++ 个人版每月5美元 |
| Listen2It | ++ 一款基于 AI 的语音生成器,可以将文本转换为自然的人声 ++ 超过 900 种 AI 语音,覆盖 145 种语言和方言 ++ 可以将语音保存为多种格式,包括 MP3 和 WAV ++ 语音编辑功能,包括调整语速、音调、重音等 ++ 无限的预览和导出功能 ++ 提供 API 和 WordPress 插件 ++ 每月19美元起,有字数限制 |
| Speechactors | ++ 300+种 AI 语音,130种语言和方言,包括普通话、广东话、吴语 ++ 提供发音编辑器、重音和音调控制等精细控制 ++ 可以在生成配音的同时编辑视频 ++ 提供非语言感叹词、音效、免版税音乐、库存照片和视频等资源数据库 ++ 可以使用RSS源在 iTunes、Spotify、Soundcloud和 Google Podcasts 上发布音频文件 ++ 每月16美元起,无字数限制 |
| Xpeacho | ++ 80种语言,660种声音 ++ 有免费版和付费版 ++ 可按次、按月或一次性付费,有字数限制 |
| BeyondWords | ++ 140+种语言,550+种声音 ++ 语音克隆技术,可以定制语音 ++ 使用自然语言处理算法将文本转换为语音合成标记语言(SSML) ++ 提供 API、RSS Feed 导入器、WordPress 插件和 Ghost 插件 ++ 有免费版和付费版 |
| Immersive Reader | ++ 免费 ++ 作为教学辅助工具,帮助教师支持不同能力的学生 ++ 可将文本大声朗读、将其分解为音节以及增加行和字母间距 ++ 提供专注模式,维持注意力并提高阅读速度 ++ 提供词性功能,支持教学并提高写作质量 ++ 提供音节划分功能,提高词汇识别能力 ++ 可以在多个平台上使用:OneNote、Word、Outlook、Office Lens、Microsoft Edge 浏览器和 Microsoft Teams |
| Select and Speak | ++ 免费 Chrome 扩展 ++ 21种语言,包括中文 ++ 限个人使用,不可商用 |
| Wellsaid | ++ 只有英语,但有80+种声音和多国口音 ++ 可用自己的声音生成 ++ 免费一周试用,付费版每月44美元 ++ 音频下载数量有限制 |