超逼真的 AI 配音!文本转语音工具(Text to Speech)推荐

文本转语音(TTS)是一种语音合成应用程序,它可以处理文本并用人类的声音朗读出来。人工智能(AI)的兴起带来了令人难以置信的各种文本转语音生成器。TTS 生成器在各个领域都得到广泛应用,它可以当小助手帮你念书、读邮件,它可以当教学辅助工具帮学生更好学习,它还可以为企业和个人创作者快速制作配音。市场上有许多优秀的文本转语音生成器,每个生成器都提供独特的功能和应用。下面我们就来介绍几款好用的文本转语音工具。

Amazon Polly 官网 [/buy]

优点

[pros] 支持多种文档
[pros] 可以集成到你自己的应用程序或网站中
[pros] 价格便宜,第一年有免费级别

缺点

[cons] 需要亚马逊账号
[cons] 不适合非技术人员

输入您的邮箱,订阅《美国攻略》

Join 203 other subscribers

Amazon Polly 提供了50多种声音和25种语言供用户选择,你可以根据需要选择男性或女性的声音,选择不同的口音和语调。此外,它还支持 Speech Synthesis Markup Language (SSML),用户可以通过它来控制语音的语调、速度和音量。Amazon Polly 支持多种音频格式,包括 MP3、OGG 和 PCM,可以根据需要将语音保存为不同的格式。

Amazon Polly 不仅仅是一个文本转语音的工具,它还可以让你轻松地将语音合成功能整合到电子书、文章和其他媒体中。你只需通过 API 发送文本,它就会把音频流直接送回你的应用程序。

在定价方面,Amazon Polly 采取按使用量计费的方式,第一年每月免费提供500万个字符,免费级别用完后,每100万字符的语音或语音标记请求为4美元。如果你是一个开发者,需要一个强大的 API 来将文本转换为语音,那么 Amazon Polly 是一个不错的选择。与之相似的还有 Google Cloud Text-to-Speech 和 Microsoft Azure Text to Speech。

其他 TTS 工具

其实 TTS 工具还有很多很多,我自己在用的是 ReadAloud(Chrome 扩展)和 Audify (手机应用程序),它们都符合我的需求:1. 免费;2. 能为我阅读网页内容。如果你有制作视频音频、配音的需求,上面介绍的5种 TTS 工具和下面的更多选择,一定能找到适合的!

Synthesia++ AI视频创作平台,一键制作视频
++ 120+种语言,140+种AI形象
++ 60+种模板
++ 可以捏脸
++ 每月30美元起
Natural Reader++ 支持文本、PDF和20多种其他格式转换为口语音频
++ 可直接从网页听取电子邮件、新闻、文章和 Google 文档
++ 有在线应用程序、移动应用程序和Chrome扩展
++ 语音风格可调,允许用户添加情绪和效果
++ 免费版仅英文;Premium 版8种语言,无中文;Plus 版21种语言,包括中文
++ 付费版每月10美元起
Audify++ 可以朗读网页和电子书(ePub 和 PDF)中的文字
++ 多种语言
++ 可以更改朗读速度
++ 夜间模式、蓝光过滤模式
++ 免费,有 iOS 和 Android 版
ReadAloud++ 免费 Chrome / Firefox / Edge 浏览器扩展
++ 可听取当前网页内容多种语言,包括中文
++ 语音不够自然
Google Cloud Text-to-Speech++ 自定义语音(测试版)
++ WaveNet 声音
++ 有语音调整,支持文本和 SSML
++ 免费试用期为90天,有使用限制
++ 免费配额后的标准价格:4.00美元/百万字符(0至400万字符)
++ 免费配额后的 WaveNet 价格:16.00美元/百万字符(0至100万字符)
IBM Watson Text to Speech++ API云服务,可以将书面文本转换为音频
++ 可集成到现有的应用程序或 Watson 助手中
++ 9种语音,不支持中文
++ 有免费级别
Descript++ 可直接在编辑器里编辑音频和视频
++ 多轨音频编辑
++ 22种语言,无中文
++ 免费版限制较多,收费版每月12美元起
Notevibes++ 快速将文本转换为语音
++ 25种语言,225+种声音
++ 有免费版
++ 收费版每月9美元起,120万字符限制
Microsoft Azure Text to Speech++ Custom Neural Voice 功能开发出高度逼真的语音
++ 可调整发音、音调、语速、暂停等语音参数
++ 按使用量付费
Voice Dream Reader++ 30+种语言,200+种声音
++ 可阅读 PDF、文档
++ 可扫描图像、识别文字并阅读
++ 可线下阅读
++ 仅限 iOS, Mac
From Text to Speech++ 网页版 TTS 工具,无需下载
++ 8种语言,无中文
++ 免费下载转换后的音频
LOVO Studio++ 功能强大的 Genny 工具,提供高质量的 AI 生成的语音
++ 100种语言,400+种语音
++ 多达25+种情绪
++ 14天免费试用 Pro 版
++ 基础版每月19美元,Pro 版每月24美元
Play.ht++ 829种声音,142种语言和方言
++ 语音生成和音频分析功能
++ 音频可下载为MP3和WAV文件
++ 个人版每月5美元
Listen2It++ 一款基于 AI 的语音生成器,可以将文本转换为自然的人声
++ 超过 900 种 AI 语音,覆盖 145 种语言和方言
++ 可以将语音保存为多种格式,包括 MP3 和 WAV
++ 语音编辑功能,包括调整语速、音调、重音等
++ 无限的预览和导出功能
++ 提供 API 和 WordPress 插件
++ 每月19美元起,有字数限制
Speechactors++ 300+种 AI 语音,130种语言和方言,包括普通话、广东话、吴语
++ 提供发音编辑器、重音和音调控制等精细控制
++ 可以在生成配音的同时编辑视频
++ 提供非语言感叹词、音效、免版税音乐、库存照片和视频等资源数据库
++ 可以使用RSS源在 iTunes、Spotify、Soundcloud和 Google Podcasts 上发布音频文件
++ 每月16美元起,无字数限制
Xpeacho++ 80种语言,660种声音
++ 有免费版和付费版
++ 可按次、按月或一次性付费,有字数限制
BeyondWords++ 140+种语言,550+种声音
++ 语音克隆技术,可以定制语音
++ 使用自然语言处理算法将文本转换为语音合成标记语言(SSML)
++ 提供 API、RSS Feed 导入器、WordPress 插件和 Ghost 插件
++ 有免费版和付费版
Immersive Reader++ 免费
++ 作为教学辅助工具,帮助教师支持不同能力的学生
++ 可将文本大声朗读、将其分解为音节以及增加行和字母间距
++ 提供专注模式,维持注意力并提高阅读速度
++ 提供词性功能,支持教学并提高写作质量
++ 提供音节划分功能,提高词汇识别能力
++ 可以在多个平台上使用:OneNote、Word、Outlook、Office Lens、Microsoft Edge 浏览器和 Microsoft Teams
Select and Speak++ 免费 Chrome 扩展
++ 21种语言,包括中文
++ 限个人使用,不可商用
Wellsaid++ 只有英语,但有80+种声音和多国口音
++ 可用自己的声音生成
++ 免费一周试用,付费版每月44美元
++ 音频下载数量有限制

Read More

Leave a Reply

Your email address will not be published. Required fields are marked *

This site uses Akismet to reduce spam. Learn how your comment data is processed.