描述
亚马逊Polly是一项完全托管的服务,将文本转换为逼真的语音,使开发人员能够创建能够以自然和引人入胜的方式与用户沟通的应用程序。通过利用先进的深度学习技术,亚马逊Polly可以将文章、网页和其他文本格式转换为高质量的音频流。该服务支持数十种逼真的声音,覆盖广泛的语言,使其适用于从移动应用到物联网设备的多种应用。
将亚马逊Polly集成到现有应用程序中非常简单,因为它提供了一个简单的API,开发人员可以使用该API发送文本进行转换。音频输出可以直接播放或存储为标准音频文件格式,如MP3。此外,亚马逊Polly支持语音合成标记语言(SSML),允许用户调整语音的各个方面,如音调、音量和语速。这种灵活性对于创建满足特定用户需求的定制音频体验尤其有益。
亚马逊Polly旨在具有成本效益,提供按需付费的定价模型,根据处理的字符数量收费。新用户可以利用免费的服务层,在第一年内允许进行大量的文本转语音转换而无需支付费用。这使其成为希望在不承担高初始成本的情况下增强应用程序的企业的一个有吸引力的选择。
该服务在多个行业中尤其有用,包括教育领域,它可以帮助有阅读障碍的个人,以及媒体领域,它可以为动画和视频生成配音。凭借其合成自然且引人入胜的语音的能力,亚马逊Polly为创建能够接触全球受众的互动和无障碍应用程序开辟了新的可能性。
亚马逊Polly的核心功能
支持100多种声音,覆盖40多种语言
提供12个月的免费服务层
提供API以便集成
使用SSML自定义语音输出
生成多种格式的音频(MP3,OGG)
提供生成语音的缓存和重播功能
特定声音的新scaster说话风格
可定制品牌声音
如何使用 亚马逊Polly?
登录您的AWS账户
导航到亚马逊Polly控制台
输入您想要转换为语音的文本
选择所需的声音和语言
如有需要,使用SSML调整设置
点击'合成'生成音频
下载或播放生成的音频文件
将音频输出集成到您的应用程序中
亚马逊Polly的使用案例
- 电子学习
- 媒体制作
- 电话解决方案
- 无障碍
- 物联网设备





