説明
Amazon Pollyは、テキストをリアルな音声に変換する完全管理型サービスであり、開発者がユーザーと自然で魅力的な方法でコミュニケーションできるアプリケーションを作成することを可能にします。高度な深層学習技術を活用することで、Amazon Pollyは記事、ウェブページ、その他のテキスト形式を高品質なオーディオストリームに変換できます。このサービスは、さまざまな言語で数十のリアルな音声をサポートしており、モバイルアプリからIoTデバイスまで多様なアプリケーションに適しています。
Amazon Pollyを既存のアプリケーションに統合するのは簡単で、開発者が変換のためにテキストを送信できるシンプルなAPIを提供しています。オーディオ出力は直接再生することも、MP3などの標準オーディオファイル形式で保存することもできます。さらに、Amazon Pollyは音声合成マークアップ言語(SSML)をサポートしており、ユーザーは音声のピッチ、音量、話す速度などのさまざまな側面を調整できます。この柔軟性は、特定のユーザーのニーズに応じたカスタマイズされたオーディオ体験を作成するのに特に役立ちます。
Amazon Pollyはコスト効率を考慮して設計されており、処理された文字数に基づいて課金される従量課金制の料金モデルを提供しています。新しいユーザーは、最初の1年間にかなりの量のテキスト読み上げ変換を無料で行える無料プランを利用できます。これにより、高い初期コストをかけずにアプリケーションを強化したい企業にとって魅力的な選択肢となります。
このサービスは、教育などのさまざまな業界で特に役立ち、読み障害のある個人を支援したり、メディアではアニメーションやビデオのナレーションを生成したりすることができます。自然で魅力的な音声を合成する能力を持つAmazon Pollyは、インタラクティブでアクセス可能なアプリケーションを作成するための新しい可能性を開き、グローバルなオーディエンスにリーチすることができます。
Amazon Pollyの主要機能
40以上の言語で100以上の音声をサポート
12ヶ月間の無料プランあり
統合用のAPIあり
SSMLを使用したカスタマイズ可能な音声出力
複数のフォーマット(MP3、OGG)でオーディオを生成
生成された音声のキャッシュと再生を提供
特定の音声用のニュースキャスター話法
ブランド音声のカスタマイズが可能
Amazon Pollyの使い方は?
AWSアカウントにログインする
Amazon Pollyコンソールに移動する
音声に変換したいテキストを入力する
希望する音声と言語を選択する
必要に応じてSSMLを使用して設定を調整する
「合成」をクリックしてオーディオを生成する
生成されたオーディオファイルをダウンロードまたは再生する
オーディオ出力をアプリケーションに統合する
Amazon Pollyの使用例
- Eラーニング
- メディア制作
- 電話ソリューション
- アクセシビリティ
- IoTデバイス





