声を作り出す仕組み
ボイスクローニングは、元となる音声サンプル(一定量の声データ)を解析し、その話者の声の特徴を再現した合成音声を作る機能です。自分の声をサンプルにすれば、読み上げやナレーションにも使える「自分だけの音声」を用意できます。
声の利用には権利・同意の確認が重要です。本人以外の声を使う場合は、必ず該当する同意と権利の確認をしてください。利用ポリシーは公式サイトで確認してください。
声のライブラリ
ゼロから声を作らない場合には、あらかじめ用意された音声ライブラリ(Voice Library)から声を選ぶ方法もあります。多数の言語・トーン・話し方の声が収録されており、すぐに読み上げへ使えます。
作りたい声の「再現」か、それとも「用意された声の選択」か、目的に合わせて使い分けられます。基本の読み上げは テキスト読み上げ を参照してください。