このドキュメントは英語の原文から自動翻訳されています。表現に不自然な箇所がある場合があります。正確な内容は英語の原文もあわせてご確認ください。
text_to_speechエンドポイント、同じパラメータ、同じレスポンス形式です。
このサンプルでは一連の流れを通して説明します: オーディオサンプルのアップロード、カスタムボイスの一覧取得、新しいクローンを使った音声生成までを実行します。
APIによるボイスクローン作成はFreeプランではご利用いただけません。サンプルオーディオはWAVまたはMP3で3 MB未満、ボイス名は100文字以下にしてください。
ステップ1 — サンプルからボイスをクローンする
- Python
- TypeScript
- cURL
voice_idが含まれます。これを保存しておいてください — 以降のTTS呼び出しで渡す値です。
ステップ2 — カスタムボイスを一覧表示する
- Python
- TypeScript
search_custom_voicesを使用してください。
ステップ3 — 新しいボイスで音声を生成する
voice_settings、output_format、include_phonemes、normalized_textの各フィールドをサポートします。
ステップ4 — 更新または削除する
ヒント
- 同一アカウントのみで利用可能です。 クローンボイスは、そのボイスを作成したアカウントからのみ呼び出せます。別アカウントと
voice_idを共有しても403 Forbiddenが返ります。 - プラットフォーム間で共有されます。 Supertone Playでクローンしたボイスは、自動的に
list_custom_voicesに表示されます。逆も同じで、API経由でクローンしたボイスはPlayでも表示されます。 - サンプル品質。 クリーンなモノラル、単一話者のオーディオ(5〜30秒程度)が最も良いクローン結果を生み出します。BGM、複数話者の混在、強い室内ノイズは避けてください。
- 権利と開示。 アップロードするボイスをクローンする権利を持っているか必ず確認してください。AI生成音声と開示に関する各管轄区域のルールも確認しましょう。
関連情報
クローンボイスの作成
アップロードの完全なスキーマと制約を確認できます。
ボイス
プリセットボイスとカスタムボイスがどう組み合わさるかを解説します。