動画クリエイター
カメラに向かって話した自己紹介があります。
クリップに含まれていない文をテストし、そのリズムを元の音声と比較してください。トラックをすでに書き出している場合は、音声ファイルから始める方法をご覧ください。
音声ファイルから音声クローンを作成する動画入力
動画から音声をクローン化するには、まず使用許可を得た1人の話者によるクリアな発話を、10–30 secondsの音声として書き出します。Supavocalが受け付けるのは動画ファイルではなく音声サンプルです。音楽、編集による切れ目、ほかの話者の声が入ると、サンプルの品質が下がります。
Voicecloneはガイドです。操作するとSupavocalが開きます。新規アカウントには、初回限定のウェルカムクレジット1,000が付与されます。そこでサインインし、1人の話者によるクリアな発話を10–30 seconds分アップロードして、短い原稿を入力してください。音声サンプルを基にしたプレビューは処理待ちを経て、通常約1分で完成します。継続して使える音声モデルを学習するものではありません。
私のクリアな音声サンプルを使って、次の文を読み上げてください:おかえりなさい。今日は次のステップをご案内します。
これは原稿の表示例であり、入力欄ではありません。ここからテキストは送信されません。サインイン後にSupavocalで原稿を入力してください。
動画ファイルには映像と音声トラックが含まれます。音声モデルに必要なのは、そのトラック内の発話です。音声の抽出は準備作業であり、録音品質を改善する方法ではありません。
映像を取り除いても、音声トラックにすでに混ざっている問題は解消されません。抽出したトラックを音声サンプルとして使う前に、次の3点を確認してください。
インタビュー、重なった会話、観客の反応がないか聞いて確認します。1人が話している部分だけを切り出してください。そうしないと、サンプルに複数人の声が含まれる可能性があります。
音楽、室内の反響、風の音、強いノイズ除去処理によって、子音が聞こえにくくなったり、声の印象が変わったりします。マイクが捉えられなかった細部を、抽出によって復元することはできません。
細かく編集された動画では発話の断片しか残らず、短すぎるクリップでは声の変化が十分に含まれません。無関係な単語をつなぎ合わせるのではなく、自然な速さで話している連続した部分を選んでください。
明瞭な発話部分を選び、ツールが音声ファイルを必要とする場合は音声を抽出します。再現する許可を得た声だけを使用し、最後に新しい短い文で試してください。
これらの画像は入力内容の変化を示すものであり、音質の向上を測定した結果ではありません。
生成した音声を、元の話者の声と同程度の音量で比較してください。発音、話す速さ、息づかい、背景音が結果に混入していないかを確認しましょう。
カメラに向かって話した自己紹介があります。
クリップに含まれていない文をテストし、そのリズムを元の音声と比較してください。トラックをすでに書き出している場合は、音声ファイルから始める方法をご覧ください。
音声ファイルから音声クローンを作成する画面録画にナレーションと、ときどき鳴る通知音が含まれています。
途切れのない部分を選び、テスト出力で子音が明瞭に聞こえるか確認してください。必要に応じて、手順ガイドでより良いサンプルの録音方法を確認できます。
AIで自分の声の音声クローンを作成する方法別の話者との会話を撮影した動画に出演しています。
自分の声だけが聞こえる部分を使い、長い音声を作る前に短い結果を比較してください。使用例を参考に、適切なテスト用の文を選べます。
無料の音声クローンの例声の権利者が不明な古いクリップを確認しています。
音声が技術的にクリアでも、録音を使用する前に許可を確認してください。安全性ガイドでは、声がよく似ていることが使用許可の証明にはならない理由を説明しています。
音声クローンは安全? redditまず、自分の声、または使用について明示的な許可を得た声のクリアなサンプルを用意してください。短いテストなら、テキストを追加する前に音楽や編集、別の話者の影響に気づきやすくなります。
Supavocalに進むツールが対応している入力形式によります。音声ファイルが必要な場合は、動画の音声トラックを書き出し、明瞭な発話部分にトリミングしてからアップロードしてください。動画をアップロードしても、ノイズの多い音声がクリアになるわけではありません。
影響する可能性があります。音楽と話者の声が同じ音声トラックに入っているためです。音楽のない部分を探すか、元からあるクリアな録音を使用してください。出力をテストする前に、抽出した部分を聴いて確認しましょう。
対象となる、利用に同意した話者の声だけが聞こえる部分を選んでください。声が重なると、一貫した話し方の特徴を捉えにくくなります。同時に話している人の声をトリミングで分離できるとは考えないでください。
いいえ。この手順では、映っている顔や口の動きは発話の録音として使えません。使用許可を得た声の、実際に聞こえる音声サンプルが必要です。
元のクリップからコピーしていない短い文を生成してください。同程度の再生音量で元の音声と聴き比べ、発音、話す速さ、不要なノイズを確認します。音が歪んでいる場合は、原稿を長くするのではなく、よりクリアな部分を試してください。