チョッキーのあの場面の声を再現する方法について主にwindowsでまとめています。(大体マックでも同じような感じになるのでほぼ大丈夫だとは思います。)

現在は、参照する音声から声質を再現できるAIソフトがあり、パソコンにインストールして利用できるものもあります。

この記事では、その中から「Seed-VC」を使って、チョッキーの声を参照音声として、自分が用意した音声を別の声質に変換する方法を紹介します。

チョッキーの声をAIで再現する方法

チョッキーの声をAIで再現する方法を丁寧に解説しますね。

実際にどのような手順で音声を用意し、Seed-VCを使って変換するのかを、インストールから順番に解説していきます。

なお、実際の人物の声を再現する場合は、元の音声の利用や、生成した音声の公開・商用利用などについて、著作権やパブリシティ権などの問題が関係する可能性があります。

そのため、技術的な方法だけでなく、AIで声を再現する際に確認しておきたい法律上の注意点についても後半で紹介します。

Seed-VCとは?

Seed-VCは、AIを使って、人の声を別の声に変えることができるソフトです。

例えば、自分で

「こんにちは。今日はチョッキーの声を再現する方法を紹介します」

と話した音声を用意します。

そこに、チョッキーが話している音声を「声のお手本」として使うことで、自分が話した文章を、チョッキーの声に近い声質へ変換できます。

簡単にいうと、

自分が話す
↓
チョッキーの声をお手本にする
↓
AIが声を変える

という仕組みです。

Seed-VCは、声を変えるためのAIモデルを使っており、パソコンにインストールして自分の環境で使うこともできます。

チョッキーの声を再現するために必要なもの

Seed-VCを使ってチョッキーの声を再現するには、いくつか準備するものがあります。

必要なのは、主に以下の4つです。

  • パソコン
  • Seed-VC
  • チョッキーの声が入った音声
  • 話させたい文章を録音した音声

Seed-VCをパソコンにインストールする

Seed-VCをパソコンにインストールする

ここからは、Seed-VCをパソコンに入れていきます。

今回はWindowsのパソコンを使う場合の手順を紹介します。

Seed-VCを使うには、まず「Python」というソフトをパソコンに入れる必要があります。

① Pythonをインストールする

まず、Pythonの公式サイトからPython 3.10をインストールします。

Seed-VCの公式説明でも、WindowsではPython 3.10が推奨されています。

Pythonをインストールするときは、**「Add Python to PATH」**という項目にチェックを入れてからインストールしてください。

これを忘れると、後でSeed-VCを起動するときにうまく動かない場合があります。

② Seed-VCをダウンロードする

次に、Seed-VCのファイルをパソコンにダウンロードします。

公式のSeed-VCはGitHubで公開されています。

Seed-VC公式GitHub

GitHubのページからSeed-VCのファイルをダウンロードします。

ダウンロードしたSeed-VCのフォルダは、あとから分かりやすい場所に置いておきましょう。

例えば、

デスクトップ → Seed-VC

のようにしておくと分かりやすいです。

③ 必要なファイルをインストールする

Seed-VCを動かすためには、追加で必要なファイルをインストールします。

Seed-VCのフォルダを開き、そこでコマンドプロンプトを起動します。

そして、次のコマンドを入力します。

pip install -r requirements.txt

このコマンドを実行すると、Seed-VCを動かすために必要なファイルが自動的にインストールされます。

公式のインストール手順でも、この方法が案内されています。

少し時間がかかる場合がありますので、インストールが終わるまで待ちます。

これで、Seed-VCを使うための基本的な準備は完了です。

次は、Seed-VCを実際に起動して、ブラウザに操作画面を表示する方法を説明します。

Seed-VCを起動する

Seed-VCのインストールが終わったら、次にソフトを起動します。

まず、先ほどダウンロードしたSeed-VCのフォルダを開きます。

そのフォルダ内で、もう一度コマンドプロンプトを開きます。

そして、次のコマンドを入力してください。

python app.py

Enterキーを押すと、Seed-VCが起動します。

しばらく待つと、画面に

http://localhost:7860

のようなアドレスが表示されます。

このアドレスをコピーして、Chromeなどのブラウザのアドレス欄に貼り付けてください。

すると、Seed-VCの操作画面が表示されます。

ここまでできれば、Seed-VCを使う準備は完了です。

次は、チョッキーの声を参照音声として用意する方法を説明します。

チョッキーの声を参照音声として用意する

次に、AIに「この声をお手本にして」と教えるための音声を用意します。

今回は、チョッキーが実際に話している音声を使います。

できれば、次のような音声を選びましょう。

  • チョッキーの声がはっきり聞こえる
  • 他の人の声が重なっていない
  • BGMや効果音が小さい
  • できるだけ長く話している

Seed-VCでは、短い音声を「声のお手本」として使うことができます。

例えば、チョッキーが10秒ほど話している場面があれば、その部分を音声ファイルとして用意します。

この音声は、あとでSeed-VCの参照音声として使用します。

ファイル名は分かりやすいように、

chokky.wav

などにしておくといいでしょう。

話させたい文章を自分の声で録音する

次に、チョッキーの声で話させたい文章を、自分の声で録音します。

例えば、

「こんにちは。今日はチョッキーの声を再現する方法を紹介します。」

という文章を話させたい場合は、この文章を自分で声に出して録音します。

スマートフォンの録音アプリなどを使っても構いません。

できるだけ、

  • 周りが静かな場所で録音する
  • 声をはっきり出す
  • BGMや雑音が入らないようにする
  • 文章をゆっくり読み上げる

ことを意識しましょう。

録音した音声は、あとでSeed-VCに読み込ませます。

ここで用意する音声は、チョッキーの声を再現するためのお手本ではありません。

「何を話すのか」をAIに伝えるための音声です。

つまり、

チョッキーの音声 → 声のお手本

自分の音声 → 話す内容のお手本

という役割になります。

録音ができたら、次はこの2つの音声をSeed-VCに読み込ませます。

Seed-VCに2つの音声を読み込ませる

ここまで準備できたら、Seed-VCの画面に2つの音声を読み込ませます。

Seed-VCの音声変換画面には、主に

Source Audio

Reference Audio

という2つの音声を指定する場所があります。

それぞれの役割は次のとおりです。

Source Audio
→ 自分が録音した音声

Reference Audio
→ チョッキーの声が入った音声

今回は、

Source Audio:自分の声

Reference Audio:チョッキーの声

という形で設定します。

自分で録音した音声を「Source Audio」に指定し、チョッキーの声を「Reference Audio」に指定してください。

ここを逆にすると、意図した結果にならないので注意しましょう。

2つの音声を指定できたら、次はいよいよ声の変換を行います。

チョッキーの声に変換する

2つの音声を指定したら、いよいよ声を変換します。

Seed-VCでは、Source Audioに入れた音声の内容を保ちながら、Reference Audioに入れた音声の声質に近づける形で変換します。

今回の場合は、

自分の声
↓
Seed-VCで変換
↓
チョッキーの声に近い声質

という流れです。

まずは基本的な設定のまま変換を実行してみましょう。

処理が終わると、変換後の音声が出力されます。

実際に再生してみて、自分が話した文章がチョッキーの声に近い声質で再現されているか確認します。

うまくいかない場合は、参照音声や録音した音声を見直して、もう一度変換してみましょう。

声がうまく再現できないときの対処法

Seed-VCで声を変換しても、「思っていた声と違う」と感じることがあります。

その場合は、まず音声を確認してみましょう。

チョッキーの声がうまく再現されない場合

参照音声を変えてみる

チョッキーの声にBGMや効果音、他の人の声などが入っていると、うまく声質を読み取れないことがあります。

できるだけ、チョッキーが一人ではっきり話している音声を使ってみましょう。

参照音声を長めにしてみる

短すぎる音声では、声の特徴を十分に読み取れない場合があります。

別の場面から、チョッキーがはっきり話している音声を用意して試してみるのも方法です。

声が不自然になる場合

自分の録音を見直す

自分の声が小さかったり、周囲の雑音が大きかったりすると、変換後の音声も不自然になることがあります。

静かな場所で、できるだけはっきり話して録音してみましょう。

また、長い文章を一度に変換するより、短い文章に分けて試してみる方法もあります。

それでもうまくいかない場合

Seed-VCには、音声の変換方法を調整するための設定があります。

最初は基本設定のままで試し、うまくいかない場合に設定を少しずつ変えてみるといいでしょう。

ただし、設定を変えるほど必ずチョッキーの声に近づくわけではありません。

チョッキーの声をAIで再現する際の法律上の注意点【必読】

ここまで、Seed-VCを使ってチョッキーの声を再現する方法を紹介しました。

ただし、「AIで声を再現できること」と「その声を自由に使っていいこと」は別の話です。

実際に音声を作ったり、インターネットで公開したりする前に、法律上の注意点を確認しておきましょう。

声そのものに著作権があるわけではない

文化庁の検討資料では、声そのものには著作権法上の権利は及ばないと整理されています。

ただし、それだけで「誰かの声を自由に再現して公開しても問題ない」という意味ではありません。

実在する人物の声を利用する場合には、著作権とは別に、パブリシティ権や一般不法行為などが問題になる可能性があります。

元になった音声にも注意が必要

例えば、テレビ番組などからチョッキーの声を取り出して、Seed-VCの参照音声として使用する場合です。

この場合、問題になるのは「チョッキーの声」だけではありません。

テレビ番組や録音された音声などには、著作権や著作隣接権など、別の権利が関係する可能性があります。

文化庁も、AIと声優などの実演・レコードとの関係について、引き続き検討が必要だとしています。

そのため、テレビ番組から切り取った音声だから自由に使える、とは考えない方がいいでしょう。

作った音声を公開するときは特に注意

個人的に試してみる場合と、作った音声をYouTubeやSNS、ブログなどで公開する場合では、注意すべき点が変わります。

特に、

  • チョッキー本人が話したように見せる
  • 実際には言っていない発言を本人の発言として公開する
  • 作った音声を使って商品やサービスを宣伝する
  • 収益化した動画などに利用する

といった使い方では、より慎重な確認が必要です。

政府も、生成AIによる声の無断利用・生成について、パブリシティ権などの侵害が問題となり得ることを指摘しています。

「AIで作った」と分かるようにする

もし生成した音声を公開するのであれば、本人が実際に話した音声ではなく、AIで生成・変換した音声であることを明記するのも重要です。

例えば、

※この音声はAIによって生成したもので、本人が実際に発言したものではありません。

といった説明を入れておけば、実際の発言と誤解されることを防ぎやすくなります。

ただし、このような表示をすれば必ず法律上問題がなくなるという意味ではありません。

この記事で紹介する方法を利用する場合

今回紹介しているSeed-VCは、あくまで声を変換するための技術です。

そのため、

「Seed-VCで作れる」=「自由に公開・商用利用できる」

ということではありません。

特に実在する人物の声を使う場合は、使用する元音声の権利や、生成した音声の利用方法について確認しておきましょう。

法律や権利関係は、具体的な音声や利用方法によって判断が変わる場合があります。

この記事は法律相談を目的としたものではないため、公開・商用利用などで不安がある場合は、専門家に確認することをおすすめします。