NISHIRA

← トップへ戻る

しゃべるくん

台本を書くだけで、自分の声のナレーションができる(Mac 用)

なりたち
過去に自分で録音した動画のナレーション約 20 分を AI に学習させて、自分の声を再現する音声モデルを作りました。台本のテキストを渡すと、自分の声で読み上げた音声ファイルが出てきます
目的
動画を作るときの「録音して、言い間違いを編集ソフトで直す」という工程をなくすことです。台本を書き直せば音声も作り直せるので、録り直しという作業がなくなります
こだわり
音声の学習も生成も、すべて自分の Mac の中で動かしています。外部サービスに声や台本を送らないので、費用もかかりません。学習データの音質や学習のさせ方で仕上がりが大きく変わることが分かり、データを整えて作り直しを重ねました。まだ細かな微調整は必要と思われますが、自分でも聞き分けが難しい水準になりました
使ったもの
Python、オープンソースの音声合成 AI(GPT-SoVITS)
声の扱い
学習させてよいのは自分自身の声だけと決めています。この音声を動画で使うときは、AI で生成した音声であることを明記する予定です