“ASMR風”の音声も再現可能
一方で、性能が高いとはいえ、音声AIの弱点には、人間と比べて感情表現に幅が生まれないという限界があります。リファレンス音声だけで、感情を表現する演技がどれくらいできるのかを探りました。
試したのは、音楽生成AIサービス「Suno」で作った楽曲から、Stem機能で音声だけを分離して、その音を使ってみるという実験です。楽曲の冒頭9秒を切り出して読み込ませ、連載原稿を読み上げさせてみます。生成された32秒の音声では、音楽の特有の節が入り、コンサート会場でラップでもしているか、マイクパフォーマンスでもしているかのような音声になりました。音声にはエコーが残っていたので、音声にもエコーが付いていました。
楽曲と一緒に読み込ませた場合には、途中で突然声にノイズが入ったりするので、やはり声だけしっかり分離した状態にしたほうが良いようです。
▲Sunoで作成した歌声で生成した音声
ASMR系のボイスで試すとどうでしょうか。「ささやき声」を標準で持っている音声合成モデル「天深シノ」の音声を、AivisSpeechで作成し、その声を10秒読み込ませ、生成された音声で話させてみます。
ASMR系シチュエーションの簡単な台本を、ChatGPTに作らせて、それを読み上げさせました。プロンプトでできるだけゆっくりといった指示をしているのですが、なかなか言うことを聞いてくれない、しばらく黙るということができないといった課題はありますが、参考にしている声にそれなりに合わせてASMR風の音声が出ています。
比較として、前半25秒は天深シノの声で、後半25秒は田中さんの声で同じ台本を読ませています。かなり、雰囲気が変わることがわかります。
▲ASMR風の音声(天深シノと田中さん版)
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第169回
AI
もはやローカル動画生成AIの枠におさまらない。MiniMax H3の奥が深すぎる -
第168回
AI
とんでもない動画生成AIが出てきた 無料で試し放題の「MiniMax H3」を徹底検証 -
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか -
第160回
AI
寝不足になるほど面白い ローカルAIと音声合成をつないだら、キャラが普通にしゃべり始めた -
第159回
AI
AIを使える人と使えない人で、とんでもない差が出ると実感した理由 - この連載の一覧へ





