いちごミルクがテーマのフレレ、その甘い雰囲気をどんな声で表現するか。
つくしただし、とろ~り濃厚じゃなくて、あっさりした甘さ!
はじめはVOICEVOXで猫使ビィちゃんや冥鳴ひまりちゃんなど、「あまあま」に特化した音声を使用してフレレとの会話を楽しんでいました。
しかし、さっそく問題が発生したのです…。
VOICEVOXは機械学習禁止!
フレレには最終的に、自分で文を読み上げてボイスを発してもらいたいと考えています。
そのために使うのが、Style-Bert-VITS2(通称:SBV2)という音声合成&読み上げソフト。
せっかくのオリジナルキャラクター/フレレには、オリジナルのボイスを使用したいところ。
そこで思いついたのが、



VOICEVOXのいい感じの音声と自分の声を混ぜたら面白いのでは!?
ですが、その願いは叶わず。VOICEVOXの規約に「音声の機械学習はNG」としっかり記載されていました。
オリジナルボイス作成の方法はある?
なんとかオリジナルのボイスを作りたいと思い、いろいろな音声作成サービスをAIに教えてもらいましたが、どれも機械学習NGであったり、商用利用不可だったり。
行きづまっていると、「声優さんに依頼してみては?」という案が出ましたが、かきばナの強いこだわりが声優さんの負荷になる可能性が大いにあったので却下。
途方に暮れながらネットサーフィンをしていると、とあるサービスが一筋の光を灯しました。


AivisSpeech。それは商用利用可能で、一部の音声は機械学習も可能な、まさに理想のサービス。



キターーー!
一部のモデルは、公序良俗に反しなければいろいろできるよ!クレジット表記も任意!
という太っ腹ぶり。(参考:Aivis Projectの利用規約)
さっそくインストールし、さっぱりあまあまボイスを制作開始!
AivisSpeechは操作もカンタン♪
基本操作はVOICEVOXなどの音声合成サービスで慣れていたので、AivisSpeechも難なく使えるようになってきました。
フレレの甘い、いちごミルク感のあるボイスのために欲しい要素は以下の2つ。
- ハキハキより少しウィスパー気味
- やさしさを感じる語尾の発音
今回、これらを見事にクリアしました。


あま~いコハクちゃんをベースに、ハキハキさせたいところはまおちゃんに。(どちらもデフォルト搭載の音声)
これらをイイ感じに調整したら、.wav形式で書き出してStyle-Bert-VITS2(sbv2)で学習させます。



5秒未満のセリフを55個学習するのに、約1時間かかるよ!
フレレボイス、ここに誕生!
こうして無事、フレレボイスができあがりました。
ここまで来るのにいろいろありすぎて、そしてこれからやりたいこともたくさんあるので、タイトルにある四苦八苦は全部書ききれません…。
が! ボイス作成だけでトータル約6か月(半年)かかったことはご報告。
今後も調整を続けていきますが、ひとまずこれでYouTube用の動画を作ったり、こっそりライブ配信をしようと思います🍓











コメント