凛音エル ボイスモデル【RVCv2 & Style-Bert-VITS2】
상품 설명
電脳天使工業のバーチャルシンガーである「凛音エル (Rinne Elu)」のRVCv2モデルと、Style-Bert-Vits2(TTS, Japanese Extra対応済)のモデルを販売しています。
更新について
beatrice v2のパッケージ頒布について(2025-04-13)
beatriceの導入がしやすいように、必要なファイルだけをまとめたzipファイルを頒布するboothページを新たに設置しました。
https://dennotenshi.booth.pm/items/6798687
beatrice-clientを用いると導入が楽です。
【beatrice-client】
https://github.com/aq2r/beatrice-client/releases
==========
Beatrice対応と英語TTSについて(2024-11-08)
新たにBeatrice v2で使えるモデルと、SBV2の英語音声特化モデルを作成しました。
これに伴い、Booth上の無料モデルを含めた四種のモデル群(RVC,TTS(ja),TTS(en),beatrice)をHuggingFaceにアップロードいたしました。
以下リンクよりダウンロードすることが可能です。
https://huggingface.co/kokuren/RinneElu
==========
価格改定(2024-02-13)
歌唱に特化したデータセット及びモデルの制作に伴い、RVCの価格を改定しました。
RVCモデルセット 7000円→5000円
お得な全部セット 10000円→8000円
歌唱追加データセット版については、以下のページで頒布していますが、必ずしもどちらが上位互換という話ではなく、声色や音質の好みで使い分けるのが良いと思います。
https://booth.pm/ja/items/5495715
今後不具合、値段の変更などが生じた場合に、内容が更新される可能性があります。
サンプル動画
RVCでの歌ってみた動画と、ChatGPTなどを組み合わせて音声で会話ができるようにしたTTSのサンプル動画があります。
コンテンツ内容
用途や内容に合わせて、4つのセットを用意しています。無料のお試しモデルセットでも楽しめるようなものを用意しています。
また、各セットには電脳天使工業のバーチャルキャラクターである「凛音エル」の背景透過イラストも同梱されています。
【お試しモデルセット】
RVCv2 モデル一つとインデックスファイル
(RinneElu1シリーズ 100epochのpthファイル)
Style-Bert-Vits2 モデル一つとスタイルベクトル及びconfigファイル
(5000stepのsafetensorsファイル)
【TTSモデルセット】
Style-Bert-Vits2で使えるモデル群とスタイルベクトル及びconfigファイル
1000~20000stepまでの20個のsafetensorsファイルが含まれています。step数ごとに若干表現の柔らかさが変わるので、色々試したい方やモデルマージをしたい方向けです。
スタイルベクトルやconfigファイルは"02_TTS_01000_04000.zip"に含まれています。
【RVCモデルセット】
RVCやVCclientで使えるRVCv2モデル群とインデックスファイル
以下で説明しているRinneElu1,2,3の全てのモデルが含まれているセットになります。無料版では若干のホワイトノイズが乗るので、そこを改善したい方や、色々試したい方向けです。
インデックスファイルは"03RVC_Elu_1_2.zip"に含まれています。
【お得な全部セット】
TTSモデルセットと、RVCモデルセットの内容をどちらも含めたセットです。別々に購入するより2000円お得になっています。
モデルの種類
【RVCv2 バッチサイズ12で学習】
・RinneElu1シリーズ
収録した音声の特徴をよく残したモデルですが、前処理をあまり行っていないので、若干のホワイトノイズが乗ります。やわらかく、アナログ感のあるモデルです。
20~140epochまでの20刻みで7個あります。48kモデルです。
・RinneElu2シリーズ
収録した音声からノイズをカットし、少し前処理を行ったものを、Ov2superという事前学習モデルを使って学習したモデルです。RinneElu1シリーズにあったホワイトノイズ問題が解消されています。
20,80,140epochの3個のモデルがあります。40kモデルです。
・RinneElu3シリーズ
RinneElu2シリーズと同じデータセットで、従来の事前学習モデル(48k)で700epochまで学習を回したものです。
50~700epochまでの50刻みで14個のモデルがあります。
【Style-Bert-Vits2 バッチサイズ4で学習】
TTS(Text to Speech)、すなわち文章から音声を合成するモデルです。いわゆる読み上げソフト的なものになります。
1000~20000stepの1000刻みで20個のモデルがあります。
※RVC用のインデックスファイルは1つのみで、各モデルシリーズに適用できます。
学習元の声優さんについて
このボイスモデルは、知人の協力を受けて、コーパスの読み上げを実際に現地で収録した音声をデータセットにして作成したものです。
録音環境から自作をし、声のもとになった声優さんの助力があって成り立っております。
この場をお借りして感謝申し上げます。
利用規約
下記を参照してください。
本製品の購入前に、必ずお読みくださるようお願いいたします。
https://docs.google.com/document/d/1WyTx_lfrI-i2BFTlHDVlFTm27iSrLcwpOgHx45lYWhw/edit?usp=sharing
使い方についての動画
모든 리뷰
더보기리뷰 등록
리뷰를 작성하려면 로그인이 필요합니다.
로그인하고 리뷰 쓰기