〖音声学習向け〗KM Voice Dataset Builder|音声・動画から学習用データセットをかんたん作成〖ボーカル抽出・ノイズ除去〗
상품 설명
〖音声学習向け〗KM Voice Dataset Builder
## 音声・動画から、学習用データセットをかんたん作成
音声学習用の素材作りを、もっと分かりやすく。
**KM Voice Dataset Builder**は、音声・動画素材からボーカルを抽出し、補正・無音処理・音量調整・分割を行って、学習に使いやすい音声データセットを作成するWindows向けアプリです。
長時間の音声や動画を登録し、用途に合ったプリセットを選んで作成を開始するだけ。
指定した合計時間とファイル構成に合わせて、整理されたWAVデータセットを出力します。
RVCをはじめ、さまざまな音声モデルの学習素材作成にご利用いただけます。
---
🎉 発売記念価格
**2026年11月30日まで、発売記念価格5,980円で販売します。**
発売記念期間終了後は、**通常価格11,980円**となります。
音声・動画素材から学習用データセットを効率よく作成したい方は、この機会にぜひご利用ください。
---
主な機能
## 音声・動画からボーカルを抽出
音声ファイルだけでなく、動画素材も登録できます。
素材からボーカル成分を抽出し、学習用音声として扱いやすい状態へ整えます。
元の音声・動画ファイルは変更されません。
## 学習用データセットを自動構成
目標とする合計時間と、1ファイルあたりの長さを指定できます。
必要なデータ量に達すると自動的に処理を停止し、`dataset_001.wav`から始まる連番ファイルとして保存します。
## ボーカル抽出モード
素材やPC環境に合わせて、ボーカル抽出方法を選択できます。
- Quality
- Balanced
- Fast
品質や処理速度を確認しながら調整できます。
## 素材補正
モデルの追加ダウンロードを必要としないDSP処理として、以下の補正を個別に設定できます。
- Denoise:ノイズ抑制
- De-Reverb:残響抑制
- 無音圧縮
- 音量正規化
補正の強度も調整できます。
※処理結果は、元素材や設定によって異なります。
## 40 kHz/48 kHz出力
用途に応じて、出力サンプリングレートを選択できます。
- **40 kHz**
一般的な音声モデル学習向け。容量と処理負荷を抑えられます。
- **48 kHz**
48 kHz対応環境向け。高域を維持できますが、容量と学習負荷が増えます。
## 中断・再開
長時間の処理を一度に終わらせる必要はありません。
停止またはアプリ終了時に作成途中の状態が保存され、次回起動時に続きから再開できます。
素材が不足した場合は、新しい素材を追加して目標量まで作成を続けられます。
※作成途中の出力フォルダを移動・削除すると再開できません。
## 素材全体から分散して採用
対応プリセットでは、素材の一部分だけに偏らないよう、時間位置を分散して区間を採用します。
重大な品質問題が検出された区間は除外し、指定した量のデータセットを構成します。
---
かんたん3ステップ
## STEP 1 音声・動画を追加
ファイルを追加するか、フォルダーを選択します。
ドラッグ&ドロップにも対応しています。
## STEP 2 プリセットを選択
用途に近いプリセットを選びます。
- 標準セット:30分
- 高品質セット:40分
- 高密度セット:60分
- 短時間テスト:5分
プリセット適用後も、各設定を自由に調整できます。
## STEP 3 作成開始
設定内容を確認し、「音声データセットを作成」を押します。
目標量に達すると自動停止し、指定した保存先へデータセットが出力されます。
---
出力内容
## 学習用音声
- モノラルPCM WAV
- 40 kHzまたは48 kHz
- `dataset_001.wav`から連番で保存
## 素材・処理設定の記録
- `source_manifest.csv`
- `source_manifest.json`
使用した素材、採用区間、処理設定などが記録されます。
## 確認情報
音声時間やピークなど、作成結果を確認するための情報も出力されます。
作成完了後は必ず数本を試聴し、以下の問題がないか確認してください。
- 伴奏の混入
- 強いノイズ
- 音切れ
- 過度な補正
- 不要な無音
- 他者の声
---
動作環境
- **対応OS:Windows 10/Windows 11**
- **64bit版Windows**
- **NVIDIA GPU推奨**
- **出力先に5GB以上の空き容量を推奨**
GPU、ドライバー、素材形式、空き容量、各種設定などにより、処理速度や動作可否は異なります。
高品質設定や長時間素材では、一時ファイルを含め大きな容量を使用する場合があります。
---
商品内容
- KM Voice Dataset Builder v1.3.0
- セットアッププログラム
- 製品データ
- 日本語/英語対応アプリ
- 操作マニュアル
- 使用上の注意
- 第三者ライセンス資料
- SHA-256整合性確認ファイル
---
ご購入前に必ずご確認ください
- 本製品はWindows 10/11の64bit環境を想定しています。
- NVIDIA GPU環境を推奨します。
- 処理速度や出力品質は、PC構成・GPU・ドライバー・素材・設定によって異なります。
- ボーカル抽出、ノイズ抑制、残響抑制、無音処理は完全ではありません。
- すべての素材で期待どおりの結果を保証するものではありません。
- 出力WAVは必ず試聴し、内容を確認してから学習へ使用してください。
- 重要な素材は事前にバックアップしてください。
- 処理中はスリープ、強制終了、外付けドライブの取り外しを避けてください。
- 非対応OS、仮想環境、改変された環境での動作は保証されません。
- 特定の学習結果、品質、互換性、収益、審査通過を保証するものではありません。
---
素材と権利について
自分で録音した音声、または利用・加工・学習利用について必要な許可を得た音声・動画だけを使用してください。
第三者の声、著作物、配信、映像、楽曲などを、権利者や本人の許可なく取り込まないでください。
作成したデータセットや学習モデルを公開・販売・配布する場合は、素材元の利用規約、肖像権、パブリシティ権、著作権、契約、各サービスの規約などを利用者自身でご確認ください。
以下の用途には使用しないでください。
- なりすまし
- 詐欺
- 脅迫
- 誹謗中傷
- 権利侵害
- 違法行為
- 本人の同意を欠く音声複製
---
Windowsの警告について
本製品の実行ファイルおよびインストーラーは、コード署名を行っていません。
初回起動時に、Windows SmartScreenやセキュリティソフトによる警告が表示される場合があります。
必ず本BOOTHページから取得したファイルを使用し、同梱のSHA-256整合性確認ファイルをご確認ください。不明な配布元から取得したファイルは実行しないでください。
---
インストールについて
Setup.exeと製品データZIP、SHA-256ファイルを同じフォルダーへ保存してから、Setup.exeを実行してください。
セットアップ画面の案内に従ってインストールできます。
詳しい操作方法は、同梱の日本語マニュアルおよびアプリ上部の「操作マニュアル」から確認できます。
---
第三者ソフトウェアについて
本製品は、FFmpegプロジェクトのライブラリおよび実行プログラムをGNU Lesser General Public License version 3(LGPLv3)の条件で使用しています。
必要な著作権表示、ライセンス全文、対応ソースなどは、配布物内の第三者ライセンス資料から確認できます。
---
免責事項
本ソフトウェアの利用または利用不能、データ消失、学習結果、機器トラブル、第三者との紛争などによって発生した損害について、販売者は法律上認められる範囲を超えて責任を負いません。
重要な素材は事前にバックアップし、最初は短時間テストで出力内容と動作をご確認ください。
ダウンロード商品の性質上、購入者都合による返品・返金は原則としてお受けできません。
---
バージョン
**KM Voice Dataset Builder v1.3.0**
Windows 10/11 64bit
---
## 音声・動画から、学習に使いやすいデータセットへ。
素材整理や繰り返し作業にかかる時間を減らし、音声モデル制作に集中できる環境を目指して開発しました。
모든 리뷰
더보기리뷰 등록
리뷰를 작성하려면 로그인이 필요합니다.
로그인하고 리뷰 쓰기