【音声学習向け】KM Voice Dataset Builder|音声・動画から学習用データセットをかんたん作成【ボーカル抽出・ノイズ除去】
- ダウンロード商品¥ 5,980






# 〖音声学習向け〗KM Voice Dataset Builder ## 音声・動画から、学習用データセットをかんたん作成 音声学習用の素材作りを、もっと分かりやすく。 **KM Voice Dataset Builder**は、音声・動画素材からボーカルを抽出し、補正・無音処理・音量調整・分割を行って、学習に使いやすい音声データセットを作成するWindows向けアプリです。 長時間の音声や動画を登録し、用途に合ったプリセットを選んで作成を開始するだけ。 指定した合計時間とファイル構成に合わせて、整理されたWAVデータセットを出力します。 RVCをはじめ、さまざまな音声モデルの学習素材作成にご利用いただけます。 --- # 🎉 発売記念価格 **2026年11月30日まで、発売記念価格5,980円で販売します。** 発売記念期間終了後は、**通常価格11,980円**となります。 音声・動画素材から学習用データセットを効率よく作成したい方は、この機会にぜひご利用ください。 --- # 主な機能 ## 音声・動画からボーカルを抽出 音声ファイルだけでなく、動画素材も登録できます。 素材からボーカル成分を抽出し、学習用音声として扱いやすい状態へ整えます。 元の音声・動画ファイルは変更されません。 ## 学習用データセットを自動構成 目標とする合計時間と、1ファイルあたりの長さを指定できます。 必要なデータ量に達すると自動的に処理を停止し、`dataset_001.wav`から始まる連番ファイルとして保存します。 ## ボーカル抽出モード 素材やPC環境に合わせて、ボーカル抽出方法を選択できます。 - Quality - Balanced - Fast 品質や処理速度を確認しながら調整できます。 ## 素材補正 モデルの追加ダウンロードを必要としないDSP処理として、以下の補正を個別に設定できます。 - Denoise:ノイズ抑制 - De-Reverb:残響抑制 - 無音圧縮 - 音量正規化 補正の強度も調整できます。 ※処理結果は、元素材や設定によって異なります。 ## 40 kHz/48 kHz出力 用途に応じて、出力サンプリングレートを選択できます。 - **40 kHz** 一般的な音声モデル学習向け。容量と処理負荷を抑えられます。 - **48 kHz** 48 kHz対応環境向け。高域を維持できますが、容量と学習負荷が増えます。 ## 中断・再開 長時間の処理を一度に終わらせる必要はありません。 停止またはアプリ終了時に作成途中の状態が保存され、次回起動時に続きから再開できます。 素材が不足した場合は、新しい素材を追加して目標量まで作成を続けられます。 ※作成途中の出力フォルダを移動・削除すると再開できません。 ## 素材全体から分散して採用 対応プリセットでは、素材の一部分だけに偏らないよう、時間位置を分散して区間を採用します。 重大な品質問題が検出された区間は除外し、指定した量のデータセットを構成します。 --- # かんたん3ステップ ## STEP 1 音声・動画を追加 ファイルを追加するか、フォルダーを選択します。 ドラッグ&ドロップにも対応しています。 ## STEP 2 プリセットを選択 用途に近いプリセットを選びます。 - 標準セット:30分 - 高品質セット:40分 - 高密度セット:60分 - 短時間テスト:5分 プリセット適用後も、各設定を自由に調整できます。 ## STEP 3 作成開始 設定内容を確認し、「音声データセットを作成」を押します。 目標量に達すると自動停止し、指定した保存先へデータセットが出力されます。 --- # 出力内容 ## 学習用音声 - モノラルPCM WAV - 40 kHzまたは48 kHz - `dataset_001.wav`から連番で保存 ## 素材・処理設定の記録 - `source_manifest.csv` - `source_manifest.json` 使用した素材、採用区間、処理設定などが記録されます。 ## 確認情報 音声時間やピークなど、作成結果を確認するための情報も出力されます。 作成完了後は必ず数本を試聴し、以下の問題がないか確認してください。 - 伴奏の混入 - 強いノイズ - 音切れ - 過度な補正 - 不要な無音 - 他者の声 --- # 動作環境 - **対応OS:Windows 10/Windows 11** - **64bit版Windows** - **NVIDIA GPU推奨** - **出力先に5GB以上の空き容量を推奨** GPU、ドライバー、素材形式、空き容量、各種設定などにより、処理速度や動作可否は異なります。 高品質設定や長時間素材では、一時ファイルを含め大きな容量を使用する場合があります。 --- # 商品内容 - KM Voice Dataset Builder v1.3.0 - セットアッププログラム - 製品データ - 日本語/英語対応アプリ - 操作マニュアル - 使用上の注意 - 第三者ライセンス資料 - SHA-256整合性確認ファイル --- # ご購入前に必ずご確認ください - 本製品はWindows 10/11の64bit環境を想定しています。 - NVIDIA GPU環境を推奨します。 - 処理速度や出力品質は、PC構成・GPU・ドライバー・素材・設定によって異なります。 - ボーカル抽出、ノイズ抑制、残響抑制、無音処理は完全ではありません。 - すべての素材で期待どおりの結果を保証するものではありません。 - 出力WAVは必ず試聴し、内容を確認してから学習へ使用してください。 - 重要な素材は事前にバックアップしてください。 - 処理中はスリープ、強制終了、外付けドライブの取り外しを避けてください。 - 非対応OS、仮想環境、改変された環境での動作は保証されません。 - 特定の学習結果、品質、互換性、収益、審査通過を保証するものではありません。 --- # 素材と権利について 自分で録音した音声、または利用・加工・学習利用について必要な許可を得た音声・動画だけを使用してください。 第三者の声、著作物、配信、映像、楽曲などを、権利者や本人の許可なく取り込まないでください。 作成したデータセットや学習モデルを公開・販売・配布する場合は、素材元の利用規約、肖像権、パブリシティ権、著作権、契約、各サービスの規約などを利用者自身でご確認ください。 以下の用途には使用しないでください。 - なりすまし - 詐欺 - 脅迫 - 誹謗中傷 - 権利侵害 - 違法行為 - 本人の同意を欠く音声複製 --- # Windowsの警告について 本製品の実行ファイルおよびインストーラーは、コード署名を行っていません。 初回起動時に、Windows SmartScreenやセキュリティソフトによる警告が表示される場合があります。 必ず本BOOTHページから取得したファイルを使用し、同梱のSHA-256整合性確認ファイルをご確認ください。不明な配布元から取得したファイルは実行しないでください。 --- # インストールについて Setup.exeと製品データZIP、SHA-256ファイルを同じフォルダーへ保存してから、Setup.exeを実行してください。 セットアップ画面の案内に従ってインストールできます。 詳しい操作方法は、同梱の日本語マニュアルおよびアプリ上部の「操作マニュアル」から確認できます。 --- # 第三者ソフトウェアについて 本製品は、FFmpegプロジェクトのライブラリおよび実行プログラムをGNU Lesser General Public License version 3(LGPLv3)の条件で使用しています。 必要な著作権表示、ライセンス全文、対応ソースなどは、配布物内の第三者ライセンス資料から確認できます。 --- # 免責事項 本ソフトウェアの利用または利用不能、データ消失、学習結果、機器トラブル、第三者との紛争などによって発生した損害について、販売者は法律上認められる範囲を超えて責任を負いません。 重要な素材は事前にバックアップし、最初は短時間テストで出力内容と動作をご確認ください。 ダウンロード商品の性質上、購入者都合による返品・返金は原則としてお受けできません。 --- # バージョン **KM Voice Dataset Builder v1.3.0** Windows 10/11 64bit --- ## 音声・動画から、学習に使いやすいデータセットへ。 素材整理や繰り返し作業にかかる時間を減らし、音声モデル制作に集中できる環境を目指して開発しました。






