Fix esd.list ― Style-Bert-VITS2用 書き起こし自動補完ツール
- ダウンロード商品¥ 500


Fix esd.list ― Style-Bert-VITS2用 書き起こし自動補完ツール Style-Bert-VITS2 の学習データセット (esd.list + wav) の 「書き起こしが空・短い・行ごと抜けている」ファイルを自動検出し、 AIが2段構えで書き起こしを補完するWindows用ローカルツールです。 学習データを作っていて、こんな経験はありませんか? ・esd.list に書き起こしが無い行があって学習前処理でエラーになる ・数百ファイルの書き起こしを目視でチェックするのがつらい ・普通の文字起こしAIだと、囁き・叫び・演技セリフがうまく認識されない Fix esd.list は、この面倒な作業をブラウザ画面ひとつで解決します。 ■ 特徴 ★ 演技音声に強い2段構えのAI書き起こし 1段目はアニメ・ゲーム調の演技音声に特化した「anime-whisper」。 囁き・叫び・非言語発声に強く、句読点も自然に付きます。 認識に失敗したファイルだけ、自動でWhisper large-v3が再挑戦します。 ★ 抜けているファイルだけを自動検出 wavフォルダとesd.listを突き合わせ、書き起こしが必要なファイルだけを リストアップ。すでに書き起こし済みの行には手を付けません。 ★ ブラウザで検品・修正まで完結 1行ごとに音声プレイヤー付きの一覧を表示。音声を聴きながら テキストをクリックして修正できます。不要なファイルは「ごみ箱」ボタンで wavごと安全に削除(ごみ箱行きなので復元可能)。 ★ 安心の自動バックアップ esd.listへの書き出し前に、元ファイルを自動で .bak にバックアップします。 ★ 進捗が見える・途中で止められる 書き起こしは進捗バーと残り時間の目安を表示。途中停止もできます。 作業状態は自動保存され、次回起動時に前回の続きから使えます。 ■ 動作環境 (購入前に必ずご確認ください) ・Windows 10 / 11 ・Python 3.10以降のインストールが必要です (無料・READMEに手順あり) ・NVIDIA GPU推奨 (VRAM 6GB以上)。GPUが無くても動作しますが、 書き起こし速度はかなり遅くなります ・ディスク空き容量 約10GB ・初回のみインターネット接続が必要です (AIモデル 合計約6GB を自動ダウンロードします) ※ Pythonを使ったことがない方でも、同梱の「インストール.bat」を ダブルクリックして質問に答えるだけでセットアップできます。 ■ 同梱物 ・app.py (本体) ・起動.bat / インストール.bat ・requirements.txt ・README.md (セットアップ手順・使い方・注意事項) ■ 使い方 (ざっくり) 1. インストール.bat を実行 (初回のみ) 2. 起動.bat を実行 → ブラウザで画面が開く 3. wavフォルダとesd.listのパス、話者名を入れて「チェック」 4. 「書き起こし実行」→ 抜けている分だけAIが書き起こし 5. 一覧で音声を聴きながら検品・修正 6. 「保存」でesd.listに書き出し (元ファイルは自動バックアップ) ■ 使用しているAIモデル ・litagin/anime-whisper (MITライセンス) ・Systran/faster-whisper-large-v3 ― OpenAI Whisper large-v3 (MITライセンス) anime-whisperは日本語のアニメ・ゲーム調演技音声 約530万ファイルで 追加学習された日本語特化モデルです。学習データの特性上、固有名詞などの 表記に癖が出る場合があります (一覧画面で修正できます)。 ■ 注意事項 ・本ツールはローカル専用です。音声やテキストが外部に送信されることはありません ・書き起こし結果は100%正確ではありません。最終確認はご自身でお願いします ・本ツールの使用によって生じたいかなる損害についても、作者は責任を負いません ・購入者本人の利用に限ります。本ツールの再配布・転売はご遠慮ください ・Python本体やAIモデルの仕様変更により、将来動作しなくなる可能性があります ■ 更新履歴 2026-07-17 v1.0 初版公開


