【商用利用可 / 囁きボイス追加】Sumine Voice Palette V3.0 - 落ち着きと安心感のある女性ボイス / Style-Bert-VITS2
- Digital1,980 JPY


Sumine / 澄音は、落ち着き、安心感、包容力を持つ、聞き取りやすくやさしい女性ボイスです。自然な会話、案内、ナレーション、キャラクター台詞で、言葉を丁寧に届けたい場面に向いています。 通常利用向けのSumine V3と、囁き・小声向けのSumine Whisperを同梱しています。ページ内の試聴で、モデルごとの距離感とStyleによる表情の違いをお確かめください。
◆ Sumine V3+Whisper、2つのモデル
V3.0では、対応できる文章や表現の幅を大きく広げるため、通常利用向けモデルを声の土台から徹底的に作り直しました。 さまざまな話し方でもSumineらしい落ち着きと聞き取りやすさを保てるよう、発音、抑揚、声質のまとまりを丁寧に整えています。 長めの案内やナレーションから、感情を込めた短いキャラクター台詞まで、安定性と表現力の両方を活かせるモデルです。 ・1モデルでNeutral / Bright / Softを使い分けられる ・文章や表現の幅を広げ、声質と読み上げの安定性を改善 ・長めの読み上げと短いキャラクター台詞の両方に対応 ・囁き・小声向けのWhisperモデルも同梱 ・2モデルを選びやすいシンプルな構成 ━━━━━━━━━━━━━━━━━━━━━━ ◆ こんな声が欲しい方へ ━━━━━━━━━━━━━━━━━━━━━━ ・落ち着いた女性ボイスが欲しい ・案内役、受付、先生、お姉さん、相談役の声を作りたい ・聞き取りやすいナレーションや説明音声に使いたい ・作品へ自然に馴染む、上品でやさしい声が欲しい ・明るい会話からシリアスな読み上げまで、同じ声で表情を変えたい ・通常会話と囁き声を、用途に合わせて使い分けたい Sumineは、作品の中に落ち着いた案内役や、安心して言葉を任せられる女性キャラクターを置きたい時に使いやすい声です。
◆ V3とWhisperのStyle
▼ Neutral Sumineの落ち着いた標準トーンです。 聞き手が安心するような子音の伸ばし方と、包み込むような抑揚を意識しています。 通常会話、説明、案内、ナレーション、キャラクター台詞の基準に向いています。 推奨設定: 1.0固定 ▼ Bright 明るくハキハキと話し、喜びや楽しさ、弾むような表情が出やすいStyleです。 明るい案内、返事、軽いリアクション、楽しい会話に向いています。 調整範囲: 0.4~2.8 最初は0.7前後から試し、文章に合わせて少しずつ上げてください。 ▼ Soft しっとりと深く、慎重に話すStyleです。 丁寧な読み上げ、シリアスな場面、重要なお知らせ、落ち着いたタイトル読み上げに向いています。 調整範囲: 0.4~2.2 V3のSoftは、深く慎重に話すためのStyleです。 明確な囁きや小声が必要な場合は、Whisperモデルをお使いください。 ━━━━━━━━━━━━━━━━━━━━━━ ◆ Whisperモデルの使い分け ━━━━━━━━━━━━━━━━━━━━━━ ▼ Neutral 自然な小声寄りのトーン。静かな会話や、声量を抑えた案内に。 ▼ Bright 囁きの空気感を残した表情差分。近い距離でのやさしい返事や、軽いリアクションに。 ▼ Soft Whisperモデルの中心となるStyle。囁き、耳元に近い声、安眠向けの短い声かけ、静かな会話に。 Softが最も安定しやすいStyleです。 囁きの質感と明るさは両立しにくいため、まずはSoft 1.0からお試しください。
◆ 同梱内容・導入・利用条件・更新履歴
【V3 Neutral】 Sumineの落ち着いた標準トーンです。通常会話、説明、案内、ナレーション、キャラクター台詞の基準に向いています。推奨設定は1.0です。 【V3 Bright】 明るくハキハキと話し、喜びや楽しさ、弾むような表情が出やすいStyleです。明るい案内、返事、軽いリアクション、楽しい会話に向いています。調整範囲は0.4〜2.8です。最初は0.7前後からお試しください。 【V3 Soft】 しっとりと深く、慎重に話すStyleです。丁寧な読み上げ、シリアスな場面、重要なお知らせ、落ち着いたタイトル読み上げに向いています。調整範囲は0.4〜2.2です。 【Whisper】 Neutralは自然な小声寄り、Brightは囁きの空気感を残した表情差分、Softは囁き・耳元に近い声・安眠向けの短い声かけ・静かな会話に向いています。まずはSoft 1.0からお試しください。
◆ 声のタイプで選ぶなら
【同梱内容】 01_Sumine_V3\ ・sumine.safetensors ・config.json ・style_vectors.npy 02_Sumine_Whisper\ ・sumine_whisper_v2_0.safetensors ・config.json ・style_vectors.npy ・README.txt ・LICENSE.txt 【導入と動作環境】 2つのモデルは別々のフォルダで使用します。使いたいモデルフォルダをStyle-Bert-VITS2のモデルフォルダへ配置し、Style-Bert-VITS2側でモデルを読み込み、Neutral / Bright / Softから使いたいStyleを選択してください。 Style-Bert-VITS2本体は同梱していません。Style-Bert-VITS2が動作する環境が必要です。推奨はNVIDIA GPUですが、CPUのみでも生成できます。生成速度は低下します。 【利用条件】 商用利用できます。本モデルで生成した音声は、個人・法人を問わず、動画、配信、ゲーム、ノベル作品、同人作品、ナレーション、キャラクター台詞、依頼を受けて制作する作品などにご利用いただけます。生成した音声の編集、加工、ミックス、公開、配布、販売も可能です。クレジット表記は任意です。 モデル本体および設定ファイルの再配布、再販売、アップロード、共有、これらをもとにした別の音声モデルの作成、学習、配布、販売は禁止します。実在人物、声優、配信者、著名人、私人へのなりすまし、詐欺、虚偽情報、誹謗中傷、第三者の権利侵害、違法行為、各利用サービスの規約に反する利用も禁止します。 商品画像、イラスト、ガイドなどは、個別に利用可能と明記されている場合を除き、鑑賞・確認用です。素材としての再配布、再販売、加工配布、キャラクター素材としての利用はできません。 【ご購入前にご確認ください】 生成結果は、入力文章、Style、設定、利用環境によって変化します。すべての文章で完全な読み上げを保証するものではありません。長い文章は、句読点や改行で意味のまとまりごとに区切ると、聞き取りやすく安定しやすくなります。ダウンロード商品の性質上、キャンセル・返金はできません。 【更新履歴】 2026-05-18 V1.0 初回公開 2026-05-28 V1.1 Stable Neutral追加版を同梱 2026-06-13 V2.0へ更新。Whisperモデルを追加 2026-07-12 V3.0に更新。通常利用向けモデルを大幅に更新し、最新V3モデルとWhisperモデルの2モデル構成へ変更 2026-07-18 V3.0モデルを一部改良。抑揚部分を修正
▽ ShizukaLab Voice Library
ShizukaLab Voice Library は、声質・用途の異なる複数の TTS Voice Model を展開するシリーズです。 https://shizukalab.vercel.app/ Voice Palette は、完成済みキャラクターそのものではなく、あなたの創作に合わせて名前、役割、世界観を与えられる「声のガワ」として設計しています。 動画、ゲーム、配信、ノベル、オリジナルキャラクター制作など、用途に合わせて自由に組み込める声素材としてご利用ください。


