AI Bot Framework - Voice + Live2D
- Digital300 JPY

🤖 AIキャラクターをすぐ試せる開発フレームワーク音声 + Live2D / VTube Studio 対応 👉 ダブルクリックで、AIキャラ開発フレームワークの基本動作を確認できます。 会話・音声・感情フロー・VTube Studio 連携に加えて、外部アプリ連携向けの public API / SDK 基盤も含む ready-to-run パッケージです。 最新版の v5.1.0 では、外部アプリからより安全に使いやすくするための Host App Integration Boundary を強化しました。 public framework API、typed Text Chat result、Voice Output session contract、capability snapshot、session lifecycle、opaque voice artifact reference、package import readiness、fixed release package verification などを整理しています。 本商品は完成済みアプリではなく、AIキャラクターアプリや実験用ツールを作るための 開発者向けフレームワーク です。 💡 このツールについて すぐに動作確認しやすいように構成された、AIキャラクター開発用のフレームワークです。 こんな用途に向いています。 AIキャラクター開発の土台を探している 音声会話や Live2D 連携をすぐ試したい 自分用の AI キャラアプリを作りたい 外部アプリから AI キャラ会話機能を使いたい preset / character / plugin ベースで拡張したい TTS / STT / LLM / VTS の流れをまとめて確認したい public API 経由で AI キャラ機能を組み込みたい 🎮 できること AIキャラクターとの会話テスト テキストチャット session の確認 typed Text Chat result の確認 音声入力 / 音声出力のテスト Voice Output session の確認 VTube Studio / Live2D 連携 感情タグ付き応答フロー character ごとの表情マッピング runtime conversation state の確認 TTS 向けの読み上げやすい応答方針 public framework API による外部アプリ連携 app-safe session metadata の確認 capability snapshot の確認 session lifecycle の確認 public Voice Output request / result flow の確認 ✨ v5.1.0 の主な更新内容 v5.1.0 では、外部アプリから使うための public boundary を中心に整理しました。 主な更新内容: public contract inventory / conformance checks TextChatResult public result type TextChatSession.ask_result(message) typed result method VoiceOutputSession.speak(request) を推奨 API として整理 capability snapshot API FW-owned provider config resolution public session lifecycle methods opaque voice artifact reference contract package import readiness checks fixed release package builder / verification release package secret hygiene checks 外部アプリ側が framework 内部の runtime / provider / STT / TTS / VTS 実装へ直接依存しなくても扱いやすいようにするための更新です。 🧩 外部アプリ連携向け public API v5.1.0 では、外部アプリから使うための public API surface を強化しています。 主な public API: create_text_chat_session(...) TextChatSessionInfo TextChatResult create_voice_output_session(...) VoiceOutputSession VoiceOutputRequest VoiceOutputResult VoiceArtifactRef CapabilityStatus FrameworkCapabilities get_capabilities() Text Chat session API 例: session.ask(text) session.ask_result(text) session.ask_stream(text) session.reset() session.interrupt() session.close() session.dispose() Voice Output session API 例: session.speak(request) session.create_output(request) session.close() session.dispose() capability snapshot を使うことで、外部アプリ側は内部実装に依存せず、framework が対応している機能を確認できます。 ⚠️ Live2D / VTube Studio 連携について 現行版では以下に対応しています。 VTube Studio への接続 preset による ON / OFF 切替 感情タグの解析 character ごとの VTS hotkey mapping plugin 経由での表情切り替え VTube Studio が起動していない場合や、hotkey が未設定の場合でも、会話自体はそのまま継続されます。 🚀 使い方 ダウンロードして ZIP を解凍 install.bat をダブルクリック(初回のみ) .env に API キーを設定 run.bat をダブルクリック または scripts/run_*.bat を使って起動できます。 例: scripts/run_text_chat.bat scripts/run_text_vts.bat scripts/run_voice_vts.bat 💡 起動モード text_chat テキスト入力 / テキスト出力の安全な開発用モードです。最初の動作確認におすすめです。 text_vts テキスト入力 / テキスト出力 + VTube Studio 連携を確認するモードです。 voice_vts 音声入力 + テキスト表示 + 音声出力 + VTube Studio 連携の開発確認用モードです。 bilingual_ja_en 日本語入力 + 英語出力の確認用 preset です。 まずは text_chat から始めて、必要に応じて音声・VTS 連携へ進める使い方がおすすめです。 🔑 API キーについて 本ツールは外部 AI サービスを利用します。 API キーは付属しません。ご自身の API キーを使用してください。 対応構成例: Google Gemini OpenAI xAI / Grok ElevenLabs TTS 注意: API 利用料金は自己負担です TTS 機能を使う場合は、TTS provider 側の API キーや音声設定が必要です private .env files や token files は含まれません 🎙️ Voice Mode Notes voice_vts モードでは、STT で音声入力、TTS で音声出力を行います。 音声入力が検出されない場合、text fallback を使えます。text fallback で exit または quit と入力すると通常終了できます。強制終了したい場合は Ctrl+C を使えます。 v5.1.0 では Text Chat / Voice Output の public integration boundary を整理していますが、完全な realtime voice runtime ではありません。 provider-level の LLM hard cancellation、TTS queue cancellation、常時マイク入力による本格的な barge-in は今後の runtime 改善範囲です。 👤 こんな人におすすめ AIキャラクターアプリを開発したい人 VTuber / Live2D 制作と AI 連携を試したい人 音声 × 会話 × 表情制御の流れを試したい人 面倒な初期構築を減らしたい人 自分用の AI キャラ基盤を作りたい人 外部アプリから AI キャラ会話機能を使いたい人 framework の public API を使ってアプリに組み込みたい人 🎯 現行版でできること RuntimeConfig ベースの設定管理 preset による起動モード切替 character ごとの profile / system prompt 対応 入力言語 / 出力言語の分離 STT / TTS を使った音声入出力の基本対応 感情タグの解析 character ごとの VTS hotkey mapping plugin ベースの感情 / VTS 連携 runtime conversation state tracking plugin 向け state change event voice-friendly output policy public Text Chat session API TextChatResult typed result API public Voice Output session API VoiceOutputSession.speak(request) capability snapshot API app-safe session metadata limited public interrupt boundary app-facing event callbacks public session lifecycle methods opaque voice artifact reference SDK-style examples app integration smoke checks runtime boundary regression checks package import readiness checks fixed release package verification モジュール型の拡張しやすい構成 🔗 GitHub(オープンソース版) https://github.com/murayan1982/ai-character-framework 違い: GitHub 版:オープンソースのベースフレームワーク 本商品:すぐ試しやすい ready-to-run パッケージ版 用途に合わせて選んでください。 📜 利用について(ライセンス) 商用利用可能です。 許可されていること: 本フレームワークを使ったアプリ・サービスの開発 より大きなアプリやサービスの一部として利用すること AIキャラクター作品・配信・コンテンツ制作への利用 本フレームワーク上で動く plugin / character / preset / add-on 等の販売 ※ただし、フレームワーク本体を再配布しない場合に限ります。 禁止されていること: 本フレームワーク自体の再配布・再販売 テンプレート、SDK、スターターキット、boilerplate、競合フレームワークとしての再販売 軽微改変版・再パッケージ版・実質的に類似した版の再配布・再販売 詳細は同梱の LICENSE.txt をご確認ください。 ⚠️ 注意事項 API キーは付属しません Live2D モデルは付属しません 各 API の利用料金は自己負担です VTube Studio 連携を使う場合は、VTube Studio 側の起動と設定が必要です 音声機能を使う場合は、ffmpeg / マイク / スピーカー / TTS provider 設定が必要になる場合があります 本商品は完成済みアプリではなく、開発者向けフレームワークです realtime voice runtime / full barge-in / hard cancellation は今後の開発範囲です 📦 バージョン AI-Character-Framework v5.1.0 v5.1.0 package は fixed release package verification 済みです。 💡 サポートについて このプロジェクトが役に立ったら、応援してもらえると開発継続の助けになります。 👉 ダブルクリックで、すぐに基本動作を確認できます。👉 ready-to-run な土台から、自分向けに拡張していけます。
動作環境
Windows 11 Python 3.12.0
