注目★★★★★GitHub Trending
ローカルで動くオープンソース音声スタジオ Voicebox、声のクローンと音声入出力を統合
30秒で把握
- 1Voicebox:音声クローン・7 TTS エンジン・23 言語対応・MCP エージェント統合をローカルで実行
- 2ElevenLabs と Whisper Flow の機能を統一・全データ・モデルがマシン内に留まりプライバシー保護
- 3Tauri/Rust 製・macOS/Windows/Linux/Docker 対応・GitHub で無料公開・AI エージェントへの音声出力も MCP で統合可能
要約
jamiepine が開発した Voicebox は、ローカルで完全に動作するオープンソースの音声スタジオで、ElevenLabs と Whisper Flow の機能を 1 つのアプリに統合した。数秒の音声から声をクローンでき、7 つの TTS エンジンで 23 言語の音声生成、グローバルホットキーでの音声入力、MCP 対応 AI エージェント (Claude Code・Cursor・Cline) への音声出力を実現する。モデルと音声データはマシン上に留まり、プライバシーは完全に保護される。Tauri (Rust) で構築され、macOS・Windows・Linux・Docker 上で動作する。
あなたへの影響
AI エージェントを音声インターフェース化するニーズが高まる中、このツールは音声クローンから入出力の統合まで一気通貫で賄えるため、AI アシスタント・ボイスチャット機能を検討するチームは動作確認と統合パターンの評価をしておく価値がある。
推奨:MCP サーバーが組み込まれているので、既存の Claude Code や Cursor との連携も容易。