AI 重點新聞 · GitHub · debpalash/VoiceStudio
VoiceStudio:開源本機語音複製工具,支援646種語言配音
這個repo是什麼
VoiceStudio是一套開源、標榜『完全在本機執行』的語音工具,作者形容它是知名商用AI語音服務ElevenLabs的開源替代方案。功能涵蓋聲音複製、聲音設計(自己捏出一個不存在的聲音)、影片配音、語音聽寫,以及有聲書製作,支援多達646種語言。
能做什麼
VoiceStudio把功能分成三大類:『創作』(複製一段既有聲音、或自己設計新聲音;透過懸浮小工具直接語音聽寫輸入文字)、『產出』(替影片配上對好時間軸的配音;製作故事、有聲書與批次任務)、『連接』(提供本機API與MCP介面,讓其他AI代理也能呼叫它的語音功能;也支援選用遠端運算資源)。預設引擎是k2-fsa/OmniVoice,使用者也可以視需求切換成其他語音引擎。官方特別強調,本機工作流程完全在自己的硬體上執行,遠端服務是選擇性的,使用分析資料也需要使用者同意才會蒐集。
安裝方式提供多種選擇:macOS與Linux可以用一行指令自動安裝最新的Electron桌面版;也能安裝指定版本、從原始碼建置,或解除安裝但保留個人資料。發布版下載需要curl與SHA-256驗證工具;若要從原始碼建置,需要具備Git、Node.js 22以上、Bun、Rust/Cargo等開發工具。安裝完成後,只要打開『聲音複製』功能、選一個現成聲音或上傳一段乾淨的參考錄音、輸入文字,就能產生語音,系統會在需要時提示下載對應的語音模型。專案也提供一段可以直接貼給Claude Code、Codex、Cursor等AI代理的安裝指令,讓代理自動完成安裝與驗證。
對非工程師有什麼用
如果你需要幫影片配音、把文章做成有聲書,或單純想要一套完全在自己電腦上運作、不用把聲音資料上傳到雲端的語音工具,VoiceStudio提供了一鍵安裝的桌面應用程式,不需要自己寫程式,安裝門檻比多數開源AI工具低。第一次從GitHub下載工具的話,GitHub上的免費工具,普通人要怎麼用有從零開始的步驟。不過要留意授權是AGPL-3.0,這類授權對商業使用有較多限制與附加條件,實際使用的語音模型也各自有自己的授權規範,商用前建議先確認清楚;官方也提醒複製聲音前務必取得當事人同意,避免侵權或做出深偽濫用。在歐盟,AI生成的深偽內容已經要求加註標示,規定整理在歐盟AI標示新規上路那則。
原文出處:GitHub · debpalash/VoiceStudio(原始來源日期 2026-04-09)
本文由 Lab 的 AI Agent 依原始報導起草、本人審稿後發布; 事實以「原始來源」為準,「筆者看法」為本站觀點。資訊狀態:未實測。


