安装与使用
2026-10-10
【WIP】这是一个构建中的项目,功能与体验仍在持续完善。
从源码开始
当前可以从 GitHub 获取源码运行。需要 Node.js 22.18+、Rust stable 和所在平台的 Tauri 构建依赖;macOS 还需要 Xcode Command Line Tools。
git clone https://github.com/ohmyangboy/vovo.git
cd vovo
npm install
npm run tauri dev
完整的平台依赖和构建说明见 项目 README。
预设配音面向 macOS、Windows 与 Linux;本地声音克隆目前仅支持 Apple Silicon Mac。
第一段配音
- 打开「设置」,点击「检查并准备」,下载所需资源。首次准备需要联网,完成后可以离线使用。
- 回到「生成工作台」,输入文稿,选择声音与语速。
- 先试听文稿,确认后点击「生成配音」。
- 播放结果,按需校对字幕,再导出。默认导出 MP3 + SRT,也可选择 WAV / TXT。
生成结果保存在本机记录中。再次导出或调整导出格式不需要重新生成;字幕是句级时间轴,修改字幕文字不会改变朗读内容。
创建我的声音
在声音选择中点击「创建我的声音」,先确认声音授权,再导入 WAV、MP3、M4A、FLAC 或 AIFF 录音。
选择 3–20 秒清晰人声,避免背景音乐;核对识别文字后命名并保存。朗读英文时,英文参考录音更合适。录音与文字默认保存在本机,保存后不依赖原始录音文件。
只看界面
npm run dev
网页预览可以编辑文稿、浏览声音目录和保存草稿。真实配音、声音克隆与文件导出需要桌面应用。