文本转语音
选择本地模型、云端服务或系统声音,把一段或多段文字变成语音。

从一小段文字到整本长稿,都可以按段落和章节继续制作。
选择本地模型、云端服务或系统声音,把一段或多段文字变成语音。
按章节和段落持续制作有声书、课程或长内容。
导入小说、台本、课程稿或其他文本。
修改旁白、台词和文本结构,生成后仍可继续调整。
按章节、场景或语义段落组织长内容。
按当前模型真正支持的能力,添加停顿、情绪、语气词、读音或自然语言朗读要求。
把旁白和人物分别管理,换模型时也能保持角色关系清楚。
让不同人物或说话人使用不同声音。
为叙述内容设置稳定的旁白声音。
从本地、云端和系统声音中筛选、试听,再为每个角色绑定声音。
让同一角色跨场景、跨章节保持一致。
统一设置角色的模型、语速、情绪和表达;不支持的控制不会硬塞给用户。
保存同一说话人在中性、低语、生气、悲伤等状态下的参考音频,之后可跨项目复用。
可以先做一句试听,也可以确认配置后批量完成整章内容。
生成一条台词并试听不同结果。
一次生成场景、章节或工程中的多条文本。
不同模型支持的方式不同:有的使用情绪参数,有的使用自然语言指令,客户端会自动显示对应控制。
保留和比较不同生成结果,再选择使用哪一版。
文本或角色设置变化后,只重做受影响内容。
声音既可以从本地素材库里选,也可以交给 AI 生成,再放进多轨工程继续修改。
导入或从素材库选择环境声,也可以用 AI 生成风雨、街道、房间等持续氛围。
使用本地素材,或用 AI 生成脚步、开门、碰撞、提示声等事件声音。
导入自己的配乐,或用音乐模型生成 BGM,用来推动情绪、段落和转场。
在时间线上选定位置和时长,用文字描述需要的人声、环境、音效或 BGM,生成后直接进入对应轨道。
通过 BoboGen 部署已接入的本地音效与音乐模型,不使用云端生成额度也能完成相应任务。
通过语义搜索、自动标签和内容关系,更快找到适合当前工程的声音素材。
把对白、旁白、环境音、剧情音效和背景音乐组合成完整声音场景。
所有声音进入工程后,还能继续移动、裁剪、对齐和混音。
按文本顺序把生成语音放入时间线。
分别编辑角色、旁白、环境、音效和 BGM。
从文本跳到对应声音,播放时跟随当前内容。
调整台词间隔、停顿和片段衔接。
分别调整对白、旁白、环境、音效和 BGM 的音量与衔接,让重点声音更清楚。
按当前任务调整面板位置、停靠方式和工作区布局。
先整体试听,再局部返工并导出最终声音。
连续检查角色声音、节奏、音效和音乐。
只修改有问题的台词或声音片段。
理解章节内容,规划环境音、关键音效和 BGM;确认后再把方案写入多轨工程。
将语音或完整多轨工程导出为音频文件。
不必只靠自己找素材。已有声音可以直接使用,缺少的部分也可以交给 AI 生成。
展开查看导入本地音效、环境音和背景音乐,放进素材库或时间线继续使用。
用文字描述脚步、雨声、房间氛围或配乐方向,生成候选后再试听和选择。
通过 BoboGen 运行已接入的本地音效与音乐模型,可以不使用云端生成额度。
直接在时间线上指定位置和时长,生成人声、环境音、剧情音效或 BGM,结果会进入对应轨道。
BoboVox 不把你锁在单一模型上。可以按语言、音色、情绪控制和使用成本选择合适的声音来源。
展开查看当前代表性接入包括 IndexTTS2、F5-TTS、GPT-SoVITS V2Pro,可通过 BoboGen 在自己的设备上运行。
当前代表性接入包括 MiniMax Speech、通义千问 Qwen TTS、火山引擎 Seed TTS、腾讯云语音和百度智能云。
也可以使用 Edge TTS、Browser Speech 等声音服务,适合快速试听和常规内容。
当前代表性本地接入包括 Stable Audio 3 Small SFX 和 Stable Audio 3 Small Music,用于音效、环境音和 BGM。
模型会持续增加。具体可用列表、语言、音色、情绪、克隆和生成参数,以当前客户端里的模型说明为准。
不同模型的用法并不完全一样。BoboVox 用一套共同规则把它们接进同一个工程,普通用户不需要自己研究每个接口。
展开查看角色、文本和时间线保持不变,换成其他已接入模型后继续制作。
模型支持情绪、指令、停顿或语气词时才显示对应选项;不支持的内容不会拿来报错。
文本、角色、音色、模型和输出信息用统一方式保存,减少重复配置。
这里的“共享”是模型共用一套接入规则,不是公开或上传你的项目、素材、账号和 API Key。
围绕原视频完成字幕、角色配音、多语言版本、原声处理和成片导出。