从文本、角色到完整声音作品

把短文本、长稿件和多人台词做成有声内容。声音可以来自本地模型、云端服务或系统声音,还能加入 AI 生成的环境音、剧情音效和背景音乐。

BoboVox 有声创作工作区中的角色、台词、音色和多轨时间线,深色主题
浅色深色

文本与稿件

从一小段文字到整本长稿,都可以按段落和章节继续制作。

文本转语音

选择本地模型、云端服务或系统声音,把一段或多段文字变成语音。

长文本配音

按章节和段落持续制作有声书、课程或长内容。

稿件导入

导入小说、台本、课程稿或其他文本。

稿件编辑

修改旁白、台词和文本结构,生成后仍可继续调整。

内容分段

按章节、场景或语义段落组织长内容。

演播标注

按当前模型真正支持的能力,添加停顿、情绪、语气词、读音或自然语言朗读要求。

角色与音色

把旁白和人物分别管理,换模型时也能保持角色关系清楚。

多人语音合成

让不同人物或说话人使用不同声音。

旁白配音

为叙述内容设置稳定的旁白声音。

角色选音

从本地、云端和系统声音中筛选、试听,再为每个角色绑定声音。

角色声音统一

让同一角色跨场景、跨章节保持一致。

角色默认参数

统一设置角色的模型、语速、情绪和表达;不支持的控制不会硬塞给用户。

情绪参考库

保存同一说话人在中性、低语、生气、悲伤等状态下的参考音频,之后可跨项目复用。

语音生成

可以先做一句试听,也可以确认配置后批量完成整章内容。

单句生成

生成一条台词并试听不同结果。

批量生成配音

一次生成场景、章节或工程中的多条文本。

语气与情绪

不同模型支持的方式不同:有的使用情绪参数,有的使用自然语言指令,客户端会自动显示对应控制。

试听版本

保留和比较不同生成结果,再选择使用哪一版。

修改后重配

文本或角色设置变化后,只重做受影响内容。

音效、环境与 BGM

声音既可以从本地素材库里选,也可以交给 AI 生成,再放进多轨工程继续修改。

添加环境音

导入或从素材库选择环境声,也可以用 AI 生成风雨、街道、房间等持续氛围。

添加剧情音效

使用本地素材,或用 AI 生成脚步、开门、碰撞、提示声等事件声音。

添加背景音乐

导入自己的配乐,或用音乐模型生成 BGM,用来推动情绪、段落和转场。

AI 画笔

在时间线上选定位置和时长,用文字描述需要的人声、环境、音效或 BGM,生成后直接进入对应轨道。

本地声音生成

通过 BoboGen 部署已接入的本地音效与音乐模型,不使用云端生成额度也能完成相应任务。

智能素材

通过语义搜索、自动标签和内容关系,更快找到适合当前工程的声音素材。

声场设计

把对白、旁白、环境音、剧情音效和背景音乐组合成完整声音场景。

时间线与混音

所有声音进入工程后,还能继续移动、裁剪、对齐和混音。

语音自动排布

按文本顺序把生成语音放入时间线。

多轨音频编辑

分别编辑角色、旁白、环境、音效和 BGM。

文本音频联动

从文本跳到对应声音,播放时跟随当前内容。

调整对白节奏

调整台词间隔、停顿和片段衔接。

作品混音

分别调整对白、旁白、环境、音效和 BGM 的音量与衔接,让重点声音更清楚。

工作台布局

按当前任务调整面板位置、停靠方式和工作区布局。

音频导出

先整体试听,再局部返工并导出最终声音。

整体试听

连续检查角色声音、节奏、音效和音乐。

局部返工

只修改有问题的台词或声音片段。

AI 制作导演

理解章节内容,规划环境音、关键音效和 BGM;确认后再把方案写入多轨工程。

音频作品导出

将语音或完整多轨工程导出为音频文件。

使用说明

音效、环境和 BGM 从哪里来

不必只靠自己找素材。已有声音可以直接使用,缺少的部分也可以交给 AI 生成。

展开查看

使用自己的素材

导入本地音效、环境音和背景音乐,放进素材库或时间线继续使用。

用 AI 生成

用文字描述脚步、雨声、房间氛围或配乐方向,生成候选后再试听和选择。

在本机生成

通过 BoboGen 运行已接入的本地音效与音乐模型,可以不使用云端生成额度。

AI 画笔

直接在时间线上指定位置和时长,生成人声、环境音、剧情音效或 BGM,结果会进入对应轨道。

可以连接哪些语音模型

BoboVox 不把你锁在单一模型上。可以按语言、音色、情绪控制和使用成本选择合适的声音来源。

展开查看

本地语音模型

当前代表性接入包括 IndexTTS2、F5-TTS、GPT-SoVITS V2Pro,可通过 BoboGen 在自己的设备上运行。

云端语音服务

当前代表性接入包括 MiniMax Speech、通义千问 Qwen TTS、火山引擎 Seed TTS、腾讯云语音和百度智能云。

系统和浏览器声音

也可以使用 Edge TTS、Browser Speech 等声音服务,适合快速试听和常规内容。

声音生成模型

当前代表性本地接入包括 Stable Audio 3 Small SFX 和 Stable Audio 3 Small Music,用于音效、环境音和 BGM。

模型会持续增加。具体可用列表、语言、音色、情绪、克隆和生成参数,以当前客户端里的模型说明为准。

统一模型协议(共享协议)

不同模型的用法并不完全一样。BoboVox 用一套共同规则把它们接进同一个工程,普通用户不需要自己研究每个接口。

展开查看

一个工程可以换模型

角色、文本和时间线保持不变,换成其他已接入模型后继续制作。

只显示真正支持的控制

模型支持情绪、指令、停顿或语气词时才显示对应选项;不支持的内容不会拿来报错。

统一常用设置

文本、角色、音色、模型和输出信息用统一方式保存,减少重复配置。

不是共享用户数据

这里的“共享”是模型共用一套接入规则,不是公开或上传你的项目、素材、账号和 API Key。

可以完成什么

  • 01短文本、口播、提示音和单人旁白
  • 02按章节制作的有声书、课程和长内容
  • 03由多个角色或说话人组成的语音作品
  • 04加入环境、音效和背景音乐的完整声音场景
  • 05可用于播客、游戏台词和广播剧等场景的音频
  • 06可继续局部返工、混音和导出的多轨工程

查看视频配音

围绕原视频完成字幕、角色配音、多语言版本、原声处理和成片导出。

查看对应功能