一份真正可以听见的工作稿
作者不断变化的文字,与读者最终听见的声音,可以在同一个修改流程里连接起来。
修改文字,不必逐句重新录音
更新书稿后,只重新生成发生变化的片段,并继续使用同一个私人音色。
让长文任务始终可恢复
每段都显示进度,并限制在 4,200 字符和最多 7 个顺序请求内。
得到可以正常播放的 WAV 片段
PCM 响应在浏览器中完成校验与合并后,才会开放完整片段下载。
CastReader 生成什么,哪些仍需要人完成
把输出作为可审听的制作模块,而不是用它替代创作、版权与音频母带。
| 阶段 | CastReader 当前能力 | 仍需你负责 |
|---|---|---|
| 音色测试 | 最多 600 字符的播放和 WAV | 表演感觉与发音检查 |
| 书稿片段 | 最多 4,200 字符合并为一个 WAV | 文字编辑与事实核查 |
| 完整有声书 | 由多个有限片段组成 | 章节组装、母带和全书质检 |
| 公开发行 | 不自动生成发行平台包 | 文字与声音权利、披露和平台规则 |
从书稿到可以审听的声音片段
- 1
创建你的私人克隆音色
录制自己的声音 3–30 秒,确认声音归属,并创建绑定账户的克隆。
- 2
打开有权处理的书稿
选择支持的无 DRM 文件,原始文档在浏览器中本地解析。
- 3
选择我的克隆音色和有限片段
选择你拥有的音色,并让当前导出保持在清楚标示的 4,200 字符以内。
- 4
审听、修改并下载
先听合并结果,需要时修改原文,再下载已经完成的 WAV 片段。
书稿不断变化,你的声音仍然可以留在故事里
作者很少一次就完成一本书。一句话会重写,一个场景会移动,一个章节还要重新审听。声音克隆真正有价值的地方,是让这些修改可以被听见,而不是每次编辑后都要求作者重新走进录音环境。
CastReader 把有声书制作拆成一段段可恢复的任务。4,200 字符的清晰边界和最多 7 个请求的限制,让失败更容易续接,也让编辑后的局部内容可以单独重新生成。
人与人之间的判断仍然重要。作者可以和编辑、合作伙伴或第一位听众一起审听,判断节奏和发音是否服务于故事;生成音色不会替你完成这些编辑决定。
一个 WAV 片段不等于完成的商业有声书。公开发行仍需要确认书稿和声音权利、按要求披露 AI 使用、组装章节、制作母带、全书审听,并遵守发行平台要求。
使用克隆音色制作有声书
开始前先了解真实的制作边界。
可以一次生成整本书吗?
不可以。当前 Pro 文档流程每次导出一个有限片段,每段最多 4,200 字符、最多 7 个顺序合成请求,以便进度始终清楚并可以恢复。
可以打开哪些文件?
本地网页朗读器支持你有权使用的无 DRM PDF、EPUB、DOCX、TXT、Markdown 和 HTML。CastReader 不会绕过 DRM,也不会导入受保护的 Kindle 购买内容。
如果我修改了书稿怎么办?
重新打开更新后的文字,用同一个私人克隆音色生成受影响的片段即可,不需要为每次修改重新创建音色。
下载的 WAV 可以直接提交 Audible 或其他发行平台吗?
不可以。它是可审听的音频片段,不是已经制作母带、划分章节并符合发行要求的完整包。编辑、母带、权利、披露和平台规范仍由你负责。
可以使用他人的克隆音色做旁白吗?
只有仍在世的声音本人通过 Voice Gift,亲自向你的邀请者账户授予仍然有效的私人 TTS 权限时才可以;送达声音礼物不需要接收邮箱。请勿上传他人的录音,也不要用亲属或伴侣关系替代授权。
