# 音色库、我的音色与声音克隆

Source: [音色库、我的音色与声音克隆](<https://pr-444-preview.chatcut.dev/zh/docs/voice-library>)

Documentation index: [llms.txt](<https://pr-444-preview.chatcut.dev/zh/docs/llms.txt>)

Last updated: 2026-10-09

**音色库**提供可以试听和调用的官方音色；**我的音色**保存你克隆的个人音色。选择音色只会把它加入当前 AI 草稿，不会自动生成旁白。

## 我需要准备什么？

-   先决定使用官方音色、已有的 **My Voices**，还是创建新的克隆音色；试听官方音色不需要上传素材。
-   克隆音色需要一段只有目标人物说话的清晰录音，可以现场录制或上传。
-   只能克隆你自己的声音，或已经取得明确授权的声音。

## 找到并试听音色

1.  点击 AI 输入框下方的 **+**，再选择 **音色（Voices）**。
2.  点击播放按钮，试听 **精选** 或 **我的音色** 中的声音。
3.  点击 **浏览全部音色**，打开完整音色库；可以搜索、筛选并切换到 **我的音色**。
4.  点击音色名称或音色卡片上的 **使用**，把它加入当前 AI 草稿。

用语言筛选让试听与准备生成的旁白保持一致。兼容音色现在可以筛选**日语**：选择后会播放日语样例，并把日语作为明确的生成语言。不同音色支持的语言范围可能不同，因此应让筛选语言与文案一致，不要依赖对话语言自动推断。

## 克隆自己的音色

1.  点击 AI 输入框下方的 **\+ → 音色（Voices）→ 克隆音色（Clone Voice）**；也可以进入 **浏览全部音色 → My Voices**，点击 **克隆音色** 卡片。
2.  确认声音权利说明并选择录音语言。
3.  点击 **开始录音** 朗读页面文字，或点击 **上传音频**。参考音频需要 10 秒至 3 分钟，建议至少 30 秒。
4.  创建试听时保持窗口打开，对比 **克隆音色试听** 与 **原始音频**。
5.  必要时修改试听文本并点击 **重新生成试听**。
6.  输入音色名称并点击 **保存**；完成后，它会出现在 My Voices。

参考音频支持 AAC、FLAC、M4A、MP3、OGG、WAV 和 WebM，文件不超过 25 MB。背景音乐、多人说话、音量过低或选错麦克风都会降低质量。

## 在请求中使用音色

真正生成旁白，是在你发送一条同时带上音色、文案、语言、语气和位置要求的草稿时——这条请求和可以直接复制的 Prompt 都在 [AI Voiceover](https://pr-444-preview.chatcut.dev/zh/docs/ai-voiceover)。

ChatCut Desktop 0.5.5 及以上版本中，Desktop Agent 还可以从本地音频或视频素材的完整音轨创建经授权的克隆音色。它会先要求确认授权，并沿用 10 秒至 3 分钟、25 MB 的参考素材限制；这条 Agent 工作流不会给手动克隆窗口增加裁剪功能。

所有已登录账户都可以创建自己的克隆音色；使用 My Voices 生成旁白需要有效会员。可保存的音色名额随套餐档位变化，目前大致每 100 个套餐月度 Credits 对应一个音色名额；账户实际名额以克隆窗口和升级页面显示为准。

## 修正短口误

让 ChatCut Agent 修正现有录音里的某个词或短句。Agent 会先让你试听与说话人匹配的已保存音色；如果都不合适，可以回复继续，让它从项目中清晰、单人讲话的音频创建经授权的克隆音色。修正只替换说错的短句，保留前后原始录音和时间位置。

只能克隆你本人或已经获得明确授权的声音。为了获得更自然的结果，请明确指出原句和替换内容，并确保项目里有同一说话人的清晰音频样本。

音色、[Skills / My Skills](https://pr-444-preview.chatcut.dev/zh/docs/skills-overview) 和 [Design Styles / My Styles](https://pr-444-preview.chatcut.dev/zh/docs/design-styles) 是可以从输入框附加的三类可复用上下文。旁白费用见[生成积分](https://pr-444-preview.chatcut.dev/zh/docs/generation-credits)。
