Skip to content

声音克隆

本节适用场景

声音克隆允许用户上传一段真人录音作为样音,由 AI 克隆出一个专属的 AI 播音音色。克隆出的音色属于用户私有,可以用于项目中的角色配音。本节介绍声音克隆的完整流程。


关于声音克隆

万象有声目前提供极速克隆功能,专业克隆走线下人工通道。极速克隆的特点是快速、低门槛,但克隆效果的相似度受样音质量影响较大。

克隆生成的 AI 播音属于用户私有,未经用户允许不能出现在官方 AI 播音库中。


打开克隆弹窗

在「AI 有声」或「新建」入口点击 ​「声音克隆」​,弹出声音克隆弹窗。


准备样音

提交声音克隆需要填写三个必须字段:样音、试听文本、同意声明。任意一个为空,「开始克隆」按钮置灰不可点击。

上传样音
点击「上传样音」面板的任意位置,打开系统文件选择窗,或直接将音频文件拖放到面板中:

  • 支持格式:mp3、wav、m4a
  • 文件大小:最大 20M
  • 音频时长:30~300 秒(约 0.5~5 分钟)

选择好文件后,面板中显示音频文件的播放按钮、文件名及文件大小。如果文件过大,旁边会显示错误提示。用户可以点击删除按钮重新上传,或直接拖放新文件自动替换。

试听文本
试听文本是指克隆完成后,用克隆好的音色朗读的一段文字,用于验证克隆效果。最多 300 字。

弹窗中预设了几段官方提供的试听文本,点击即可使用预设文本替换输入框中的内容,也可以自己填写。

同意声明
勾选同意相关条款后,「开始克隆」按钮才可点击。

9-59-1


开始克隆

点击 ​「开始克隆」​ 按钮后,系统先检查是否满足克隆条件:

  • 文件格式不符合要求 → Toast 提示「文件格式不符合要求」
  • 文件大小超过 20M → 提示「音频文件大小不符合要求,最大为 20M」
  • 音频时长不在 30~300 秒内 → 提示「音频时长不符合要求,应在 30~300 秒」
  • 积分余额不足 → 提示「您的积分余额不足」

所有条件满足后,进入 loading 状态,提示「正在克隆」。克隆完成后,Toast 提示克隆完成,并在弹窗底部显示样音播放条,点击可以用克隆好的音色播放该样音。

点击「开始克隆」前,系统会先弹出生成须知弹窗,用户确认后才正式开始克隆。


重试机制

首次克隆完成后,弹窗中会显示 ​「重试」​ 按钮,允许用户在不重新付费的情况下重新克隆:

  • 非会员:可免费重试 1 次
  • 会员:可免费重试 2 次
  • 免费重试机会用完后,再次点击「重试」需要重新付费

重试时允许重新选择样音和修改试听文本。点击「重试」按钮后:

  • 弹窗提醒用户重新克隆会放弃当前已克隆好的音色
  • 用户点击「重选样音」,打开系统文件选择窗,选好样音文件后进入准备克隆界面
  • 进入重新克隆界面后,无论用户是否点击「开始生成」,都会消耗 1 次重试机会

历史音色展示:​
重试后,弹窗中会以列表形式展示本次所有已生成的音色,每个音色都有独立的播放按钮,点击可播放该音色的样音。用户可以从中选择一个满意的音色保存,不需要只保留最后一次生成的结果。

9-59-2


关闭弹窗的规则

  • 未开始首次克隆前:弹窗可以自由关闭
  • 克隆进行中(无论首次还是重试):关闭按钮隐藏或不可点击,不能中断克隆
  • 克隆成功后(无论首次还是重试):点击关闭按钮会弹出「保存音色」弹窗,引导用户保存

注意:即使用户意外关闭了弹窗,只要点击了「开始克隆」,积分已经扣除,系统会在后台继续完成克隆,克隆完成后将音色数据保存到用户账户下(按默认命名规则自动保存,性别、年龄段和语言保持为空)。


保存音色

克隆完成后点击 ​「保存」​,弹出保存窗,需要填写以下信息:

音色名称
默认名称:「我的声音克隆」+ 当前有效声音克隆数 + 1(如:已有 2 个克隆,则默认为「我的声音克隆 03」)。音色名对用户唯一,如果已有同名音色(包括声音克隆和音色定制生成的),Toast 提示「您已生成过同名的音色,请重命名」。

音色性别
手动选择:男 / 女。

音色年龄
手动选择年龄段:儿童 / 少年 / 青年 / 中年 / 老年。

音色语言
手动选择:普通话 / 英语 / 等。

点击保存后,Toast 提示成功或失败原因。成功后关闭所有相关弹窗,音色出现在「个人 - 素材 - AI 播音 - 我克隆的」列表中,可以在项目中选用。


音色头像

克隆的 AI 播音默认头像根据性别和年龄段信息自动匹配,从系统预设的 13 张头像图片中选取对应的默认头像。


常见问题

问题一:样音录音有什么质量要求?​

样音没有强制的质量要求,但克隆效果与样音质量直接相关。建议使用安静环境下录制的清晰人声,避免背景噪音、混响或多人说话。样音时长在 30~300 秒(约 0.5~5 分钟),时长越充分,克隆效果通常越好。

问题二:克隆结果不满意,但免费重试机会已用完怎么办?​

免费重试机会用完后,可以选择:① 从历史生成的音色中选择相对满意的一个保存;② 重新付费进行新一轮克隆(关闭弹窗后重新打开声音克隆功能)。如果你是非会员,可以考虑开通会员以获得更多免费重试机会。

问题三:克隆过程中不小心关闭了弹窗,积分还会扣吗?​

会。只要点击了「开始克隆」,积分就已经扣除,系统会在后台继续完成克隆。克隆完成后音色会按默认规则自动保存,你可以在「个人 - 素材 - AI 播音 - 我克隆的」中找到该音色,再手动完善音色信息。

问题四:克隆的音色可以用于商业项目吗?​

这取决于你上传的样音是否拥有合法授权。系统要求用户在提交克隆前勾选同意相关条款,请确保你对样音拥有必要的使用权,并遵守平台的使用规范。


本节小结

  • 样音要求:mp3/wav/m4a 格式,最大 20M,时长 30~300 秒
  • 付费一次后,非会员可免费重试 1 次,会员可免费重试 2 次
  • 重试后历史音色保留展示,用户可以从中择优保存
  • 意外关闭弹窗后,系统仍会在后台完成克隆并自动保存音色
  • 保存时需要填写名称、性别、年龄、语言,音色名对用户唯一

下一节:第 59 节《音色定制》—— 介绍如何通过文字描述音色特征,由 AI 生成专属播音音色,以及与声音克隆的区别和使用建议。