私有克隆音色属于提交任务时的组织。开始前请确认当前组织,并确保对录音、声音特征和计划用途已经取得合法、充分的许可。
第一步:填写音色名称
填写便于团队识别的名称,例如人物角色或业务用途。名称最多 160 个字符,但建议保持简短。
不要在音色名称中写身份证号、手机号、客户秘密或其他敏感个人信息。多个相似音色可以通过“人物 + 场景 + 版本”区分。
第二步:选择克隆主音频
有文件读取权限时,页面会列出当前组织内可用、20MB 以内的音频。你也可以前往文件中心管理这些文件。
有文件上传权限时,可以点击“选择本地音频”,然后点击“上传并使用”。必须等上传完成并自动选中后再提交克隆。
如果不能浏览已有文件但可以上传,页面会保留直接上传入口;如果两项权限都没有,请联系组织管理员。
第三步:决定是否提供提示音频
提示音频不是必填项。选择提示音频后,必须填写完全对应的“提示音频对应文本”。如果不准备提示音频,两项都留空。
提示音频同样必须属于当前组织、为可用音频且不超过 20MB。不要选择与主音频人物不同的录音。
第四步:填写试听文本
试听文本必填,最多 1000 个字符。它用于生成克隆结果的小样,建议包含正式业务中会遇到的数字、品牌词和完整句子。
默认试听文本可以直接使用,但更推荐换成能代表实际场景的短句。
第五步:选择是否降噪
降噪默认开启。如果原录音存在轻微、稳定的背景噪声,可以保留开启;如果原录音已经过强降噪或声音细节很少,可以用短样分别测试。
音量归一化由智笔生花固定开启,不需要用户设置。
第六步:确认计费并提交
点击“开始克隆”后,确认弹窗会显示:
- 音色名称和语言。
- 试听文本字符数。
- 是否提供提示音频。
- 是否开启降噪。
- 按一次克隆用量计费的提示。
确认声音样本已经合法授权后,再点击“确认开始克隆”。取消不会发送请求,也不会清空表单或已经上传的文件。
第七步:检查结果
任务提交后,右侧记录会显示进度。成功后:
- 新音色自动加入当前组织音色库。
- 记录存在有效样本时可以试听。
- 具备文件读取权限时可以下载试听音频。
- 可以回到音色库找到该克隆音色,并用于文本配音。
试听时不要只听训练录音中出现过的原句。用不同句式、数字和品牌词生成配音,才能更准确判断音色是否适合正式使用。
失败后怎样处理
先看记录上的失败提示,不要连续重复提交。常见处理顺序是:
- 确认主音频和提示音频仍属于当前组织且可用。
- 检查格式、文件大小、空音频和上传状态。
- 确认提示音频与提示文本是否同时提供且内容一致。
- 换用更清晰、未经强处理的短录音。
- 核对执行权限、克隆额度和智贝余额。
- 修正后创建新的克隆任务。
当前工作台不提供取消、删除或手动重放克隆任务。历史记录保留用于结果和账务核对。