创建克隆音色
克隆流程第 2 步:用上传的录音克隆出你命名的音色;克隆本身免费,首次合成成功时收一次克隆费。
/v1/voice_clone传入第 1 步的 file_id 与你自己起的 voice_id,之后把 voice_id 填到 /v1/audio/speech 的 voice 或 /v1/t2a_v2 的 voice_setting.voice_id 即可合成。带上 text 与 model 可拿到试听音频:demo_audio 是 api.hop-base.com 上的下载链接,6 小时内有效;不传 text 时为空。
计费:上传与克隆免费。克隆费只收一次,在音色首次合成成功时一并扣除(使用记录明细多一项 voice_clone_activation);试听只按语音字符计费,不算首次使用。价格见价格页。
生命周期:克隆成功后源音频与示例音频自动删除,再次克隆须重新上传;克隆失败则保留文件,可换参数重试。克隆后 7 天内未用于合成的音色自动删除,且不收克隆费。音色只属于你的帐户(企业帐户下由企业主名下成员的密钥共享),其他帐户即使知道 voice_id 也用不了。
请求头
Bearer sk-…:控制台「API 密钥」里创建的密钥,所属分组须包含请求的模型
请求体参数JSON
第 1 步 purpose=voice_clone 上传返回的文件 ID,只能用一次
范围≥ 1
你自己起的音色名,帐户内唯一:由字母、数字、-、_ 组成,以字母开头,不以 - 或 _ 结尾
长度8–256 字符
示例片段
purpose=prompt_audio 上传返回的文件 ID
范围≥ 1
示例片段的逐字文本,以标点结尾
试听文本;传了会返回试听音频,按语音字符计费(不算首次使用)
长度≤ 1000 字符
传 text 时必填
可选值speech-2.8-hdspeech-2.8-turbo
与原生入口相同
可选值autoChineseChinese,YueEnglishArabicRussianSpanishFrenchPortugueseGermanTurkishDutchUkrainianVietnameseIndonesianJapaneseItalianKoreanThaiPolishRomanianGreekCzechFinnishHindiBulgarianDanishHebrewMalayPersianSlovakSwedishCroatianFilipinoHungarianNorwegianSlovenianCatalanNynorskTamilAfrikaans
预期文本,用语音识别比对源音频
长度≤ 200 字符
text_validation 的通过阈值;官方默认 0.7
范围0–1
降噪
默认false
音量归一
默认false
AIGC 水印
默认false
返回
200克隆成功
输入是否触发敏感内容
敏感内容类型
试听音频下载链接,6 小时内有效;不传 text 时为空字符串
仅带试听时返回
试听计费字符数
试听音频时长,毫秒
成功时为 {"status_code": 0, "status_msg": "success"};错误不走这里,而是非 200 状态码加 error 对象
成功为 0
成功为 success
错误
file_id 已用过或已过期、voice_id 不合规或已被占用、音频时长超出范围、text_validation 比对未通过、text 超长、传 text 缺 model、未知字段等missing_api_key / invalid_api_key / api_key_expired)insufficient_quota)model_not_found),或路径不属于该分组(route_not_found)request body is too largevoice cloning is temporarily unavailable、voice registry is temporarily unavailable; please retry 等:稍后重试