Crear una voz clonada
Paso 2 del flujo de clonación: clona a partir de la grabación subida una voz con el nombre que usted elija; la clonación es gratis y la tarifa de clonación se cobra una vez con la primera síntesis correcta.
/v1/voice_clonePase el file_id del paso 1 y un voice_id elegido por usted; después ponga ese voice_id en voice de /v1/audio/speech o en voice_setting.voice_id de /v1/t2a_v2 para sintetizar. Si incluye text y model, obtiene un audio de vista previa: demo_audio es un enlace de descarga en api.hop-base.com, válido 6 horas; sin text queda vacío.
Facturación: subir y clonar es gratis. La tarifa de clonación se cobra una sola vez, junto con la primera síntesis correcta con la voz (el detalle del registro de uso muestra una línea adicional voice_clone_activation); la vista previa solo se factura por caracteres de voz y no cuenta como primer uso. Precios en la página de precios.
Ciclo de vida: tras una clonación correcta, el audio fuente y el de ejemplo se eliminan automáticamente; para volver a clonar hay que subirlos de nuevo. Si la clonación falla, los archivos se conservan y puede reintentar con otros parámetros. Una voz clonada que no se use para sintetizar en 7 días se elimina automáticamente, sin cobrar la tarifa de clonación. La voz pertenece solo a su cuenta (en una cuenta empresarial la comparten las claves de los miembros del titular de la empresa); otras cuentas no pueden usarla aunque conozcan el voice_id.
Encabezados
Bearer sk-…: una clave de API creada en la consola; su grupo debe incluir el modelo solicitado
Parámetros del cuerpoJSON
ID de archivo devuelto por la subida del paso 1 con purpose=voice_clone; solo se puede usar una vez
Rango≥ 1
Nombre de voz elegido por usted, único en la cuenta: letras, números, - y _; empieza por una letra y no termina en - ni _
Longitud8–256 caracteres
Fragmento de ejemplo
ID de archivo devuelto por la subida con purpose=prompt_audio
Rango≥ 1
Transcripción literal del fragmento de ejemplo, terminada en un signo de puntuación
Texto de vista previa; si se envía, se devuelve un audio de vista previa facturado por caracteres de voz (no cuenta como primer uso)
Longitud≤ 1000 caracteres
Obligatorio si se envía text
Valoresspeech-2.8-hdspeech-2.8-turbo
Igual que en el endpoint nativo
ValoresautoChineseChinese,YueEnglishArabicRussianSpanishFrenchPortugueseGermanTurkishDutchUkrainianVietnameseIndonesianJapaneseItalianKoreanThaiPolishRomanianGreekCzechFinnishHindiBulgarianDanishHebrewMalayPersianSlovakSwedishCroatianFilipinoHungarianNorwegianSlovenianCatalanNynorskTamilAfrikaans
Texto esperado; se compara con el audio fuente mediante reconocimiento de voz
Longitud≤ 200 caracteres
Umbral de aprobación de text_validation; valor oficial por defecto 0.7
Rango0–1
Reducción de ruido
Predeterminadofalse
Normalización de volumen
Predeterminadofalse
Marca de agua AIGC
Predeterminadofalse
Respuesta
200Clonación correcta
Si la entrada activó la detección de contenido sensible
Tipo de contenido sensible
Enlace de descarga del audio de vista previa, válido 6 horas; cadena vacía si no se envía text
Solo se devuelve con vista previa
Caracteres facturados de la vista previa
Duración del audio de vista previa, en milisegundos
Si tiene éxito, {"status_code": 0, "status_msg": "success"}; los errores no van aquí, sino con un código de estado distinto de 200 y un objeto error
0 si tiene éxito
success si tiene éxito
Errores
file_id ya usado o caducado, voice_id no válido o ya en uso, duración del audio fuera de rango, comparación de text_validation no superada, text demasiado largo, text sin model, campos desconocidos, etc.missing_api_key / invalid_api_key / api_key_expired)insufficient_quota)model_not_found) o la ruta no pertenece a ese grupo (route_not_found)request body is too largevoice cloning is temporarily unavailable, voice registry is temporarily unavailable; please retry, etc.: reintente más tarde