Skip to main content
SUNO nos permite crear personajes de voz personalizados a partir de cualquier archivo de audio, logrando la clonación de voz para la generación musical. A diferencia de la API Persona existente (que utiliza el audio_id generado por Suno), esta API acepta un audio_url accesible públicamente, es decir, tu propia grabación de voz. Este documento explica cómo integrar la API de clonación de voz.

Paso 1: Crear un personaje de voz

Esta API tiene tres parámetros de entrada: audio_url (obligatorio), que es la URL de un archivo de audio en formato MP3 o WAV accesible públicamente, que contenga voz clara de una sola persona; name y description (opcionales), que son el nombre y la descripción del personaje de voz. Requisitos del archivo de audio:
  • Formato: MP3 o WAV
  • Duración: al menos 10 segundos
  • Contenido: voz clara de una sola persona, minimizando ruido de fondo o música
El resultado es el siguiente:
Como se observa, el campo persona_id dentro de data es el ID del personaje de voz creado. El campo is_public siempre es false porque los personajes de voz creados mediante la subida de audio son privados.

Paso 2: Generar música usando el personaje de voz

Con el ID del personaje de voz, podemos usar la Suno Audios Generation API para generar música. Establece action a generate y persona_id al ID del personaje de voz obtenido arriba; la canción generada usará la voz clonada para la interpretación.
Nota: La clonación de voz solo es compatible con modelos chirp-v4-5 y superiores (como chirp-v4-5, chirp-v5, chirp-v5-5), no es compatible con chirp-v4.
El resultado es el siguiente:
Como se puede ver, la canción generada utiliza la voz clonada para la interpretación. El persona_id también puede usarse junto con la acción cover para versionar canciones existentes con la voz clonada.