Skip to main content
SUNO umożliwia tworzenie niestandardowych postaci głosowych na podstawie dowolnych plików audio, realizując klonowanie głosu do generowania muzyki. W odróżnieniu od istniejącego Persona API (korzystającego z audio_id wygenerowanego przez Suno), to API przyjmuje publicznie dostępny audio_url, czyli własne nagranie głosu. Niniejsza dokumentacja wyjaśnia sposób integracji API klonowania głosu.

Krok pierwszy: utworzenie postaci głosowej

API posiada trzy parametry wejściowe: audio_url (wymagany), będący publicznie dostępnym URL do pliku audio w formacie MP3 lub WAV, zawierającego wyraźny głos jednej osoby; name oraz description (opcjonalne), określające nazwę i opis postaci głosowej. Wymagania dotyczące pliku audio:
  • Format: MP3 lub WAV
  • Długość: co najmniej 10 sekund
  • Zawartość: wyraźny głos jednej osoby, z minimalnym szumem tła lub muzyką
Otrzymany rezultat:
Jak widać, pole persona_id w data to ID utworzonej postaci głosowej. Pole is_public zawsze ma wartość false, ponieważ postacie głosowe tworzone przez przesłanie audio są prywatne.

Krok drugi: generowanie muzyki z wykorzystaniem postaci głosowej

Mając ID postaci głosowej, możemy użyć Suno Audios Generation API do generowania muzyki. Ustaw action na generate oraz persona_id na zwrócone wcześniej ID postaci głosowej — wygenerowana piosenka zostanie zaśpiewana klonowanym głosem.
Uwaga: Klonowanie głosu jest obsługiwane tylko przez modele chirp-v4-5 i nowsze (np. chirp-v4-5, chirp-v5, chirp-v5-5), nie jest wspierane przez chirp-v4.
Otrzymany rezultat:
Jak widać, wygenerowana piosenka została zaśpiewana klonowanym głosem. persona_id można także wykorzystać z akcją cover, aby wykonać covery istniejących utworów klonowanym głosem.