Technologia

Suno czyta teraz twój wiersz na głos i od razu komponuje do niego muzykę

Susan Hill
Dodaj nas w Google

Suno, aplikacja, która zasłynęła z zamieniania krótkiego promptu w piosenkę, potrafi teraz zrobić z tekstem coś bardziej niezwykłego: przeczytać go na głos i jednocześnie skomponować muzykę. Wpisujesz wiersz, toast albo bajkę na dobranoc, opisujesz głos i nastrój, na jakich ci zależy, a Speech tworzy jeden utwór, w którym narracja i podkład powstają razem, zamiast być łączone dopiero później. Najtrudniejszym elementem domowego projektu audio rzadko był sam głos. Problemem było sprawienie, by głos i muzyka brzmiały tak, jakby należały do tego samego świata.

Dla osób przygotowujących przemowy weselne, krótkie filmy, medytacje prowadzone czy wstępy do podcastów oznacza to pominięcie kroku, który zwykle wymaga dwóch aplikacji i montażu na osi czasu. Do tej pory trzeba było nagrać narrację w jednym miejscu, znaleźć podkład muzyczny wolny od tantiem w innym, a potem regulować głośność, aż muzyka przestanie zagłuszać słowa. Suno obiecuje, że jeden model zajmie się obiema częściami, komponując ścieżkę dźwiękową z myślą o wypowiedzi, zamiast doklejać ją pod spodem.

Speech oferuje dwa tryby. W trybie Simple opisujesz pomysł — na przykład kapitana piratów zagrzewającego załogę do walki — a Suno samo pisze tekst i go odczytuje. Tryb Advanced pozwala wprowadzić własny scenariusz i daje dodatkowe ustawienia: płeć głosu, styl mówienia oraz zakres zmian w sposobie wykonania między kolejnymi próbami. Utwory mogą trwać około ośmiu minut, co wystarczy na całą bajkę na dobranoc albo krótką medytację. Muzyka jest domyślnie włączona, ale można ją wyłączyć, jeśli ktoś chce uzyskać wyłącznie narrację.

Jack Brody, dyrektor ds. produktu w Suno, określa Speech jako pierwszy model audio, który generuje głos i muzykę razem, tworząc spójną całość. Syntetyczna narracja sama w sobie nie jest nowością. ElevenLabs, Adobe i Google DeepMind oferują zamianę tekstu na mowę brzmiącą po ludzku, ale muzykę trzeba przygotować osobno i samodzielnie zmiksować. Suno wchodzi na rynek z przeciwnej strony: to firma muzyczna, która dodaje głos, a nie firma zajmująca się głosem, która dokłada muzykę.

Niedociągnięcia są realne i Suno samo o nich uprzedza. Firma ostrzega, że brytyjski akcent może nagle skręcić w stronę Australii, a dramatyczne pauzy bywają naprawdę bardzo dramatyczne. Nie ma ustawień pozwalających precyzyjnie określić czas trwania ani momentów wypowiadania poszczególnych słów. Suno nie wyjaśniło też, czy własne głosy, które użytkownicy mogą już nagrywać na potrzeby piosenek, działają również w Speech. Firma nie podała, jakie języki obsługuje funkcja — to istotna luka dla odbiorców spoza rynków anglojęzycznych — ani ile kredytów kosztuje utwór z narracją. W bezpłatnym planie standardowe warunki Suno zastrzegają własność wygenerowanych materiałów dla firmy i wykluczają ich komercyjne wykorzystanie. Każdy, kto planuje płatny podcast lub reklamę, powinien więc najpierw dokładnie przeczytać regulamin.

Speech udostępniono wszystkim użytkownikom Suno w wersji internetowej oraz w aplikacjach na iOS i Androida 1 października, po około miesiącu testów z niewielką grupą osób. Funkcja nadal ma status wersji beta, korzysta z tych samych planów kredytowych co generowanie piosenek, a Suno nie podało terminu wydania gotowej wersji.

Premiera odbywa się również w samym środku prawnej batalii. Warner Music Group zawarła ugodę z Suno i udzieliła firmie licencji w listopadzie 2025 roku, ale Universal Music Group i Sony Music złożyły we wrześniu nowy pozew dotyczący modeli muzycznych v6. Zarzucają w nim firmie skopiowanie ponad 60 000 nagrań i domagają się nawet 9 miliardów dolarów ustawowego odszkodowania. Sprawa toczy się przed sądem federalnym w Bostonie, co oznacza, że muzykę podkładaną pod bajkę na dobranoc generuje firma, która wciąż musi bronić sposobu, w jaki nauczyła się tworzyć muzykę.

Tagi: , , , , ,

Dodaj nas w Google

Dyskusja

Jest 0 komentarzy.