Teknologi

Suno leser nå diktet ditt høyt og komponerer musikken til det i samme slengen

Susan Hill
Legg oss til på Google

Suno, appen som ble kjent for å gjøre en kort instruksjon om til en sang, gjør nå noe mer spesielt med ordene dine: Den leser dem høyt og komponerer musikken som følger dem, i én og samme omgang. Skriv inn et dikt, en skål eller en godnatthistorie, beskriv stemmen og stemningen du ønsker, og Speech lager ett spor der fortellerstemmen og musikken er skapt sammen, ikke lagt oppå hverandre etterpå. Det vanskelige med å lage lyd selv har sjelden vært stemmen. Utfordringen har vært å få stemmen og musikken til å høres ut som om de hører hjemme i samme rom.

For alle som lager bryllupstaler, korte videoer, guidede meditasjoner eller podkastintroer, fjerner dette et steg som vanligvis krever to apper og en redigeringstidslinje. I dag må man spille inn fortellerstemmen ett sted, finne royaltyfri bakgrunnsmusikk et annet sted og deretter finjustere lydnivåene til musikken ikke lenger overdøver ordene. Sunos idé er at én og samme modell håndterer begge deler, slik at lydsporet komponeres rundt talen i stedet for å limes inn under den.

Speech har to moduser. I Simple-modus beskriver du en idé, for eksempel en sjørøverkaptain som samler mannskapet sitt, og Suno skriver ordene og fremfører dem. Advanced-modus lar deg bruke ditt eget manus og gir deg mulighet til å velge stemmens kjønn og talestil, samt hvor mye fremføringen skal variere fra forsøk til forsøk. Sporene kan vare i rundt åtte minutter, lenge nok til en hel godnatthistorie eller en kort meditasjon. Musikken er slått på som standard, men kan fjernes med en bryter for dem som bare vil ha fortellerstemmen.

Jack Brody, Sunos produktsjef, beskriver det som den første lydmodellen som lager stemme og musikk sammen som ett helhetlig spor. Syntetisk fortellerstemme er ikke noe nytt i seg selv. ElevenLabs, Adobe og Google DeepMind tilbyr alle tekst-til-tale som høres menneskelig ut, men brukeren må selv stå for lydsporet, produsere det separat og mikse det for hånd. Suno går inn på dette feltet fra motsatt kant: som et musikkselskap som legger til en stemme, snarere enn et stemmeselskap som legger til musikk.

Det finnes reelle svakheter, og Suno trekker selv frem noen av dem. Selskapet advarer om at en britisk aksent kan gli over i australsk og tilbake igjen, og at dramatiske pauser kan bli svært dramatiske. Det finnes ingen kontroller for nøyaktig varighet eller timing på ordnivå, og Suno har ikke opplyst om de tilpassede stemmene brukerne allerede kan spille inn til sanger, også fungerer i Speech. Selskapet har heller ikke offentliggjort hvilke språk funksjonen støtter – en mangel som betyr mye for lyttere utenfor engelskspråklige markeder – eller hvor mange kreditter et spor med fortellerstemme koster. Med gratisabonnementet beholder Sunos standardvilkår eierskapet til det brukerne lager, og kommersiell bruk er ikke tillatt. Alle som planlegger en podkast med inntekter eller en reklame, bør derfor lese det som står med liten skrift først.

Speech ble tilgjengelig for alle Suno-brukere på nett og i iOS- og Android-appene 1. oktober, etter omtrent en måneds testing med en liten gruppe. Funksjonen er fortsatt merket som beta, bruker de samme kredittabonnementene som sanggenerering, og Suno har ikke oppgitt noen dato for en ferdig versjon.

Lanseringen skjer også midt i en juridisk konflikt. Warner Music Group inngikk forlik med Suno og lisensierte musikk til selskapet i november 2025, men Universal Music Group og Sony Music leverte et nytt søksmål i september om musikkmodellene v6. De anklager selskapet for å ha kopiert mer enn 60 000 innspillinger og krever opptil 9 milliarder dollar i lovbestemte erstatninger. Saken behandles i en føderal domstol i Boston. Det betyr at lydsporet under godnatthistorien din kommer fra et selskap som fortsatt må forsvare hvordan det lærte å lage musikk.

Tagger: , , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.