Teknologi

Suno læser nu dit digt højt og komponerer musikken til det i samme omgang

Susan Hill
Tilføj os på Google

Suno, appen, der blev kendt for at forvandle en prompt på én linje til en sang, gør nu noget mere usædvanligt med dine ord: Den læser dem højt og komponerer musikken til dem i samme omgang. Skriv et digt, en skål eller en godnathistorie, beskriv den stemme og stemning, du ønsker, og Speech leverer ét lydspor, hvor fortællerstemmen og musikken er skabt sammen i stedet for at blive lagt oven på hinanden bagefter. Det svære ved selv at lave et lydstykke har sjældent været stemmen. Det har været at få stemmen og musikken til at lyde, som om de hører hjemme i samme rum.

For alle, der laver bryllupstaler, korte videoer, guidede meditationer eller podcast-introer, fjerner det et trin, som normalt kræver to apps og et redigeringsspor. I dag betyder opgaven, at man producerer fortællerstemmen ét sted, finder et royaltyfrit musikunderlag et andet sted og derefter justerer lydstyrken, indtil musikken ikke længere overdøver ordene. Sunos idé er, at én enkelt model håndterer begge dele, så lydsporet bliver komponeret omkring talen i stedet for blot at blive lagt ind under den.

Speech har to tilstande. I Simple beskriver du en idé, for eksempel en piratkaptajn, der samler sit mandskab, og Suno skriver ordene og fremfører dem. Advanced tager udgangspunkt i dit eget manuskript og giver dig mulighed for at styre stemmens køn, talestil og hvor meget fremførelsen varierer fra den ene version til den næste. Lydsporene kan vare op til omkring otte minutter, hvilket er nok til en hel godnathistorie eller en kort meditation. Musikken er slået til som standard, men kan slås fra, hvis man kun ønsker fortællerstemmen.

Jack Brody, Sunos produktchef, beskriver det som den første lydmodel, der genererer stemme og musik sammen som ét sammenhængende lydspor. Syntetisk fortællerstemme er ikke noget nyt i sig selv. ElevenLabs, Adobe og Google DeepMind tilbyder alle tekst-til-tale, der lyder menneskeligt, men brugeren må selv stå for lydsporet, producere det separat og mixe det i hånden. Suno bevæger sig ind på området fra den modsatte side: som et musikfirma, der føjer en stemme til, snarere end et stemmefirma, der føjer musik til.

Der er stadig tydelige skønhedsfejl, og Suno nævner selv nogle af dem. Selskabet advarer om, at en britisk accent kan drive over mod Australien og tilbage igen, og at dramatiske pauser kan blive meget dramatiske. Der er ingen indstillinger for præcis varighed eller timing på ordniveau, og Suno har ikke oplyst, om de brugerdefinerede stemmer, som brugerne allerede kan indspille til sange, også virker i Speech. Selskabet har heller ikke offentliggjort, hvilke sprog funktionen understøtter – et vigtigt spørgsmål for lyttere uden for de engelsksprogede markeder – eller hvor mange credits et lydspor med fortællerstemme koster. På det gratis abonnement beholder Suno ifølge sine standardvilkår ejerskabet til det, brugerne genererer, og udelukker kommerciel brug. Alle, der planlægger en podcast med betaling eller en reklame, bør derfor læse det med småt først.

Speech blev tilgængelig for alle Suno-brugere på nettet og i iOS- og Android-appene den 1. oktober efter omkring en måneds test med en mindre gruppe. Funktionen er stadig mærket som en betaversion, bruger de samme credit-abonnementer som sanggenerering, og Suno har ikke meldt nogen dato ud for en færdig version.

Lanceringen finder også sted midt i en juridisk strid. Warner Music Group indgik forlig med Suno og licenserede selskabet i november 2025, men Universal Music Group og Sony Music anlagde en ny sag i september om musikmodellerne v6. De beskylder selskabet for at have kopieret mere end 60.000 indspilninger og kræver op til 9 milliarder dollar i lovbestemt erstatning. Sagen verserer ved en føderal domstol i Boston, hvilket betyder, at lydsporet under din godnathistorie kommer fra et selskab, der stadig forsvarer den måde, det lærte at lave musik på.

Tags: , , , , ,

Tilføj os på Google

Debat

Der er 0 kommentarer.