Suno introduceert Speech om spraak en muziek te combineren

Het platform Suno heeft een bètaversie van Speech uitgebracht. Hiermee kunnen gebruikers gesproken audio genereren die direct wordt gecombineerd met originele achtergrondmuziek in één enkel model.
Suno heeft een nieuwe functie gelanceerd genaamd Speech, waarmee gesproken audio en muzikale composities naadloos in elkaar overlopen binnen één enkel model. Gebruikers kunnen ideeën of teksten invoeren die vervolgens worden omgezet naar gesproken woord met een bijpassende achtergrondtrack. Na een testperiode voor een kleine groep is de bètaversie nu beschikbaar voor een breed publiek via zowel mobiele als webapplicaties.
De convergentie van stem en muziekGeneratieve AI voor audio richt zich traditioneel op ofwel spraaksynthese, zoals bij virtuele assistenten, ofwel op het creëren van instrumentale muziek en liedjes. Het combineren van beide elementen in één model sluit aan bij de bredere trend waarin AI-systemen steeds meer verschillende soorten media tegelijkertijd kunnen verwerken en genereren. Dit soort technologieën verlagen de drempel voor het maken van multimediale content, doordat makers niet langer afzonderlijke tools hoeven te gebruiken voor voice-overs en achtergrondmuziek.
Deze samenvatting is gebaseerd op een origineel artikel van Unite.AI. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel