Nvidia lanceert gratis spraakidentificatiemodel Nemotron 3

Chipmaker Nvidia heeft een nieuw open-source AI-model uitgebracht dat in staat is om conversaties te analyseren en tot acht verschillende sprekers gelijktijdig te herkennen. Het model is ontworpen om realtime sprekerseparatie uit te voeren.
Nvidia heeft het AI-model Nemotron 3 Diarization beschikbaar gesteld, waarmee audiofragmenten direct kunnen worden opgesplitst per spreker in een gesprek. Het systeem herkent maximaal acht personen tegelijk en werkt in real-time.
Modellen voor sprekerherkenning worden vaak ingezet bij vergaderplatforms, transcriptieservices en klantenservice-applicaties om automatische notulen of verslagen overzichtelijker te maken. Nvidia breidt met dit model zijn portfolio van efficiënte AI-componenten verder uit, wat ontwikkelaars helpt om spraaktechnologie lokaal of via eigen servers te implementeren.
Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel