Meta presenteert real-time audimodel voor continue AI-assistenten

Meta heeft Muse Voice Transcribe geïntroduceerd, een real-time spraakverwerkingsmodel dat audio direct omzet in tekst en sprekers van elkaar onderscheidt. De technologie is bedoeld als basis voor persoonlijke assistenten op apparaten zoals slimme brillen.
Het nieuwe model van Meta verwerkt gesproken taal in kleine stappen en kan feilloos onderscheiden wie er aan het woord is. Volgens onafhankelijke analyses levert de software nauwkeurige resultaten op tegen relatief lage kosten.
De ontwikkeling past in een bredere trend waarin bedrijven inzetten op ambient computing, waarbij kunstmatige intelligentie continu op de achtergrond meeluistert en reageert via draagbare apparatuur zoals camerabrillen.
Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel