Nieuw multimodaal Qwen-model concurreert met Google

Qwen heeft Qwen3.8-Omni-Flash uitgebracht, een multimodaal model voor AI-agenten dat audio en video verwerkt. Het model levert vergelijkbare prestaties als vergelijkbare Google-systemen, maar tegen aanzienlijk lagere API-kosten.
Het model is specifiek ontworpen om zelfstandig tools te gebruiken en diverse taken uit te voeren, zoals het bewerken van video's, vertalen van fragmenten en samenvatten van films. Dankzij de combinatie van audio- en videoverwerking kan het systeem complexe multimediale opdrachten aan.
Toenemende concurrentie in multimodale AI
De introductie past in een bredere marktontwikkeling waarin fabrikanten elkaar de maat nemen op het gebied van efficiëntie en prijs. Waar eerdere generaties vooral tekst verwerkten, ligt de focus nu op multimodale systemen die verschillende mediavormen tegelijkertijd begrijpen en bewerken.
Door concurrerende prestaties te leveren tegen lagere kosten, wordt geavanceerde AI toegankelijker voor ontwikkelaars en toepassingen waarbij API-kosten een zware weging hebben.
Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel