Google introduceert gerichte videoverwerking voor Gemini Flash
Google heeft een nieuwe methode ontwikkeld voor zijn Gemini Flash-modellen om efficiënter door videobestanden te navigeren. In plaats van elk beeldje afzonderlijk in te laden, selecteert de software gericht de benodigde fragmenten op basis van een vraag.
Google past de manier aan waarop zijn Gemini Flash-modellen videobestanden verwerken. Het systeem analyseert niet langer standaard elke seconde van een video, maar laadt uitsluitend de onderdelen die direct aansluiten bij een gegeven instructie. Deze aanpak zorgt voor een aanzienlijke besparing op het verbruik van rekeneenheden.
Efficiënter omgaan met videodata
Het verwerken van videobestanden vraagt traditioneel om veel rekenkracht en geheugen binnen taalmodellen. Door selectief te werk te gaan, kunnen systemen sneller reageren op specifieke vragen over beeldmateriaal zonder dat de volledige inhoud vooraf hoeft te worden ingelezen. Dit sluit aan bij een bredere trend in de technologiesector om AI-toepassingen lichter en zuiniger te maken.
Grotere taalmodellen krijgen steeds vaker multimodale vaardigheden, waarmee ze tekst, audio en video gecombineerd kunnen verwerken. Optimalisaties zoals deze zijn nodig om dergelijke technologie bruikbaar te houden bij grote hoeveelheden data.
Deze samenvatting is gebaseerd op een origineel artikel van MarkTechPost. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel