Terug naar nieuws
Onderzoek

FreeToken maakt lokaal draaien van enorme taalmodellen mogelijk

23 augustus 2026•Samengevat door AI Dagblad-redactie•Bron: MarkTechPost

Een nieuwe inferentie-engine genaamd FreeToken maakt het mogelijk om grote Mixture-of-Experts modellen lokaal uit te voeren op een enkele werkstation-gpu. De software verdeelt de belasting slim over de beschikbare hardwarebronnen.

Met FreeToken is een techniek ontwikkeld waarmee geavanceerde taalmodellen lokaal kunnen draaien op standaard hardware. De engine splitst de cache-uitwisselingen op tussen geheugenoverdrachten en computerberekeningen, waardoor het mogelijk wordt om omvangrijke systemen op een enkele werkstation-gpu te benaderen.

Lokaal rekenen aan AI

Het lokaal uitvoeren van grote modellen wint aan populariteit binnen de techwereld, omdat het gebruikers meer controle geeft over hun data en minder afhankelijkheid van clouddiensten vereist. Door efficiënter gebruik te maken van bestaande hardware wordt geavanceerde technologie toegankelijker voor ontwikkelaars en onderzoekers die geen gebruik willen maken van zware datacenter-infrastructuur.

Deze samenvatting is gebaseerd op een origineel artikel van MarkTechPost. Lees het volledige, originele bericht bij de bron.

Lees het originele artikel

Achtergrond bij dit bericht

Meer uit Onderzoek

Van de makers van AI Dagblad

Wil je AI inzetten in je eigen bedrijf?

Van een slimme assistent tot een agent die je administratie doet — wij bouwen het betaalbaar. Stel vrijblijvend je vraag.