GPU, TPU en NPU: welke chip doet wat?
Waarom gewone processors niet volstaan
De processor in je laptop is gebouwd om snel achter elkaar verschillende dingen te doen. AI vraagt het tegenovergestelde: miljarden keren dezelfde simpele rekensom, allemaal tegelijk. Daar is een andere soort chip voor nodig — niet een snellere, maar een bredere.
De drie soorten
GPU — grafische processor
Oorspronkelijk gemaakt om beelden te berekenen voor spellen, en precies daarom geschikt voor AI: beeldberekening is ook heel veel dezelfde som naast elkaar. Dit was een gelukkig toeval dat één bedrijf wereldwijd marktleider heeft gemaakt. Een GPU kan zowel trainen als antwoorden en is daarmee de veelzijdigste keuze.
TPU — tensorprocessor
Een chip die Google heeft laten maken voor precies één soort werk: de rekenpatronen die in neurale netwerken voorkomen. Minder veelzijdig dan een GPU, maar voor dat ene doel efficiënter — en dus goedkoper per berekening. Een tensor is in dit verband niets magisch: het is de naam voor het soort getallenrooster waar deze modellen mee rekenen.
NPU — neurale processor
De kleine variant, die inmiddels in telefoons en laptops zit. Niet bedoeld om modellen te bouwen, maar om een klein model lokaal te laten draaien zonder je accu leeg te trekken. Dit is de chip achter functies die op je apparaat zelf werken in plaats van in een datacenter.
Waarom de grote bedrijven eigen chips maken
Niet om betere chips te hebben dan de marktleider — dat lukt meestal niet. Het gaat om drie andere dingen.
Prijs. Wie honderdduizenden chips per jaar afneemt, betaalt een enorme marge aan de leverancier. Zelf laten maken is onder die omvang goedkoper, zelfs als de chip minder goed is.
Beschikbaarheid. In de drukste jaren was de beperking niet geld maar levertijd. Een eigen lijn is zekerheid.
Onderhandelingspositie. Een geloofwaardig alternatief in huis hebben verandert het gesprek met de leverancier, ook als je uiteindelijk bij die leverancier blijft kopen.
Wat je hieruit moet onthouden
Als gebruiker merk je van dit alles bijna niets, en dat is de bedoeling. Het is wel de reden dat berichten over AI zo vaak over chips gaan: de rekenkracht is op dit moment de schaarste in de hele keten, en wie die kraan beheert, bepaalt veel.