Cloudspecialisten richten zich op efficiëntie bij AI-inferentie
De markt voor het uitvoeren van getrainde AI-modellen vraagt om nieuwe technische oplossingen om de prestaties te verbeteren. Gespecialiseerde cloudaanbieders breiden daarom uit van enkel rekenkracht naar integrale optimalisatie van opslag en netwerken.
De nadruk in de technologiesector verschuift momenteel van het trainen van nieuwe modellen naar het daadwerkelijk inzetten daarvan voor gebruikers, een proces dat bekendstaat als inferentie. Omdat dit dagelijks gebruik enorme hoeveelheden rekenkracht en energie vraagt, zoeken bedrijven naar manieren om dit sneller en kostenefficiënter in te richten. Alleen het aanbieden van grafische processoren volstaat daarbij niet meer.
Van hardware naar integrale diensten
Om deze knelpunten op te lossen, richten cloudproviders zich op een bredere aanpak waarin zowel netwerkverbindingen als opslagsystemen en software op elkaar worden afgestemd. Deze verschuiving past in de bredere volwassenwording van de markt, waarin de economische haalbaarheid van kunstmatige intelligentie steeds centraler komt te staan. Door de infrastructuur rondom de modellen te optimaliseren, hopen aanbieders de operationele kosten te beheersen.
Deze samenvatting is gebaseerd op een origineel artikel van SiliconANGLE AI. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel