DeepSeek lanceert nieuw multimodaal taalmodel
De Chinese startup DeepSeek heeft een nieuw model toegevoegd aan zijn serie grote taalmodellen. Het model genaamd V4 Flash Vision Exp is vooralsnog beschikbaar via het betaalde platform voor ontwikkelaars.
De ontwikkelaars achter de V4-serie hebben een variant uitgebracht die zowel tekst als andere media kan verwerken. Dit model is direct gelanceerd op de eigen programmeeromgeving van de organisatie. Het bedrijf staat erom bekend dat het in het verleden geregeld open-source varianten deelde met de gemeenschap, wat de deur openzet voor een latere publieke uitrol.
Multimodale systemen vormen een belangrijk onderdeel van de huidige generatie kunstmatige intelligentie, omdat ze verschillende typen data zoals tekst en visuele informatie met elkaar kunnen combineren. Dit soort toevoegingen laat zien hoe de concurrentie in de sector aanhoudt, waarbij bedrijven elkaar proberen te overtreffen in zowel taalvaardigheid als visuele verwerking.
Deze samenvatting is gebaseerd op een origineel artikel van SiliconANGLE AI. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel