Jina AI introduceert jina-ocr-v1 voor documentverwerking
Jina AI heeft jina-ocr-v1 uitgebracht, een visuele documentparser gebaseerd op een Mixture of Experts-architectuur. Het model zet verschillende typen documenten om naar Markdown-formaat en is ontworpen om efficiënt te werken op minder zware hardware.
Organisaties die grote hoeveelheden fysieke of digitaal gescande documenten verwerken, maken al langer gebruik van gespecialiseerde software om tekst en tabellen leesbaar te maken voor computersystemen. De nieuwe software van Jina AI richt zich specifiek op het extraheren van data uit uiteenlopende documenten zoals pdf-bestanden, facturen en grafieken, en zet deze om naar gestructureerde Markdown-tekst.
Efficiëntie en hardware
Het model maakt gebruik van een specifieke technologische opzet waarbij niet alle onderdelen van het netwerk tegelijkertijd actief zijn bij het verwerken van tokens. Dit zorgt ervoor dat de software ook op minder krachtige grafische kaarten kan draaien. Daarnaast is er technologie toegevoegd om het genereren van tekst te versnellen zonder dat dit ten koste gaat van de nauwkeurigheid van de output.
Software voor optische tekenherkenning en documentbegrip is een fundamenteel onderdeel binnen de kunstmatige intelligentie, met name voor toepassingen waarin ongestructureerde documenten omgezet moeten worden naar doorzoekbare data. Modellen die efficiënter omgaan met rekencapaciteit maken het voor meer organisaties mogelijk om dergelijke technologie lokaal of op beperkte hardware in te zetten.
Deze samenvatting is gebaseerd op een origineel artikel van MarkTechPost. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel