Google introduceert spraakmodel Gemini 3.5 Transcribe
Google heeft een nieuw spraak-naar-tekst-model uitgebracht genaamd Gemini 3.5 Transcribe. Het model is opgesplitst in twee versies, waarbij de ene zich richt op snelheid en de andere op extra functies zoals sprekerherkenning.
Google heeft een nieuw spraakherkenningsmodel gepresenteerd onder de naam Gemini 3.5 Transcribe. Dit model is opgedeeld in twee afzonderlijke varianten om verschillende toepassingen te ondersteunen. De streamingvariant levert direct resultaat op, terwijl de batchvariant extra opties biedt zoals het herkennen van verschillende sprekers.
Spraak-naar-tekst-technologie is een belangrijk onderdeel binnen de markt voor kunstmatige intelligentie, met name voor de ontwikkeling van virtuele assistenten en geautomatiseerde klantenservice. Aanbieders proberen elkaar continu te overtreffen op het gebied van nauwkeurigheid en verwerkingssnelheid om zo aantrekkelijk te blijven voor softwareontwikkelaars.
Deze samenvatting is gebaseerd op een origineel artikel van MarkTechPost. Lees het volledige, originele bericht bij de bron.
Lees het originele artikelAchtergrond bij dit bericht
- Gemini (Google): wat kun je ermee?Google's AI, diep verweven met Search, Workspace en Android.
- AI die vergaderingen uitwerkt: wat werkt en wat nietAutomatisch notuleren is een van de weinige AI-toepassingen die direct tijd oplevert. Wat het goed doet, waar het misgaat, en waar je op moet letten voordat je het aanzet.