Spraakherkenning (speech-to-text), wat is het?

← AI-begrippenlijst

Spraakherkenning (speech-to-text), Spraakherkenning zet gesproken audio om naar geschreven tekst, een technologie die inmiddels breed is ingezet in assistenten en transcriptiesoftware.

Moderne spraakherkenning gebruikt diepe neurale netwerken die getraind zijn op duizenden uren gesproken taal. Systemen als Whisper van OpenAI kunnen meerdere talen herkennen en omgaan met accenten en achtergrondgeluid. Spraakherkenning is een bouwsteen in spraakassistenten, vergadertranscriptie en toegankelijkheidstoepassingen. De nauwkeurigheid is inmiddels op veel taken gelijkwaardig aan menselijke transcriptie.

Dit begrip komt uitgebreid aan bod in de module Spraak: hoe AI luistert en praat.

Onderdeel van cursus 8, AI om je heen, studieduur ±2 uur. Module 1 van AILogica is gratis, zonder account.

Begin gratis met module 1 Bekijk de cursussen