Guardrails, wat is het?
Guardrails, Guardrails zijn technische of beleidmatige begrenzingen die voorkomen dat een AI-model schadelijke, onjuiste of ongewenste uitvoer produceert.
Guardrails kunnen op meerdere niveaus werken: in de systeemprompt als instructies, als filterlaag na de modeloutput of als aparte classificatiemodellen die uitvoer beoordelen. Ze zijn het antwoord op de realiteit dat een puur taalmodel alles kan zeggen dat taalkundig aannemelijk is. Guardrails zijn nooit perfect: ze kunnen zowel te restrictief zijn (nuttige inhoud blokkeren) als te permissief (schadelijke inhoud doorlaten).
Dit begrip komt uitgebreid aan bod in de module AI veilig en verantwoord gebruiken.
Onderdeel van cursus 6, AI gebruiken, studieduur ±1,5 uur. Module 1 van AILogica is gratis, zonder account.
Begin gratis met module 1 Bekijk de cursussen