Filters voor het gebruik van AI
Bedrijven, overheden en kennisinstellingen maken steeds vaker gebruik van taalmodellen. Om de AI-technologie verantwoord in te zetten, maken ze daarbij gebruik van zogeheten vangrails. Die bepalen wat gebruikers met het taalmodel kunnen doen en welke kennis gedeeld. Zogenaamde ‘content filters’ voorkomen bijvoorbeeld dat chatbots ingaan op suggestieve vragen van gebruikers, en filteren onnodig gedeelde persoonsgegevens uit. Andere filters herkennen situaties waar AI geen kennis over heeft en waarschuwen de gebruiker daarover.
Situaties waarin filters minder goed werken voor Nederlandse taal en cultuur
Om de transitie naar digitale autonomie aan te jagen ontwikkelt dit project vangrails gericht op de Nederlandse taal en cultuur. Daarbij wordt rekening gehouden met situaties waarin vangrails minder goed werken binnen ons taalgebied. Welk type persoonsgegevens – zoals namen met ë of ü – worden bijvoorbeeld niet correct geanonimiseerd? En welke gevaarlijke gevallen beschreven in de Nederlandse taal – zoals gewelddadige situaties, dierenmishandeling, seksuele intimidatie – worden niet herkend?
Eigen generatieve AI-toepassingen mee evalueren
De vangrails die het consortium vervolgens ontwikkelt, zijn kosteloos beschikbaar voor publieke en private organisaties. Ze kunnen er hun eigen generatieve AI-toepassingen mee evalueren. Gebruikers kunnen een open source referentie-dataset zelf aanpassen afhankelijk van de relevante context. Ze kunnen de vangrails bovendien gemakkelijk binnen verschillende tech stacks – zowel cloud of on-premise - gebruiken.