
Masterclass 'Testen van General Purpose AI (GPAI) toepassingen'
Beschrijving
Naarmate GPAI-modellen steeds beter worden, wordt er steeds vaker beweerd dat systemen de prestaties van experts evenaren of overtreffen op het gebied van ‘probleemoplossing’, ‘wetenschappelijk redeneren’ of ‘softwareontwikkeling in de praktijk’. Deze beweringen zijn gebaseerd op gangbare tests voor verschillende vaardigheden, ook wel ‘benchmarks’ genoemd.
Toch bestaat er vaak een misvatting over wat benchmarks nu eigenlijk meten, welke conclusies we daadwerkelijk over een systeem kunnen trekken en hoe we kunnen beoordelen wat er voor een specifieke toepassing echt toe doet. Net als in andere technologiegedreven sectoren, zoals de gezondheidszorg en de luchtvaart, heeft AI-benchmarking betrouwbare standaarden nodig. Omdat best practices nog in de kinderschoenen staan, kan het voor professionals best lastig zijn om hun weg te vinden in GPAI-evaluaties.
In deze masterclass distilleren we de meest waardevolle inzichten uit het gebied van GPAI-benchmarking en maken we die toegankelijk. De cursus behandelt:
- GPAI volgens de AI-wet en benchmarking voor systemen met systeemrisico’s
- Toonaangevende benchmarks uit de sector en toepassing op GPT-NL
- Inzichten uit het eigen benchmarkwerk van Algorithm Audit
- Actuele kwesties in het vakgebied vanuit een wetenschappelijk perspectief
- De ontwerpaspecten die de kwaliteit van een benchmark bepalen
Na het volgen van de training kun je:
- De relevante verplichtingen voor GPAI-systemen onder de AI-wet begrijpen
- Begrijpen hoe benchmarks ‘achter de schermen’ werken
- Je weg vinden in gangbare evaluatiedatabases en documentatie
- Beoordelen of bestaande benchmarks geschikt zijn voor je eigen werk
- Bepalen wanneer een aangepaste aanpak nodig is en hoe die eruit zou kunnen zien
Datum
3 november 2026
Adres
The Hague Conference Centre (New Babylon), Anna van Buerenplein 29, 2595 DA Den Haag
Programma
- 09:30-10:00 Inloop
- 10:00-11:15 Introductie General Purpose AI (GPAI) en het testen van GPAI-toepassingen
- 11:15-11:30 Pauze – koffie, thee en versnaperingen
- 11:30-12:30 State-of-the-art concepten en ontwikkelingen in GPAI-benchmarking
- 12:30-13:30 Lunch – verzorgd
- 13:30-14:45 Casus uit de Nederlandse publieke sector
- 14:45-15:15 Pauze – koffie, thee en versnaperingen
- 15:15-16:30 Praktijkoefeningen om hands-on ervaring op te doen
- 16:30-17:30 Borrel – verzorgd
Kosten
- €300 fysieke deelname (incl. lunch en catering, koffie, thee etc.)
Doelgroep
Professionals uit de private en publieke sector die regelmatig werken met GPAI-toepassingen, zoals het implementeren van generatieve AI-oplossingen in werkprocessen, het testen van GPAI-capaciteiten en/of het werken aan AI-beleid.