De Kirkpatrick Evaluatiecoach skill voor Claude
Je geeft je trainingsdoel en de gedragsverandering die je wilt zien, en je krijgt een meetplan terug over alle vier de niveaus van Kirkpatrick: een tevredenheidssurvey, criteria voor een voor- en natoets, een observatieschema voor dag 30, 60 en 90 met gedragsindicatoren voor leidinggevenden, en de koppeling naar drie tot vijf bestaande bedrijfs-KPI's. Elk cijfer komt van jou of staat als [INVULLEN] in het plan, met een voorstel hoe je eraan komt. Streefscores en ROI-percentages verzint de skill niet.
de regels hierboven komen uit de zip op deze pagina · SKILL.md is 9.828 bytes
Trainingsdoel in, meetplan uit
reg. K.001Dit is het uitgewerkte voorbeeld dat in de SKILL.md zelf staat, hier ingekort weergegeven. Let op de bedragen en de streefwaarden. Ze staan er wel, maar nooit als bewering van de skill: de streefscore stelt de opdrachtgever vast, de minimale verbetering wordt bevestigd, en waar geen nulmeting is staat gewoon [INVULLEN].
Wat de Kirkpatrick Evaluatiecoach is
De Kirkpatrick Evaluatiecoach is een gratis skill uit onze eigen skill-bibliotheek voor Claude. Een skill is een instructiebestand, SKILL.md, dat een AI-assistent een vaste werkwijze meegeeft voor één taak. Geen software die je installeert, geen abonnement, geen koppeling met je LMS: één tekstbestand van 1.390 woorden dat Claude vertelt hoe de vier niveaus van Kirkpatrick werken, wat hij van jou moet uitvragen, in welke volgorde het meetplan wordt opgebouwd en welke cijfers hij onder geen beding zelf mag verzinnen. Je downloadt de zip bovenaan deze pagina, zet hem in je AI-omgeving, en vanaf dat moment bouwt Claude meetplannen volgens deze logica.
Het probleem dat de skill oplost staat in het bestand zelf benoemd en is herkenbaar voor iedereen die weleens een training heeft georganiseerd. Een tevredenheidssurvey vertelt je hoe mensen zich voelden. Niveau 3 en 4 vertellen je of er iets veranderd is. De meeste evaluaties blijven hangen op niveau 1, en dan blijft het bij enthousiaste deelnemers en een directie die vraagt wat het opleverde. Deze skill trekt het meetplan door tot en met de cijfers waar die directie naar kijkt, zonder te doen alsof daarmee bewezen is dat de training de oorzaak was.
Hij is geschreven voor trainingen, onboarding, compliance-trajecten en AI-adoptieprogramma's. Voorkennis van Kirkpatrick is niet nodig: de niveaus, de ontwerplogica en de valkuilen zitten in het bestand. Hij is onderdeel van de skill-bibliotheek die we vanuit de dienst AI en automatisatie gratis beschikbaar stellen, zonder account en zonder verkoopmail achteraf. Ben je nieuw met skills, dan legt wat zijn Claude skills eerst uit wat je precies downloadt.
Eén ding moet je vooraf weten, en het bestand is daar streng in: dit is een meetraamwerk, geen didactisch ontwerp en geen wetenschappelijk effectonderzoek. Het meetplan maakt effect aannemelijk en bespreekbaar. Zonder controlegroep toont het samenhang en geen oorzaak, en die zin hoort volgens de skill ook gewoon in je rapportage terecht te komen.
Waarom evaluaties blijven steken op niveau 1
Bijna iedere training eindigt met een formulier. Was het nuttig, was de trainer goed, hoe waren de faciliteiten. Dat formulier is makkelijk uit te zetten, komt bijna altijd terug met een aardig cijfer, en zegt precies niets over wat er maandag op de werkvloer gebeurt. Vier oorzaken houden dat patroon in stand, en de skill pakt ze alle vier aan.
De meting wordt pas na afloop bedacht. Dan is de training al ontworpen, zijn de deelnemers al gekozen en is het moment voor een nulmeting voorbij. Het New World Kirkpatrick Model draait dat om: je begint bij niveau 4, het gewenste bedrijfsresultaat, en werkt terug naar wat mensen daarvoor moeten doen, weten en ervaren. Die volgorde volgt hij letterlijk: eerst de vraag welk resultaat de training moet raken, en pas daarna bouwt hij niveau 1.
Er is geen benoembaar gedrag. Zonder een concrete beschrijving van wat mensen na de training anders doen, is er niets te observeren. Dat is de reden dat de skill die vraag als eerste stelt, en waarom hij zonder antwoord niet verder gaat. In het bestand staat het onomwonden: zonder benoembaar gedrag geen meetplan.
Indicatoren zijn geen gedrag maar gevoel. Toont betrokkenheid is geen indicator, want twee leidinggevenden zien daar iets anders in. Deelt wekelijks een werkwijze met het team wel, want dat gebeurde of het gebeurde niet. Observatieschema's zonder observeerbaar gedrag weigert hij te leveren, en juist dat verschil is waar de meeste gedragsmetingen op stuklopen.
En niveau 4 wordt of overgeslagen of overdreven. Overslaan omdat het lastig is, of juist een KPI-stijging volledig aan de training toeschrijven. Geen van beide gebeurt hier, en dat is een bewuste keuze. Hij koppelt drie tot vijf bestaande KPI's met databron en meetfrequentie, en benoemt in dezelfde adem welke andere factoren dezelfde KPI beïnvloeden.
In diff-vorm, met indicatoren uit het voorbeeld van de skill. Links wat er meestal in een observatieformulier staat, rechts wat je daadwerkelijk kunt afvinken.
Ontworpen van boven naar beneden
reg. K.002De vier niveaus zoals ze in de SKILL.md staan, maar in de volgorde waarin de skill ze ontwerpt. Meten doe je van beneden naar boven, van reactie naar resultaat. Ontwerpen doe je andersom: je begint bij het bedrijfsresultaat en werkt terug. De gemarkeerde rij bovenaan is dus het startpunt van de skill, niet het eindstation.
Wat er werkelijk in de SKILL.md staat
Een skill is zo goed als zijn instructies, dus die beschrijven we hier gewoon. Het bestand opent met frontmatter waarin staat wanneer Claude de skill moet oppakken. Niet alleen bij de voor de hand liggende vragen als kirkpatrick, training evalueren, meetplan voor een training of opleidingsbudget verantwoorden, maar ook bij verzuchtingen: ik weet niet of mijn training iets oplevert, we sturen alleen een tevredenheidsformulier, iedereen was enthousiast maar niemand doet iets anders, na de training zakt alles weer in, mijn evaluaties zeggen alleen iets over de broodjes. Wie zoiets tegen Claude zegt terwijl de skill geladen is, krijgt hem automatisch.
Daarna volgt de theorie waarop de skill rust, in het bestand zelf uitgeschreven. Donald Kirkpatrick beschreef zijn vier evaluatieniveaus in 1959 in een serie artikelen in het Journal of the American Society of Training Directors, voortkomend uit zijn proefschrift. In 1994 bundelde hij het model in Evaluating Training Programs: The Four Levels. Zijn zoon James en schoondochter Wendy actualiseerden het in 2016 als het New World Kirkpatrick Model, met meer nadruk op het vooraf ontwerpen van de meting en op de ondersteuning na de training.
De kern van het bestand is een lijst van acht vaste handelingen. Eerst vraagt hij gericht uit: het trainingsdoel, de doelgroep en de groepsgrootte, duur en vorm, en vooral de gewenste gedragsverandering op de werkvloer. Hij werkt terug vanaf niveau 4 en zoekt drie tot vijf bestaande KPI's. Hij bouwt niveau 1 als korte survey over relevantie, toepasbaarheid en betrokkenheid, met een streefscore die jij vaststelt. Niveau 2 wordt een set toetscriteria voor een voor- en natoets die aansluiten op het gewenste gedrag.
Hij bouwt niveau 3 als observatieschema voor dag 30, 60 en 90, met drie tot vijf observeerbare indicatoren per meetmoment en een invulformat. Niveau 4 wordt de koppeling tussen die indicatoren en de KPI's, met meetfrequentie, databron en de kanttekening welke andere factoren meebewegen. Hij benoemt de benodigde middelen eerlijk: een surveytool, een spreadsheet en een observatieformulier volstaan. En hij levert een tijdlijn van dag 0 tot dag 90, met per moment de eigenaar van de meting.
Voordat er iets gebouwd wordt, loopt de skill een verplichte inputchecklist na: het trainingsdoel in één zin en de gewenste gedragsverandering, doelgroep en aantal deelnemers plus of hun leidinggevenden willen meewerken aan observatie, duur en vorm, de bestaande bedrijfs-KPI's met huidige waarden als je die hebt, de beschikbare tools, en de termijn waarop de organisatie resultaat wil zien plus wie het meetplan moet goedkeuren. Hij vraagt alleen na wat ontbreekt.
De uitvoer staat in een vaste volgorde van zes onderdelen: doel en gedragsverandering met de aannames die je moet bevestigen, dan de vier niveaus elk met hun meetmoment en eigenaar, en tot slot de tijdlijn met alle meetmomenten op een rij. Wil je zelf zulke bestanden leren schrijven, dan legt SKILL.md schrijven de opbouw uit.
Dag 0 tot dag 90
reg. K.003Het zesde blok van de uitvoer is een tijdlijn van alle meetmomenten met per moment de eigenaar. Dat blok is de reden dat een meetplan blijft leven: zonder naam bij een datum gebeurt de meting op dag 60 niet. De tijdlijn uit het voorbeeld van de skill, met de rol die het meetmoment volgens datzelfde voorbeeld uitvoert.
De theorie waarop de skill rust
De SKILL.md noemt vijf bronnen bij naam, en dat is bewust: dan kun je ze nalezen en zelf beslissen of je het met de keuzes eens bent. Opvallend is dat er een kritische bron tussen zit. Dat is geen slordigheid, dat is de reden dat de skill zo voorzichtig formuleert.
Het model komt van Donald Kirkpatrick. Hij beschreef de vier niveaus in 1959 in een serie artikelen in het Journal of the American Society of Training Directors, voortkomend uit zijn proefschrift, en bundelde het in 1994 in Evaluating Training Programs: The Four Levels. Dat is nog steeds het skelet van elk meetplan dat de skill oplevert.
De ontwerplogica komt van James en Wendy Kirkpatrick. Hun New World Kirkpatrick Model uit 2016 legt de nadruk op twee dingen die in de oorspronkelijke versie onderbelicht bleven: de meting vooraf ontwerpen in plaats van achteraf bedenken, en de ondersteuning na de training. Daar komt de omgekeerde volgorde uit FIG.02 vandaan.
Het vijfde niveau komt van Jack Phillips. Return on Investment in Training and Performance Improvement Programs uit 1997 voegde ROI toe boven niveau 4, met de bijbehorende kanttekeningen. Die bron noemt hij wel, maar hij rekent geen ROI uit en verzint geen enkel percentage. Wie de bedragen achter zo'n berekening wil bepalen, is beter af bij de Prijsstrategie Coach skill, die precies dat waardevraagstuk behandelt.
De kritiek komt van Alliger en Janak. Hun artikel Kirkpatrick's Levels of Training Criteria: Thirty Years Later uit 1989 in Personnel Psychology gaat over de aangenomen causaliteit tussen de niveaus: het idee dat tevreden deelnemers ook leren, en dat wie leert het ook toepast, blijkt niet vanzelfsprekend. Die bron staat in het bestand en verklaart waarom de skill niveau 1 nooit als voorspeller van niveau 2 presenteert.
Ook zonder de skill te installeren kun je met deze principes je eigen evaluatie verbeteren: begin bij het resultaat dat je wilt zien, schrijf gedrag op dat je kunt afvinken, spreek een eigenaar per meetmoment af, en zet in je rapportage wat er nog meer op die KPI drukte.
Wat de skill weigert
reg. K.004De SKILL.md bevat een lijst van zeven dingen die de skill nooit doet, en bij evaluatie is die lijst het halve product. Een meetplan met verzonnen streefcijfers ziet er professioneel uit en is waardeloos. In het gesprek pakken die regels zo uit: elke regel is een verzoek dat je zou kunnen doen, met de reactie die de skill volgens zijn eigen instructies geeft.
Installeren in Claude Code, Claude.ai of Codex
De zip bevat één map, ai-kirkpatrick-evaluatiecoach, met daarin de SKILL.md. Installeren is een kwestie van dat bestand op de juiste plek zetten, en die plek verschilt per omgeving. SKILL.md is sinds december 2025 een open standaard, en dezelfde skill werkt daardoor ook in Codex, Cursor en Gemini CLI. Je downloadt dus geen Claude-bestand maar een werkinstructie die elke moderne AI-assistent kan lezen.
- Pak de zip uit in
~/.claude/skills/(of.claude/skills/in je project). - Claude herkent de skill daarna vanzelf zodra je over training evalueren, meetplannen of Kirkpatrick begint.
- Direct aanroepen kan ook, met
/ai-kirkpatrick-evaluatiecoach.
- Ga naar Customize en dan Skills.
- Upload de zip daar als skill.
- Of plak de inhoud van SKILL.md in de projectinstructies van een Project.
- Open
AGENTS.mdin je repo. - Plak de inhoud van SKILL.md erin, of zet SKILL.md er als los bestand naast en verwijs ernaar vanuit
AGENTS.md. - Codex leest dat bij elke sessie mee.
Daarna is het gebruik simpel: beschrijf je trainingsdoel en vooral wat mensen na afloop anders moeten doen. Loop je vast op het uitpakken of het vinden van de juiste map, dan staat dat stap voor stap in Claude skills installeren. En wil je eerst de bredere uitleg over werken met AI, dan vind je die in de kennisbank.
Wanneer je hem wel en niet gebruikt
Op zijn sterkst is hij bij trajecten waar iemand later gaat vragen wat het opleverde: een AI-adoptieprogramma, een onboardingtraject, een compliance-traject, een trainingsreeks met een budget eromheen. Hoe eerder je hem inzet, hoe meer je eraan hebt, want de nulmeting op dag 0 is het enige meetmoment dat je niet kunt inhalen. Hij is ook nuttig als je alleen wilt scherpstellen wat je eigenlijk wilt zien veranderen: die eerste vraag over gedrag levert vaak al een ander gesprek op met de opdrachtgever.
Er zijn ook situaties waarin je hem beter laat liggen, en het bestand noemt ze zelf. Het ontwerpen van de training is er een van: dit is een meetraamwerk, geen didactisch ontwerp. Wat er in de training gebeurt en hoe je de stof opbouwt is werk voor een ander soort hulp, bijvoorbeeld de Bloom Taxonomie Coach skill, die leerdoelen en toetsvragen per denkniveau schrijft. Statistisch bewijs is de tweede grens: het meetplan maakt effect aannemelijk en bespreekbaar, het is geen wetenschappelijk effectonderzoek met controlegroep. En de derde is beoordeling van mensen: de observatiescores zijn er om de training te evalueren, niet om een dossier mee te vullen.
Nog een eerlijke grens die de skill zelf benoemt: bij kleine groepen en korte termijnen is niveau 4 vaak niet hard te maken. Dat betekent niet dat je het overslaat, maar dat de rapportage eerlijk vertelt wat je wel en niet kunt zien. Werk je toe naar een besluit over doorgaan of stoppen, dan is dat onderscheid belangrijker dan het cijfer zelf.
Zelf draaien of laten draaien
reg. K.005Deze skill is de gratis doe-het-zelf-versie van werk dat we ook als dienst leveren. De skill blijft compleet en zonder addertjes, maar besef wat een skill is: hij leert je AI hoe hij iets doet, terwijl elke nieuwe sessie leeg begint. De skill is niet de motor en niet het geheugen. Jij prompt, jij levert elke keer opnieuw de context, jij controleert. Bij een meetplan dat over negentig dagen loopt is dat een reëel bezwaar, want de meting op dag 60 komt niet vanzelf terug in je scherm.
waar je nu bent De skill: jij bent de motor Je draait de Kirkpatrick Evaluatiecoach zelf in Claude, Codex of Cursor. Kost niets, werkt vandaag, en je houdt het volledig in eigen hand: geen proefperiode, geen afgeschermde onderdelen. De grens is je eigen tijd: het gebeurt alleen wanneer jij prompt, en je legt je KPI's en je organisatie elke sessie opnieuw uit.
laten voorbereiden De Rapportagemedewerker: het staat klaar zonder dat jij prompt Precies dit werk, maar dan als dienst: de Rapportagemedewerker bereidt week- en maandrapportages voor zonder dat jij ervoor achter Claude hoeft te kruipen, en dat is exact wat een meetplan op dag 30, 60 en 90 nodig heeft. De controle blijft bij jou, want output blijft concept tot een mens akkoord geeft. Dit leveren we via Mansotti, de onderneming waarvan TheSEO de handelsnaam is, die naast de Rapportagemedewerker ook een Offertemedewerker en een Salesmedewerker (prospect-research) bouwt. Lees wat een AI-medewerker is en doet.
alles uit een bron Jarvis: al je AI's werken vanuit dezelfde bedrijfskennis De skill leert de AI, het brein is waar het geheugen leeft. Wil je dat al je AI's vanuit dezelfde bedrijfskennis werken: dat is Jarvis, het organisatiebrein. Het verbindt ChatGPT, Claude, Codex en je mensen met dezelfde projecten, kernkennis en beslissingen, zodat je volgende sessie niet opnieuw begint. Jarvis selecteert context, delegeert werk en bewaart alleen wat is goedgekeurd: klantkennis blijft geïsoleerd en elke stap laat een controleerbaar spoor na. Ook deze skill wordt daar beter van, want je KPI-definities, je nulmetingen en de afspraak wie wat meet hoef je dan niet meer per sessie aan te leveren. Wat dat concreet oplevert, van de plannen tot je eerste week, lees je bij Jarvis zelf.
Wat Jarvis concreet oplevert
reg. K.006Trede 3 verdient meer dan een alinea, want dit is het verschil tussen een slimme chat en een systeem waar je op kunt bouwen. Jarvis is het organisatiebrein: het onthoudt wat je AI's moeten weten, verdeelt het werk en houdt bij wat er gebeurde. Bij een meetplan van negentig dagen is dat geen luxe maar de kern, want een meting die niemand terughaalt is geen meting.
Wij draaien zelf al maanden op dit systeem. Elke agent-sessie, elke taak en elke beslissing wordt erin gelogd en is terug te lezen. Een nieuwe sessie begint daardoor niet blanco: hij haalt eerst de vastgelegde besluiten, de lopende projecten en de laatste wijzigingen op, en werkt verder waar de vorige stopte. We beschrijven dus geen belofte maar de werkwijze waar we zelf dagelijks in werken.
Bekijk de vier plannen op jarvis/prijzen. Via de wachtlijst geef je alleen vrijblijvend je voorkeursplan door. Dat maakt nog geen account, bestelling of betalingsplicht. Zakelijk maatwerk bespreken we eerst.
De skills eromheen
reg. K.007Een meetplan staat nooit op zichzelf: er gaat een training aan vooraf en er komt een rapportage achteraan. Deze skills uit dezelfde bibliotheek pakken elk een ander stuk van die keten.
Voor de training
het ontwerpHet meetplan meet wat de training beoogt. Deze twee gaan over dat eerste stuk.
Bloom Taxonomie CoachSchrijft leerdoelen en toetsvragen per denkniveau, precies wat niveau 2 nodig heeft.SKILL Feynman Techniek CoachLaat stof net zolang vereenvoudigen tot de gaten in het begrip zichtbaar worden.SKILLRond de meting
de cijfersNiveau 4 leunt op KPI's die al bestaan. Deze twee gaan over die cijfers zelf.
Balanced Scorecard CoachOrdent je bedrijfs-KPI's over vier perspectieven, zodat je weet welke je koppelt.SKILL OKR CoachZet doelen om in meetbare key results, met dezelfde eis: geen cijfer zonder bron.SKILLNa de training
het gedragNiveau 3 gaat over wat mensen blijven doen. Deze twee gaan over dat volhouden.
Growth Mindset CoachVoor de deelnemer die na twee weken terugvalt op de oude werkwijze.SKILL Deliberate Practice CoachZet doelgerichte oefening op met feedback, zodat gedrag niet inzakt na dag 30.SKILLVerder kijken
de contextWaar deze skill vandaan komt en wat er nog meer is.
De hele skill-bibliotheek100 gratis skills op een rij, per onderwerp gesorteerd.HUB AI en automatisatieDe dienst erachter: van losse skills naar werkende automatisering.SRV AI-trainingenDe training waar dit meetplan omheen past, als je team met AI aan de slag gaat.SRV KennisbankArtikelen over SEO, AI en online zichtbaarheid, doorzoekbaar.DOCVeelgestelde vragen
Wat kost de Kirkpatrick Evaluatiecoach skill?
Niets. De skill is gratis, valt onder de MIT-licentie en je hoeft geen account aan te maken en geen e-mailadres achter te laten. Je downloadt een zip van 4,1 KB met daarin een map en een enkel bestand, SKILL.md, en dat is de complete skill. Er is geen betaalde versie en er komt geen verkoopmail achteraan.
Werkt deze skill ook in Codex, Cursor of Gemini CLI?
Ja. SKILL.md is sinds december 2025 een open standaard, en hetzelfde bestand werkt daardoor ook in Codex, Cursor, Gemini CLI en andere tools die de standaard volgen. In Codex pak je de zip uit in .agents/skills/ in je project, of in ~/.agents/skills/ voor al je projecten; Codex ondersteunt SKILL.md sinds de open standaard van december 2025 rechtstreeks. De inhoud van SKILL.md in je AGENTS.md zetten kan ook nog steeds. De instructies zijn gewoon leesbare tekst, dus een assistent die instructiebestanden accepteert kan ermee overweg.
Rekent de skill de ROI van mijn training uit?
Nee. ROI-percentages verzinnen staat bij de dingen die de skill nooit doet. Het vijfde niveau ROI komt uit het werk van Jack Phillips uit 1997 en staat in de bronnenlijst, met de kanttekeningen erbij. Wat de skill wel doet is niveau 4 opbouwen: drie tot vijf bestaande bedrijfs-KPI's koppelen aan de gedragsindicatoren, met databron, meetfrequentie en de externe factoren die dezelfde KPI beïnvloeden.
Verzint de skill streefscores en nulmetingen als ik die niet heb?
Nee. Elk cijfer komt van jou of wordt [INVULLEN] met een voorstel hoe je eraan komt. In het uitgewerkte voorbeeld staat een streefscore van 4,0 op 5 uitdrukkelijk als iets dat de opdrachtgever vaststelt, en een minimale verbetering van 25 procent als iets dat de opdrachtgever bevestigt. Ontbreekt een nulmeting, dan staat er [INVULLEN: nulmeting nodig].
Bewijst een meetplan dat mijn training werkt?
Nee, en dat zegt de skill er zelf bij. Zonder controlegroep toont niveau 4 samenhang en geen oorzakelijk verband, en die zin hoort ook in de rapportage terecht te komen. Het model heeft meer grenzen: de niveaus zijn geen bewezen causale keten, tevredenheid voorspelt leerresultaat slecht, en bij kleine groepen en korte termijnen is niveau 4 vaak niet hard te maken.
Kan ik alleen niveau 1 en 2 meten?
Ja, dat kan, maar niet stilzwijgend. De skill slaat niveau 3 en 4 niet over omdat ze lastig zijn. Kies je bewust voor alleen reactie en leren, dan benoemt hij wat er dan onbeantwoord blijft: of mensen het geleerde ook echt toepassen, en of er iets verandert in de cijfers waar de directie naar kijkt.
Welke tools heb ik nodig om het meetplan uit te voeren?
Volgens het bestand volstaan een surveytool, een spreadsheet en een observatieformulier. Zware meetsystemen zijn niet nodig, en dat benoemt de skill expliciet als onderdeel van het plan. In de inputchecklist vraagt hij wel welke tools je al hebt, zodat het meetplan aansluit op wat er staat in plaats van op wat je zou moeten aanschaffen.
Eerst het gedrag, dan de cijfers
De zwaarste vraag in dit hele raamwerk is de eerste: wat doen mensen na de training aantoonbaar anders. Wie daar een helder antwoord op heeft, heeft het meetplan half af en meestal ook een betere training. Wil je dat je team met AI aan de slag gaat en wil je meteen kunnen laten zien wat dat verandert, dan is dat precies de combinatie die we leveren in de AI-trainingen. En wil je doorpraten over wat AI verder in je organisatie kan overnemen, van losse skills tot volledige automatisering, dan doen we dat gewoon in een gesprek.