Afgelopen woensdag debatteerde de onderwijscommissie van de Tweede Kamer over toetsen en examens. Het ging, zoals bijna altijd, vooral over de doorstroomtoets en het moment van selecteren. Onder de stapel stukken op de agenda lag een bijlage die veel minder aandacht kreeg en veel directer over jouw werk gaat: een onderzoek van Cito naar de kwaliteit van schoolexamens, meegestuurd met een Kamerbrief van staatssecretaris Tielen van 2 juli.
In juni schreven we in een stuk over de examenuitslag dat de helft van het eindcijfer, het schoolexamen, nergens wordt gecontroleerd. Dat was een redenering. Nu is er voor het eerst in jaren iemand gaan kijken. Dit is wat ze vonden.
Wat Cito precies deed
Het onderzoek kwam er op advies van de Onderwijsinspectie, die in 2023 de schoolexaminering als proces onderzocht en het ministerie aanraadde om ook naar de toetsen zelf te laten kijken. CitoLab, het onderzoeksteam van Stichting Cito, deed dat op drie manieren. Vakinhoudelijke en toetstechnische deskundigen beoordeelden 78 ingezonden schoolexamens langs een vast kader. Docenten en leden van examencommissies vulden vragenlijsten in over hoe zij hun toetsen maken, nakijken en normeren. En Cito sprak met vakverenigingen.
Eén kanttekening hoort vooraan, niet achteraan. Deelname was vrijwillig. De 78 examens komen uit 18 pakketten van vijftien scholen, het vwo is oververtegenwoordigd en niemand weet hoe de toetsen eruitzien van scholen die níet durfden in te zenden. Cito noemt de resultaten daarom beschrijvend en verkennend; de staatssecretaris schrijft dat het onderzoek geen landelijk representatief beeld geeft. Lees de cijfers hieronder dus als: dit zien we bij scholen die het aandurfden hun schoolexamens te laten beoordelen. Cito voegt daar zelf aan toe dat de uitkomsten niet wezenlijk afwijken van eerder, groter onderzoek naar het schoolexamen.
Wat goed ging
Dit is geen rapport dat het schoolexamen afbrandt, en het zou oneerlijk zijn het zo te brengen. De basisopzet van de toetsen is overwegend goed. Vorm en opzet passen in de meeste gevallen bij leerjaar, niveau en doel, de moeilijkheid wordt als passend beoordeeld, de lay-out is leesbaar, het taalgebruik is afgestemd op de leerling en de puntentelling per vraag is meestal inzichtelijk. Praktische opdrachten zijn realistisch en relevant. Docenten zijn tevreden over de deskundigheid van hun sectie en maken hun toets meestal samen met een collega, of laten er een collega naar kijken.
Kortom: de vraag op papier is in orde. Het probleem zit in wat er ná de toets gebeurt.
Waar het wringt: het nakijken
De paragraaf over beoordeling en normering is de scherpste van het rapport, en hij gaat precies over het deel van het werk dat je alleen doet, 's avonds, zonder dat iemand meekijkt.
Beoordelingsmodellen missen regelmatig details: voorbeeldantwoorden ontbreken, net als richtlijnen voor wat je doet met een antwoord dat half goed is of een andere route neemt dan het model. De logica van puntentoekenning en weging is niet altijd consequent of verdedigbaar. Veel docenten hanteren een vaste cesuur, maar er zijn weinig vaste afspraken op schoolniveau over hoe een score een cijfer wordt. En tweede correctoren worden bij schriftelijke toetsopgaven vrijwel niet ingezet. Cito trekt de conclusie zelf: dit zet de vergelijkbaarheid en betrouwbaarheid van beoordelingen onder druk.
Dat is, in nette onderzoekstaal, wat we eerder de onzichtbare ruis in nakijken noemden. Als het model geen voorbeeldantwoord heeft, bepaalt jouw stemming om 22:30 wat een half punt waard is. Als de regel voor een deels goed antwoord ontbreekt, krijgt de leerling bovenop de stapel een ander cijfer dan de leerling onderop. Niet omdat je slordig bent, maar omdat er niets is om consequent aan vast te houden. En omdat er geen tweede corrector is, ziet niemand het.
Cito vond nog iets dat hierbij hoort. Toetsmatrijzen, die vastleggen welke vraag welk leerdoel meet en hoe zwaar hij weegt, werden zelden aangeleverd of aantoonbaar gebruikt. Geen enkele school stuurde een toetstechnische visie mee, en slechts 39 procent van de pakketten bevatte een PTA. Van de examencommissieleden die de vragenlijst invulden, zei 14 procent het PTA niet te kennen en 11,8 procent de visie op toetsing niet. De documenten die het nakijken zouden moeten sturen, bestaan op veel plekken niet of leven niet.
De oude examenvraag als sluiproute
Het rapport verklaart ook waarom het zo loopt. Veel schoolexamens leunen zwaar op oude vragen uit het centraal examen en op methodemateriaal. Van de ondervraagde docenten noemt 67 procent als reden dat je zo gemakkelijker of sneller een toets van hoge kwaliteit maakt. Iets minder dan een derde wil er het verschil tussen het SE-cijfer en het CE-cijfer mee klein houden.
Dat is een begrijpelijke keuze. Een CE-vraag is getest, genormeerd en heeft een correctievoorschrift. Maar Cito wijst op de prijs: het schoolexamen wordt dan een oefenexamen voor mei en verliest precies datgene waarvoor het bestaat, ruimte voor de eigen visie van de school en voor vaardigheden die het centraal examen niet toetst. In de meerderheid van de beoordeelde examens was zo'n eigen visie niet zichtbaar. De staatssecretaris herhaalt dat in haar brief: scholen gebruiken nog regelmatig oude CE-opgaven, waardoor het schoolexamen soms te veel de functie krijgt van voorbereiding op het centraal examen.
De onderliggende oorzaak noemt Cito zonder omhaal: tijdgebrek. Het staat in de aanbevelingen aan schoolleiders als de oorzaak van veel onvolledige toetsdocumentatie en inconsistenties, en het staat in de vragenlijsten als de reden waarom samenwerking meestal beperkt blijft tot een duo binnen de sectie.
Tijd, zegt ook de Kamerbrief zelf
Dezelfde brief bevat, een paar alinea's verderop, een tweede meting die in dit verhaal past. Op verzoek van de Kamer liet het ministerie via TeacherTapp aan leraren in het basis- en voortgezet onderwijs vragen of zij genoeg tijd hebben om schrijfopdrachten zorgvuldig na te kijken en van goede feedback te voorzien. Van de 552 leraren die antwoordden, zei een ruime meerderheid van niet. Ongeveer 70 procent gaf aan dat tijdgebrek er soms tot regelmatig toe leidt dat zij minder of kortere schrijfopdrachten geven dan ze eigenlijk zouden willen. De twee meest genoemde oplossingen: kleinere klassen en officieel ingeroosterde nakijktijd.
Lees die twee onderzoeken naast elkaar en er staat één verhaal. Docenten kiezen de oude examenvraag omdat een eigen vraag met een eigen model tijd kost. Ze slaan het voorbeeldantwoord over omdat het model schrijven tijd kost. Ze geven kortere opdrachten omdat nakijken tijd kost. De kwaliteit van het schoolexamen is geen deskundigheidsprobleem, wat de vragenlijsten ook bevestigen, maar een tijdprobleem dat zich als kwaliteitsprobleem vermomt.
De staatssecretaris kondigt in dezelfde brief aan dat Cito binnenkort een prototype oplevert van een AI-tool die docenten kan ondersteunen bij het nakijken van toetsvragen, met de aantekening dat de professionele ruimte van de docent bij constructie en correctie de kern blijft. Dat is een verstandige aantekening. Waar tijdwinst door AI in de praktijk op neerkomt, en waar die uren horen te landen, stond vorige week in het stuk over tijdsbesparing.
Wat je sectie deze week kan doen
Het mooie van de aanbevelingen die Cito aan docenten doet, is dat ze geen beleid, geld of wachten op Den Haag vereisen. Vier stuks, vrij vertaald.
Stel de cesuur vooraf vast en schrijf in één zin op waarom die daar ligt. Onduidelijke of ontbrekende cesuren maken toetsen onvergelijkbaar, en een grens die je achteraf nog kunt verschuiven, schuift ook. Hoe je van punten naar een cijfer komt en welke keuzes daarin zitten, staat op de pagina over cijfers berekenen.
Leg bij elke toets een beoordelingsmodel met voorbeeldantwoorden of kapstokpunten, en met een regel voor het deels goede en het afwijkende antwoord. Cito schrijft letterlijk dat dit de subjectiviteit vermindert en het nakijken consistenter maakt. Het is ook het enige onderdeel van de lijst dat je morgen bij je eerstvolgende toets al kunt toepassen.
Geef elke toets een standaard voorblad: tijdsduur, toegestane hulpmiddelen, hoe de totaalscore wordt berekend en waar de cesuur ligt. Dat kost een kwartier en lost het transparantieprobleem op dat Cito bij een deel van de examens zag.
En kalibreer. Wissel vóór de afname toetsen uit binnen de sectie, kijk na de afname een paar antwoorden samen na en werk waar het kan met een tweede, onafhankelijke beoordelaar. Bij open vragen en praktische opdrachten is dat volgens Cito de stap die de betrouwbaarheid het meest verhoogt. Waarom hetzelfde antwoord hetzelfde cijfer hoort te krijgen, en wat daarvoor nodig is, staat in het artikel over consistent beoordelen.
Wat wij eraan doen
Wie dit rapport leest, herkent de lijst waarvoor Corrigo is gebouwd. Nakijken met Corrigo begint met een expliciet correctiemodel: voordat er een antwoord wordt beoordeeld, staat vast wat een vraag waard is en waar de punten op worden gegeven. Elk antwoord wordt vervolgens langs datzelfde model gelegd, of het nu bovenop de stapel ligt of onderop, en bij elke vraag blijft een onderbouwing bewaard die een collega, een examencommissie of een leerling kan nalezen. Jij loopt de voorstellen na, past aan wat je anders ziet en bepaalt het cijfer.
Dat vervangt geen tweede corrector, en dat beweren we ook niet. Het maakt wel het nakijkproces controleerbaar, wat op dit moment bij vrijwel geen enkel schoolexamen het geval is. Hoe dat in de toetsweek werkt, staat op de pagina over PTA nakijken; hoe het nakijken werkt en waar het níet de juiste keuze is, op toetsen nakijken met AI. Wat het aan kwaliteit oplevert, houden we bij op de bewijspagina: meer dan 90% van de 200.000 beoordeelde vragen zat goed, over alle vakken en alle niveaus, stand 28 augustus 2026.
Het rapport van Cito eindigt met een oproep aan schoolleiders om structureel tijd in het rooster te reserveren voor toetsontwikkeling, collegiale review en kalibratie. Dat is de goede oproep. Tot die tijd er is, kun je in elk geval zorgen dat de tijd die je nu al in nakijken steekt, een cijfer oplevert dat je kunt verdedigen.
Veelgestelde vragen
Wat onderzocht Cito precies aan de schoolexamens?
In opdracht van het ministerie van OCW beoordeelde CitoLab, het onderzoeksteam van Stichting Cito, 78 schoolexamens uit 18 pakketten van vijftien scholen langs een beoordelingskader voor vakinhoudelijke en toetstechnische kwaliteit. Daarnaast vulden docenten en leden van examencommissies vragenlijsten in en sprak Cito met vakverenigingen. Het technisch rapport dateert van mei 2026 en ging op 2 juli 2026 met een Kamerbrief van staatssecretaris Tielen naar de Tweede Kamer.
Is het Cito-onderzoek representatief voor alle scholen?
Nee, en Cito zegt dat zelf. Deelname was vrijwillig, waardoor vooral scholen meededen die hun schoolexamens durfden te laten beoordelen; het vwo is oververtegenwoordigd en de 78 examens komen van maar vijftien scholen. De staatssecretaris schrijft daarom dat het onderzoek geen landelijk representatief beeld geeft. Cito merkt wel op dat de uitkomsten niet wezenlijk afwijken van eerder, groter onderzoek naar het schoolexamen.
Wat vond Cito over het nakijken van schoolexamens?
Dat de beoordeling en normering wisselend zijn geregeld. Beoordelingsmodellen missen regelmatig voorbeeldantwoorden en richtlijnen voor deels goede of alternatieve antwoorden, de logica van puntentoekenning en weging is niet altijd consequent of verdedigbaar, en er zijn weinig vaste afspraken op schoolniveau over het omzetten van scores naar cijfers. Tweede correctoren worden bij schriftelijke toetsopgaven vrijwel niet ingezet. Cito schrijft dat dit de vergelijkbaarheid en betrouwbaarheid van beoordelingen onder druk zet.
Waarom gebruiken docenten oude examenvragen in het schoolexamen?
Van de ondervraagde docenten noemt 67 procent als reden dat je zo gemakkelijker of sneller een toets van hoge kwaliteit maakt. Iets minder dan een derde wil er het verschil tussen SE- en CE-cijfers mee beperken. Cito ziet daar een keerzijde in: het schoolexamen wordt dan te veel een oefening voor het centraal examen en verliest zijn eigen karakter. Ook de staatssecretaris benoemt dat in haar Kamerbrief.
Wat kun je als sectie deze week al verbeteren aan je schoolexamens?
Cito geeft docenten vier concrete aanbevelingen: stel de cesuur vooraf expliciet vast en motiveer die kort; zorg dat bij elke toets een beoordelingsmodel ligt met voorbeeldantwoorden en regels voor deels goede antwoorden; geef elke toets een standaard voorblad met tijdsduur, hulpmiddelen, puntentelling en cesuur; en organiseer kalibratie binnen de sectie, waar mogelijk met een tweede, onafhankelijke beoordelaar. Geen daarvan vereist nieuw beleid of geld.
Bronnen: Stichting Cito (CitoLab), Onderzoek naar de kwaliteit van schoolexamens
, technisch rapport, mei 2026, in opdracht van het ministerie van OCW (78 schoolexamens uit 18 pakketten van 15 scholen; vragenlijsten onder docenten en examencommissieleden; interviews met vakverenigingen; deelname vrijwillig, niet representatief); Kamerbrief Betrouwbare, toekomstbestendige en toegankelijke examens
van staatssecretaris J.Z.C.M. Tielen, 2 juli 2026 (Kamerstuk 31 289, nr. 612), inclusief de TeacherTapp-peiling onder 552 leraren naar aanleiding van de motie-Boomsma; convocatie commissiedebat Toetsen en examens, Tweede Kamer, 9 september 2026; VO-raad, verslag van dat debat, 10 september 2026; Onderwijsraad, Kijk anders naar toetsing
, 28 mei 2026. De vragenlijstcijfers uit het Cito-onderzoek en de TeacherTapp-peiling zijn zelfgerapporteerd.