In 1936 stuurde een Amerikaans tijdschrift meer dan tien miljoen stembriefjes rond om de uitslag van een presidentsverkiezing te voorspellen. Ruim twee miljoen mensen vulden er een in, en toch wees de voorspelling de verkeerde winnaar aan, met zo'n 20 procentpunt verschil.
Een steekproef bepaal je in drie stappen: je legt de populatie vast, kiest een selectiemethode en berekent daaruit de benodigde omvang. Alleen een aselecte trekking laat later een conclusie over de hele populatie toe, en alleen daarvoor geldt de formule voor de steekproefomvang. Aan het eind weet je hoeveel deelnemers je onderzoek nodig heeft en hoe je die keuze in je methodehoofdstuk onderbouwt.
📌 In het kort
- Een steekproef is het onderzochte deel van een grotere populatie.
- Alleen een aselecte trekking laat conclusies over de hele populatie toe.
- Bij 95 procent betrouwbaarheid en 5 procent foutmarge volstaan 385 mensen.
- Boven een miljoen mensen verandert de populatieomvang niets meer.
- Het CBS benadert jaarlijks ruim 200 duizend personen voor de EBB.
Gratis enquête maken
Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.
- Enquête met AI
- Aanpassen met drag & drop
- Analyse in realtime
Wat is een steekproef?
Een steekproef is een deel dat uit een grotere groep, de populatie, wordt getrokken en namens die groep wordt onderzocht. De resultaten van dat deel worden vervolgens naar de hele groep doorgetrokken, mits de selectie via een erkende statistische procedure tot stand kwam.
De populatie omvat alle personen of gevallen waarover je een uitspraak wilt doen. In de statistiek staat de hoofdletter N voor de populatie en de kleine letter n voor de steekproef. Onderzoek je alle elementen van de populatie, dan is dat een volledige telling. Onderzoek je slechts een deel, dan is het een steekproefonderzoek, en in de praktijk is dat vrijwel altijd de enige begaanbare weg.
De officiële statistiek laat zien hoe klein een steekproef kan zijn. Volgens het Centraal Bureau voor de Statistiek worden jaarlijks ruim 200 duizend personen benaderd voor de eerste peiling van de Enquête beroepsbevolking, die sinds 1987 loopt (stand: augustus 2026). Meedoen is voor particulieren vrijwillig, en juist daarom hangt de kwaliteit van zo'n onderzoek net zo sterk aan de respons als aan de omvang. Je eigen empirisch onderzoek werkt volgens hetzelfde principe, op kleinere schaal.
Een volledige telling is de uitzondering. Een onderbouwde selectie is de regel.
Waarom een grote steekproef niet automatisch representatief is
Een grote steekproef is niet automatisch representatief, want het aantal antwoorden zegt niets over de manier waarop die antwoorden tot stand kwamen. Vertekent de selectiemethode de samenstelling, dan meet elk extra antwoord alleen maar nauwkeuriger een verkeerde uitkomst.
Het bekendste bewijs komt van het tijdschrift The Literary Digest. Voor de Amerikaanse verkiezing van 1936 stuurde het ruim tien miljoen stembriefjes rond, vooral naar adressen uit telefoongidsen en kentekenregisters. Er kwamen er meer dan 2,3 miljoen terug, een respons van net geen kwart. De voorspelling gaf 55 procent aan Alf Landon en 41 procent aan Franklin D. Roosevelt. Roosevelt won, met 60,8 procent van de stemmen (The American Presidency Project, University of California Santa Barbara).
Vrijwel elk studieboek geeft dezelfde verklaring: destijds hadden alleen welgestelde huishoudens een telefoon en een auto, dus was de selectie scheef. Zo eenvoudig ligt het niet. Peverill Squire analyseerde in 1988 in Public Opinion Quarterly een nameting en stelde vast dat ook mensen mét auto en telefoon in meerderheid op Roosevelt stemden. De tweede fout zat in de respons: aanhangers van Landon stuurden het briefje veel vaker terug. Hoe de totale fout zich over beide oorzaken verdeelt, is nog altijd omstreden. Squire (1988) legt meer gewicht bij de adresbestanden, Dominic Lusinchi (2012) bij de respons.
Voor je eigen onderzoek volgt daaruit een ongemakkelijke regel: wie antwoordt bepaalt de uitkomst net zo sterk als wie je hebt aangeschreven. Of een onderzoek uiteindelijk representatief is, hangt dus af van de methode en de respons, niet van een minimumaantal.
Steekproefmethoden: de drie routes naar je selectie
Steekproefmethoden vallen uiteen in drie groepen: de willekeurige selectie, de doelgerichte selectie en de aselecte trekking. Alleen de aselecte trekking draagt een statistisch onderbouwde conclusie over de populatie, omdat alleen daar elk element een bekende kans heeft om getrokken te worden.
Welke groep voor jou geldt, wordt zelden beslist door het ideaal en bijna altijd door een praktische vraag: heb je überhaupt een volledige lijst van je populatie? Voor ‘iedereen die in Utrecht fietst’ bestaat zo'n lijst niet, dus valt een echte aselecte trekking af. Het eerlijke antwoord in je methodehoofdstuk luidt dan dat je doelgericht of willekeurig hebt geselecteerd.
| Methode | Hoe er geselecteerd wordt | Wanneer het past |
|---|---|---|
| Willekeurige selectie | wie op dat moment bereikbaar is | eerste verkenning, pretest |
| Doelgerichte selectie | op vooraf vastgelegde kenmerken | extreme gevallen, zeldzame groepen |
| Aselecte trekking | via loting uit een lijst | conclusies over de populatie |
De drie meest gebruikte aselecte steekproeven
Binnen de aselecte trekking onderscheidt de methodenliteratuur drie varianten die in inspanning flink verschillen. Alle drie voldoen aan dezelfde voorwaarde, namelijk dat het toeval beslist. Ze plaatsen dat toeval alleen op een ander moment in de procedure, en dat verandert hoe nauwkeurig de uitkomst wordt.
- Enkelvoudige aselecte steekproef: elk element van de populatie wordt rechtstreeks en met gelijke kans getrokken.
- Gestratificeerde steekproef: de populatie wordt eerst op een kenmerk verdeeld, daarna wordt binnen elke laag getrokken.
- Clustersteekproef: er worden hele groepen getrokken, bijvoorbeeld schoolklassen, en daarbinnen wordt iedereen bevraagd.
In een scriptie is de gestratificeerde variant vaak het verstandigst, omdat die voorkomt dat een belangrijke groep puur door toeval te klein uitvalt. Hoe je genoeg mensen voor de trekking bereikt, staat in het artikel over respondenten werven.
Steekproefomvang berekenen: formule, waarden en een voorbeeld
De steekproefomvang volgt uit vier gegevens: de omvang van de populatie, de foutmarge die je toestaat, het betrouwbaarheidsniveau dat je wilt halen en de verwachte spreiding van de antwoorden. Samen geven ze het minimumaantal mensen dat je vragenlijst volledig moet invullen.
De vier gegevens op een rij:
- Populatie (N): alle personen waarover je een uitspraak wilt doen.
- Foutmarge (e): hoever je uitkomst van de werkelijke waarde mag afwijken, gebruikelijk is 5 procent.
- Betrouwbaarheidsniveau: hoe betrouwbaar dat interval de werkelijke waarde bevat, gebruikelijk is 95 procent.
- z-waarde: het betrouwbaarheidsniveau als getal, dus 1,645 bij 90 procent, 1,96 bij 95 procent, 2,576 bij 99 procent.
- Spreiding (p): de verwachte verdeling van de antwoorden, zonder voorkennis op 0,5 gezet, het ongunstigste geval.
Twee stappen maken van die gegevens een getal. De eerste geeft de waarde voor een zeer grote populatie, de tweede corrigeert die naar beneden zodra je groep klein is:
n0 = z² × p × (1 − p) / e²
n = n0 / (1 + n0 / N)
Een rekenvoorbeeld: je ondervraagt de studenten van je hogeschool, 12.000 personen in totaal. Bij 95 procent betrouwbaarheid (z = 1,96), 5 procent foutmarge (e = 0,05) en p = 0,5 geeft de eerste stap 384,16 en de tweede 372,2. Naar boven afgerond heb je 373 volledig ingevulde vragenlijsten nodig. Dezelfde berekening met je eigen cijfers doet de steekproefcalculator voor je. Omdat een deel van de respondenten altijd halverwege afhaakt, stuur je de vragenlijst naar aanzienlijk meer mensen.
Wanneer de formule voor de steekproefomvang niet geldt
De formule veronderstelt een aselecte trekking. Verspreid je je onderzoek via een Instagram-story, een WhatsApp-groep of het prikbord van je opleiding, dan beslist niet het toeval over deelname, maar de bereidheid van de mensen die jou toch al zien. Voor zo'n gelegenheidssteekproef valt geen foutmarge te berekenen, ook niet met 500 antwoorden.
⚠️ Let op
385 antwoorden uit een Instagram-story zeggen niets over Nederland, alleen iets over je bereik. Zet in zulke gevallen geen foutmarge in je scriptie. Noem in plaats daarvan de methode, beperk de uitspraak tot de groep die je echt hebt bereikt en leg uit waarom dat voor je onderzoeksvraag volstaat.
Gratis enquête maken
Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.
- Enquête met AI
- Aanpassen met drag & drop
- Analyse in realtime
Hoeveel deelnemers heb je echt nodig?
Voor de meeste onderzoeken ligt de benodigde steekproef tussen 80 en 400 mensen. Bij 95 procent betrouwbaarheid en 5 procent foutmarge zijn het er 385 zodra de populatie de miljoen passeert, en aanzienlijk minder zodra je groep overzichtelijk is.
Het verrassende daaraan is hoe weinig de omvang van de populatie uitmaakt. Tussen een miljoen en 18 miljoen mensen verandert de benodigde steekproef helemaal niet meer. Wie een onderzoek opblaast met het argument dat de doelgroep enorm is, heeft de som niet gemaakt.
| Populatie (N) | Benodigde steekproef (n) |
|---|---|
| 100 personen | 80 |
| 500 personen | 218 |
| 1.000 personen | 278 |
| 10.000 personen | 370 |
| 100.000 personen | 383 |
| 1.000.000 personen | 385 |
| 18.000.000 personen | 385 |
Berekend bij 95 procent betrouwbaarheid, 5 procent foutmarge en p = 0,5.
Meer nauwkeurigheid kost onevenredig veel mensen
De foutmarge is het duurste gegeven van de hele berekening, omdat die in het kwadraat meetelt. Van 5 naar 3 procent gaan kost bijna drie keer zoveel deelnemers, van 5 naar 1 procent kost vijfentwintig keer zoveel. Andersom laat de foutmargecalculator zien hoe nauwkeurig je uitkomst is bij een aantal deelnemers dat je al hebt gehaald. Voor een scriptie is de combinatie van 95 procent betrouwbaarheid en 5 procent foutmarge daarom de gebruikelijke en vaak enige realistische instelling.
| Foutmarge | Betrouwbaarheid | Benodigde steekproef |
|---|---|---|
| 10 procent | 95 procent | 97 |
| 5 procent | 90 procent | 271 |
| 5 procent | 95 procent | 385 |
| 5 procent | 99 procent | 664 |
| 3 procent | 95 procent | 1.066 |
| 1 procent | 95 procent | 9.513 |
Berekend voor een populatie van een miljoen personen en p = 0,5.
Bij kwalitatief onderzoek telt verzadiging, niet het aantal
Voor interviews en open vormen is de formule nutteloos, omdat daar geen verhouding wordt geschat. De maatstaf is theoretische verzadiging: je blijft interviewen tot nieuwe gesprekken geen nieuwe aspecten meer opleveren. In een scriptie gaat het vaak om acht tot vijftien interviews, al weegt de onderbouwing in de tekst zwaarder dan het aantal. Het verschil tussen beide routes staat in het artikel over kwalitatieve en kwantitatieve onderzoeksmethoden.
De steekproef in je scriptie beschrijven
De steekproef beschrijf je in het methodehoofdstuk, direct na de keuze van de onderzoeksmethode en vóór de vragenlijst zelf. Niemand verwacht een perfecte selectie, alleen een navolgbare: je begeleider wil lezen wie je hebt onderzocht, hoe je die mensen hebt bereikt en welke beperkingen daaruit voor je resultaten volgen.
Precies op dit punt laten veel scripties punten liggen. Een gelegenheidssteekproef kost niets, een verzwegen methode kost veel, omdat de beoordelaar dan zelf moet uitzoeken hoe solide je cijfers zijn. Wie de beperkingen zelf benoemt, komt zekerder over. Kijk ook in het onderwijs- en examenreglement van je opleiding, zeker als het om persoonsgegevens gaat.
Wat in het methodehoofdstuk hoort
- De populatie, benoemd en duidelijk afgebakend.
- De gekozen selectiemethode, met onderbouwing.
- De route waarlangs je de deelnemers hebt bereikt.
- De veldwerkperiode, met begin- en einddatum.
- Het aantal antwoorden, gesplitst naar begonnen en afgerond.
- De samenstelling op de kenmerken die voor je vraag tellen.
- De beperkingen die uit de methode voortvloeien.
Voor de laatste regel volstaat één zin, bijvoorbeeld: ‘De steekproef is een gelegenheidssteekproef, de resultaten gelden voor de bevraagde groep en zijn niet naar alle studenten door te trekken.’ Hoe het methodehoofdstuk als geheel wordt opgebouwd, staat in de gids voor empirisch onderzoek schrijven.
Veelgemaakte fouten bij de steekproef
De meeste fouten ontstaan niet tijdens het rekenen, maar ervoor en erna: bij het afbakenen van de populatie, bij het verspreiden van het onderzoek en bij het opschrijven van de resultaten. Vier gevallen komen steeds terug.
Alle vier zijn te vermijden als je vóór de start opschrijft over wie je onderzoek uiteindelijk iets moet zeggen. Zonder die zin op papier verschuift de doelgroep tijdens het veldwerk, meestal richting de mensen die het makkelijkst te bereiken zijn.
De populatie blijft vaag
‘Jongeren’ is geen populatie, want daaruit volgt geen selectie. Zonder leeftijdsgrens, gebied en periode valt er geen steekproef te trekken en later ook niet te controleren of die klopt. Het gevolg blijkt pas bij de analyse, wanneer onduidelijk blijft over wie de cijfers eigenlijk gaan. Schrijf de populatie daarom als volledige zin op voordat de eerste vraag bestaat.
De omvang wordt op gevoel vastgelegd
Ronde getallen als 100 of 200 ogen solide maar zijn zelden onderbouwd. Bij een populatie van 500 personen volstaan 218 antwoorden voor 5 procent foutmarge, bij 100.000 personen zijn er 383 nodig. Wie het getal vooraf kiest in plaats van het te berekenen, mikt te hoog en verliest tijd, of te laag en verliest zeggingskracht.
De respons wordt niet meegepland
Tussen verstuurde uitnodigingen en afgeronde vragenlijsten zit stelselmatig een groot gat. Wie 373 antwoorden nodig heeft en precies 373 mensen aanschrijft, eindigt ver onder de streep. Plan de verspreiding daarom ruimer en volg de respons tijdens het veldwerk, in plaats van aan het eind op een getal te hopen. Hoeveel uitnodigingen je nodig hebt, kun je vooraf via het responspercentage berekenen. Een tweede, vriendelijke herinnering levert meestal meer op dan twee weken verlenging.
Een scheve selectie wordt een algemene uitspraak
De duurste fout staat meestal in de conclusie. Een onderzoek onder 200 studiegenoten wordt daar een zin over ‘de studenten in Nederland’. Vakgenoten zien die sprong meteen, en hij ondermijnt ook de delen die wel goed zijn. Formuleer resultaten daarom altijd samen met de groep die je werkelijk hebt bevraagd.
Conclusie
De steekproef bepaalt de kwaliteit van je resultaten ruim voordat er ook maar iets geanalyseerd wordt. Kies de methode bewust, bereken de omvang één keer netjes en zet beide met hun beperkingen in je methodehoofdstuk. Een kleine, eerlijk beschreven steekproef brengt een onderzoek verder dan een grote die niemand kan reconstrueren.
Hoe je verdergaat
- Wil je de vragenlijst opbouwen? Vragenlijst maken
- Twijfel je over het meetniveau van je vragen? Meetniveaus bepalen
- Plan je de analyse al? Analysemethoden op een rij
Heb je 385 antwoorden nodig en maar drie weken de tijd?
Met empirio.ai, een online enquêtetool uit Duitsland, zet je je onderzoek in een paar stappen op, deel je het via een link en zie je de respons in real time, zodat je op tijd kunt bijsturen.
