empirio.ai

Steekproef: zo kies je de juiste methode en omvang

Hoeveel antwoorden heb je echt nodig? We laten je de gangbare selectiemethoden zien, rekenen de steekproefomvang voor en zeggen wanneer die formule niets meer zegt.

Auteur bij empirio.ai - Maria Malzewdoor Maria MalzewBijgewerkt op 31 augustus 2026Leestijd 11 min

In 1936 stuurde een Amerikaans tijdschrift meer dan tien miljoen stembriefjes rond om de uitslag van een presidentsverkiezing te voorspellen. Ruim twee miljoen mensen vulden er een in, en toch wees de voorspelling de verkeerde winnaar aan, met zo'n 20 procentpunt verschil.

Een steekproef bepaal je in drie stappen: je legt de populatie vast, kiest een selectiemethode en berekent daaruit de benodigde omvang. Alleen een aselecte trekking laat later een conclusie over de hele populatie toe, en alleen daarvoor geldt de formule voor de steekproefomvang. Aan het eind weet je hoeveel deelnemers je onderzoek nodig heeft en hoe je die keuze in je methodehoofdstuk onderbouwt.


📌 In het kort

  • Een steekproef is het onderzochte deel van een grotere populatie.
  • Alleen een aselecte trekking laat conclusies over de hele populatie toe.
  • Bij 95 procent betrouwbaarheid en 5 procent foutmarge volstaan 385 mensen.
  • Boven een miljoen mensen verandert de populatieomvang niets meer.
  • Het CBS benadert jaarlijks ruim 200 duizend personen voor de EBB.

Gratis enquête maken

Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.

  • Enquête met AI
  • Aanpassen met drag & drop
  • Analyse in realtime
Gratis beginnen

Wat is een steekproef?

Een steekproef is een deel dat uit een grotere groep, de populatie, wordt getrokken en namens die groep wordt onderzocht. De resultaten van dat deel worden vervolgens naar de hele groep doorgetrokken, mits de selectie via een erkende statistische procedure tot stand kwam.

De populatie omvat alle personen of gevallen waarover je een uitspraak wilt doen. In de statistiek staat de hoofdletter N voor de populatie en de kleine letter n voor de steekproef. Onderzoek je alle elementen van de populatie, dan is dat een volledige telling. Onderzoek je slechts een deel, dan is het een steekproefonderzoek, en in de praktijk is dat vrijwel altijd de enige begaanbare weg.

De officiële statistiek laat zien hoe klein een steekproef kan zijn. Volgens het Centraal Bureau voor de Statistiek worden jaarlijks ruim 200 duizend personen benaderd voor de eerste peiling van de Enquête beroepsbevolking, die sinds 1987 loopt (stand: augustus 2026). Meedoen is voor particulieren vrijwillig, en juist daarom hangt de kwaliteit van zo'n onderzoek net zo sterk aan de respons als aan de omvang. Je eigen empirisch onderzoek werkt volgens hetzelfde principe, op kleinere schaal.

Een volledige telling is de uitzondering. Een onderbouwde selectie is de regel.

Waarom een grote steekproef niet automatisch representatief is

Een grote steekproef is niet automatisch representatief, want het aantal antwoorden zegt niets over de manier waarop die antwoorden tot stand kwamen. Vertekent de selectiemethode de samenstelling, dan meet elk extra antwoord alleen maar nauwkeuriger een verkeerde uitkomst.

Het bekendste bewijs komt van het tijdschrift The Literary Digest. Voor de Amerikaanse verkiezing van 1936 stuurde het ruim tien miljoen stembriefjes rond, vooral naar adressen uit telefoongidsen en kentekenregisters. Er kwamen er meer dan 2,3 miljoen terug, een respons van net geen kwart. De voorspelling gaf 55 procent aan Alf Landon en 41 procent aan Franklin D. Roosevelt. Roosevelt won, met 60,8 procent van de stemmen (The American Presidency Project, University of California Santa Barbara).

Vrijwel elk studieboek geeft dezelfde verklaring: destijds hadden alleen welgestelde huishoudens een telefoon en een auto, dus was de selectie scheef. Zo eenvoudig ligt het niet. Peverill Squire analyseerde in 1988 in Public Opinion Quarterly een nameting en stelde vast dat ook mensen mét auto en telefoon in meerderheid op Roosevelt stemden. De tweede fout zat in de respons: aanhangers van Landon stuurden het briefje veel vaker terug. Hoe de totale fout zich over beide oorzaken verdeelt, is nog altijd omstreden. Squire (1988) legt meer gewicht bij de adresbestanden, Dominic Lusinchi (2012) bij de respons.

Voor je eigen onderzoek volgt daaruit een ongemakkelijke regel: wie antwoordt bepaalt de uitkomst net zo sterk als wie je hebt aangeschreven. Of een onderzoek uiteindelijk representatief is, hangt dus af van de methode en de respons, niet van een minimumaantal.

Steekproefmethoden: de drie routes naar je selectie

Steekproefmethoden vallen uiteen in drie groepen: de willekeurige selectie, de doelgerichte selectie en de aselecte trekking. Alleen de aselecte trekking draagt een statistisch onderbouwde conclusie over de populatie, omdat alleen daar elk element een bekende kans heeft om getrokken te worden.

Welke groep voor jou geldt, wordt zelden beslist door het ideaal en bijna altijd door een praktische vraag: heb je überhaupt een volledige lijst van je populatie? Voor ‘iedereen die in Utrecht fietst’ bestaat zo'n lijst niet, dus valt een echte aselecte trekking af. Het eerlijke antwoord in je methodehoofdstuk luidt dan dat je doelgericht of willekeurig hebt geselecteerd.

MethodeHoe er geselecteerd wordtWanneer het past
Willekeurige selectiewie op dat moment bereikbaar iseerste verkenning, pretest
Doelgerichte selectieop vooraf vastgelegde kenmerkenextreme gevallen, zeldzame groepen
Aselecte trekkingvia loting uit een lijstconclusies over de populatie

De drie meest gebruikte aselecte steekproeven

Binnen de aselecte trekking onderscheidt de methodenliteratuur drie varianten die in inspanning flink verschillen. Alle drie voldoen aan dezelfde voorwaarde, namelijk dat het toeval beslist. Ze plaatsen dat toeval alleen op een ander moment in de procedure, en dat verandert hoe nauwkeurig de uitkomst wordt.

  • Enkelvoudige aselecte steekproef: elk element van de populatie wordt rechtstreeks en met gelijke kans getrokken.
  • Gestratificeerde steekproef: de populatie wordt eerst op een kenmerk verdeeld, daarna wordt binnen elke laag getrokken.
  • Clustersteekproef: er worden hele groepen getrokken, bijvoorbeeld schoolklassen, en daarbinnen wordt iedereen bevraagd.

In een scriptie is de gestratificeerde variant vaak het verstandigst, omdat die voorkomt dat een belangrijke groep puur door toeval te klein uitvalt. Hoe je genoeg mensen voor de trekking bereikt, staat in het artikel over respondenten werven.

Steekproefomvang berekenen: formule, waarden en een voorbeeld

De steekproefomvang volgt uit vier gegevens: de omvang van de populatie, de foutmarge die je toestaat, het betrouwbaarheidsniveau dat je wilt halen en de verwachte spreiding van de antwoorden. Samen geven ze het minimumaantal mensen dat je vragenlijst volledig moet invullen.

De vier gegevens op een rij:

  • Populatie (N): alle personen waarover je een uitspraak wilt doen.
  • Foutmarge (e): hoever je uitkomst van de werkelijke waarde mag afwijken, gebruikelijk is 5 procent.
  • Betrouwbaarheidsniveau: hoe betrouwbaar dat interval de werkelijke waarde bevat, gebruikelijk is 95 procent.
  • z-waarde: het betrouwbaarheidsniveau als getal, dus 1,645 bij 90 procent, 1,96 bij 95 procent, 2,576 bij 99 procent.
  • Spreiding (p): de verwachte verdeling van de antwoorden, zonder voorkennis op 0,5 gezet, het ongunstigste geval.

Twee stappen maken van die gegevens een getal. De eerste geeft de waarde voor een zeer grote populatie, de tweede corrigeert die naar beneden zodra je groep klein is:

n0 = z² × p × (1 − p) / e²
n  = n0 / (1 + n0 / N)

Een rekenvoorbeeld: je ondervraagt de studenten van je hogeschool, 12.000 personen in totaal. Bij 95 procent betrouwbaarheid (z = 1,96), 5 procent foutmarge (e = 0,05) en p = 0,5 geeft de eerste stap 384,16 en de tweede 372,2. Naar boven afgerond heb je 373 volledig ingevulde vragenlijsten nodig. Dezelfde berekening met je eigen cijfers doet de steekproefcalculator voor je. Omdat een deel van de respondenten altijd halverwege afhaakt, stuur je de vragenlijst naar aanzienlijk meer mensen.

Wanneer de formule voor de steekproefomvang niet geldt

De formule veronderstelt een aselecte trekking. Verspreid je je onderzoek via een Instagram-story, een WhatsApp-groep of het prikbord van je opleiding, dan beslist niet het toeval over deelname, maar de bereidheid van de mensen die jou toch al zien. Voor zo'n gelegenheidssteekproef valt geen foutmarge te berekenen, ook niet met 500 antwoorden.

⚠️ Let op

385 antwoorden uit een Instagram-story zeggen niets over Nederland, alleen iets over je bereik. Zet in zulke gevallen geen foutmarge in je scriptie. Noem in plaats daarvan de methode, beperk de uitspraak tot de groep die je echt hebt bereikt en leg uit waarom dat voor je onderzoeksvraag volstaat.

Gratis enquête maken

Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.

  • Enquête met AI
  • Aanpassen met drag & drop
  • Analyse in realtime
Gratis beginnen

Hoeveel deelnemers heb je echt nodig?

Voor de meeste onderzoeken ligt de benodigde steekproef tussen 80 en 400 mensen. Bij 95 procent betrouwbaarheid en 5 procent foutmarge zijn het er 385 zodra de populatie de miljoen passeert, en aanzienlijk minder zodra je groep overzichtelijk is.

Het verrassende daaraan is hoe weinig de omvang van de populatie uitmaakt. Tussen een miljoen en 18 miljoen mensen verandert de benodigde steekproef helemaal niet meer. Wie een onderzoek opblaast met het argument dat de doelgroep enorm is, heeft de som niet gemaakt.

Populatie (N)Benodigde steekproef (n)
100 personen80
500 personen218
1.000 personen278
10.000 personen370
100.000 personen383
1.000.000 personen385
18.000.000 personen385

Berekend bij 95 procent betrouwbaarheid, 5 procent foutmarge en p = 0,5.

Meer nauwkeurigheid kost onevenredig veel mensen

De foutmarge is het duurste gegeven van de hele berekening, omdat die in het kwadraat meetelt. Van 5 naar 3 procent gaan kost bijna drie keer zoveel deelnemers, van 5 naar 1 procent kost vijfentwintig keer zoveel. Andersom laat de foutmargecalculator zien hoe nauwkeurig je uitkomst is bij een aantal deelnemers dat je al hebt gehaald. Voor een scriptie is de combinatie van 95 procent betrouwbaarheid en 5 procent foutmarge daarom de gebruikelijke en vaak enige realistische instelling.

FoutmargeBetrouwbaarheidBenodigde steekproef
10 procent95 procent97
5 procent90 procent271
5 procent95 procent385
5 procent99 procent664
3 procent95 procent1.066
1 procent95 procent9.513

Berekend voor een populatie van een miljoen personen en p = 0,5.

Bij kwalitatief onderzoek telt verzadiging, niet het aantal

Voor interviews en open vormen is de formule nutteloos, omdat daar geen verhouding wordt geschat. De maatstaf is theoretische verzadiging: je blijft interviewen tot nieuwe gesprekken geen nieuwe aspecten meer opleveren. In een scriptie gaat het vaak om acht tot vijftien interviews, al weegt de onderbouwing in de tekst zwaarder dan het aantal. Het verschil tussen beide routes staat in het artikel over kwalitatieve en kwantitatieve onderzoeksmethoden.

De steekproef in je scriptie beschrijven

De steekproef beschrijf je in het methodehoofdstuk, direct na de keuze van de onderzoeksmethode en vóór de vragenlijst zelf. Niemand verwacht een perfecte selectie, alleen een navolgbare: je begeleider wil lezen wie je hebt onderzocht, hoe je die mensen hebt bereikt en welke beperkingen daaruit voor je resultaten volgen.

Precies op dit punt laten veel scripties punten liggen. Een gelegenheidssteekproef kost niets, een verzwegen methode kost veel, omdat de beoordelaar dan zelf moet uitzoeken hoe solide je cijfers zijn. Wie de beperkingen zelf benoemt, komt zekerder over. Kijk ook in het onderwijs- en examenreglement van je opleiding, zeker als het om persoonsgegevens gaat.

Wat in het methodehoofdstuk hoort

  • De populatie, benoemd en duidelijk afgebakend.
  • De gekozen selectiemethode, met onderbouwing.
  • De route waarlangs je de deelnemers hebt bereikt.
  • De veldwerkperiode, met begin- en einddatum.
  • Het aantal antwoorden, gesplitst naar begonnen en afgerond.
  • De samenstelling op de kenmerken die voor je vraag tellen.
  • De beperkingen die uit de methode voortvloeien.

Voor de laatste regel volstaat één zin, bijvoorbeeld: ‘De steekproef is een gelegenheidssteekproef, de resultaten gelden voor de bevraagde groep en zijn niet naar alle studenten door te trekken.’ Hoe het methodehoofdstuk als geheel wordt opgebouwd, staat in de gids voor empirisch onderzoek schrijven.

Veelgemaakte fouten bij de steekproef

De meeste fouten ontstaan niet tijdens het rekenen, maar ervoor en erna: bij het afbakenen van de populatie, bij het verspreiden van het onderzoek en bij het opschrijven van de resultaten. Vier gevallen komen steeds terug.

Alle vier zijn te vermijden als je vóór de start opschrijft over wie je onderzoek uiteindelijk iets moet zeggen. Zonder die zin op papier verschuift de doelgroep tijdens het veldwerk, meestal richting de mensen die het makkelijkst te bereiken zijn.

De populatie blijft vaag

‘Jongeren’ is geen populatie, want daaruit volgt geen selectie. Zonder leeftijdsgrens, gebied en periode valt er geen steekproef te trekken en later ook niet te controleren of die klopt. Het gevolg blijkt pas bij de analyse, wanneer onduidelijk blijft over wie de cijfers eigenlijk gaan. Schrijf de populatie daarom als volledige zin op voordat de eerste vraag bestaat.

De omvang wordt op gevoel vastgelegd

Ronde getallen als 100 of 200 ogen solide maar zijn zelden onderbouwd. Bij een populatie van 500 personen volstaan 218 antwoorden voor 5 procent foutmarge, bij 100.000 personen zijn er 383 nodig. Wie het getal vooraf kiest in plaats van het te berekenen, mikt te hoog en verliest tijd, of te laag en verliest zeggingskracht.

De respons wordt niet meegepland

Tussen verstuurde uitnodigingen en afgeronde vragenlijsten zit stelselmatig een groot gat. Wie 373 antwoorden nodig heeft en precies 373 mensen aanschrijft, eindigt ver onder de streep. Plan de verspreiding daarom ruimer en volg de respons tijdens het veldwerk, in plaats van aan het eind op een getal te hopen. Hoeveel uitnodigingen je nodig hebt, kun je vooraf via het responspercentage berekenen. Een tweede, vriendelijke herinnering levert meestal meer op dan twee weken verlenging.

Een scheve selectie wordt een algemene uitspraak

De duurste fout staat meestal in de conclusie. Een onderzoek onder 200 studiegenoten wordt daar een zin over ‘de studenten in Nederland’. Vakgenoten zien die sprong meteen, en hij ondermijnt ook de delen die wel goed zijn. Formuleer resultaten daarom altijd samen met de groep die je werkelijk hebt bevraagd.

Conclusie

De steekproef bepaalt de kwaliteit van je resultaten ruim voordat er ook maar iets geanalyseerd wordt. Kies de methode bewust, bereken de omvang één keer netjes en zet beide met hun beperkingen in je methodehoofdstuk. Een kleine, eerlijk beschreven steekproef brengt een onderzoek verder dan een grote die niemand kan reconstrueren.

Hoe je verdergaat


Heb je 385 antwoorden nodig en maar drie weken de tijd?

Met empirio.ai, een online enquêtetool uit Duitsland, zet je je onderzoek in een paar stappen op, deel je het via een link en zie je de respons in real time, zodat je op tijd kunt bijsturen.

Gratis een enquête maken

Veelgestelde vragen

Bij 95 procent betrouwbaarheid en 5 procent foutmarge heeft een steekproef 385 volledig ingevulde antwoorden nodig zodra de populatie de miljoen mensen passeert. Bij kleinere groepen daalt dat aantal flink: 383 bij 100.000 personen, 370 bij 10.000, 278 bij 1.000 en 80 bij 100. Al deze waarden veronderstellen een aselecte trekking.

Een steekproef is representatief wanneer die via loting uit een volledig in kaart gebrachte populatie is getrokken en de respons niet stelselmatig scheef is. Omvang alleen beslist niet. Het onderzoek van het tijdschrift The Literary Digest uit 1936 verzamelde ruim 2,3 miljoen antwoorden en wees toch de verkeerde winnaar aan.

De populatie omvat alle personen of gevallen waarover een uitspraak moet gelden, terwijl de steekproef alleen het werkelijk onderzochte deel omvat. In de statistiek staat de hoofdletter N voor de populatie en de kleine letter n voor de steekproef. Worden alle elementen onderzocht, dan heet dat een volledige telling.

Steekproefmethoden vallen uiteen in willekeurige selectie, doelgerichte selectie en aselecte trekking. De aselecte trekking kent drie gangbare varianten: de enkelvoudige aselecte steekproef, de gestratificeerde steekproef en de clustersteekproef. Alleen de aselecte trekking draagt een statistisch onderbouwde conclusie over de populatie.

De steekproefomvang volgt uit vier gegevens: populatie N, foutmarge e, de z-waarde van het betrouwbaarheidsniveau en de verwachte spreiding p. Eerst bereken je n0 = z² × p × (1 − p) / e², daarna n = n0 / (1 + n0 / N). Bij N = 12.000, z = 1,96, e = 0,05 en p = 0,5 komt daar 373 personen uit.

Het CBS benadert jaarlijks ruim 200 duizend personen voor de eerste peiling van de Enquête beroepsbevolking, die sinds 1987 loopt. Meedoen is voor particulieren vrijwillig, wat betekent dat de respons voor de kwaliteit van de cijfers net zo bepalend is als de omvang van de steekproef (stand: augustus 2026).

De hoofdletter N staat voor de populatie, dus alle personen of gevallen waarover een uitspraak moet gelden. De kleine letter n staat voor de steekproef, dus het aantal werkelijk onderzochte gevallen. In resultatenrapportages geeft n vaak ook de omvang van een subgroep aan, bijvoorbeeld n = 42 voor één leeftijdsgroep.

Dit zou je ook kunnen interesseren

Empirisch onderzoek

Grondslagen van empirisch onderzoek | empirio

Empirisch onderzoek is meer dan cijfers en meer dan een eigen enquête. Ontdek welke route bij jouw onderzoeksvraag past en wat je vóór de eerste vraag geregeld moet hebben.

Empirisch onderzoek

Kwantitatief onderzoek: verloop, methoden & voorbeeld

In dit artikel bespreken we kwantitatief onderzoek en voor welke onderwerpsgebieden het het beste geschikt is. Aan de hand van een concreet voorbeeld - een kwantitatief onderzoek - laten we je zien hoe je deze onderzoeksmethode in je afstudeerwerk kunt toepassen.