empirio.ai

Sociaal-demografische vragen: formulering en voorbeelden

Leeftijd, geslacht, opleiding en inkomen lijken onschuldig, maar ze halen soms je hele analyse onderuit. We laten je zien hoe je ze formuleert en wat de AVG erover zegt.

Auteur bij empirio.ai - Maria Malzewdoor Maria MalzewBijgewerkt op 19 augustus 2026Leestijd 10 min

Twee vragenlijsten willen dezelfde informatie. De ene vraagt „Hoe oud bent u?”, de andere „In welk jaar ben je geboren?”. De antwoorden zijn niet even volledig, niet even nauwkeurig en uiteindelijk niet even bruikbaar bij de analyse.

Sociaal-demografische gegevens zijn de kenmerken van de persoon die in vrijwel elke vragenlijst voorkomen: leeftijd, geslacht, opleiding, arbeidspositie, inkomen en woonplaats. Je verzamelt ze om antwoorden per groep te vergelijken en je steekproef te plaatsen, en je kunt daarbij beter de indelingen van het CBS overnemen dan zelf iets bedenken. Aan het eind heb je zes vragen die je kunt overnemen en weet je welke je beter weglaat.


📌 In het kort

  • Sociaal-demografische gegevens beschrijven de persoon, niet het onderwerp.
  • Het CBS levert de indelingen die vergelijkbaar zijn met officiële cijfers.
  • Religie en seksuele gerichtheid vallen onder artikel 9 van de AVG.
  • Vooraan plaatsen verlaagt de respons niet (Teclaw 2012).
  • Onder vijf personen per groep is anonimiteit niet houdbaar.

Zo ziet zo'n vraag eruit in een afgeronde vragenlijst, als gesloten keuze met vaste categorieën.

Sociaal-demografische vraag in de vragenlijst van een online onderzoek

Gratis enquête maken

Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.

  • Enquête met AI
  • Aanpassen met drag & drop
  • Analyse in realtime
Gratis beginnen

Wat zijn sociaal-demografische gegevens?

Sociaal-demografische gegevens zijn kenmerken die een respondent sociaal en demografisch plaatsen: leeftijd, geslacht, opleidingsniveau, beroep, arbeidspositie, inkomen, burgerlijke staat en woonplaats. Ze beschrijven de persoon achter de mening en niet de mening zelf.

Daar komt hun nut precies vandaan. Zonder deze gegevens heb je één gemiddelde over alle deelnemers en verder niets. Met deze gegevens kun je vragen of studenten anders antwoorden dan werkenden, of leeftijdsgroepen uiteenlopen en of je steekproef überhaupt lijkt op de groep waarover je een uitspraak wilt doen.

In de onderzoeksmethodologie heten deze kenmerken daarom achtergrondkenmerken, en ze vormen het startpunt om de representativiteit van een steekproef te beoordelen. Voor een verenigingsonderzoek klinkt dat overdreven. Voor een scriptie is het het verschil tussen een analyse en een kolom cijfers.

Deze zes kenmerken volstaan voor de meeste onderzoeken:

  • Leeftijd, gevraagd als geboortejaar of als klasse.
  • Geslacht, met minstens een optie om niets in te vullen.
  • Hoogst voltooide opleiding, in één keuze.
  • Huidige arbeidspositie, inclusief studie en pensioen.
  • Netto huishoudinkomen, in klassen in plaats van bedragen.
  • Woonplaats, meestal provincie of postcodegebied.

Demografisch of sociaal-demografisch: waar de grens ligt

Demografische kenmerken beschrijven de bevolkingsstructuur in enge zin: leeftijd, geslacht, burgerlijke staat en woonplaats. Sociaal-demografische kenmerken voegen de sociale positie toe: opleiding, beroep, arbeidspositie en inkomen. Elk demografisch kenmerk is dus ook sociaal-demografisch, andersom geldt dat niet.

In de praktijk worden beide termen vrijwel door elkaar gebruikt en trekt geen enkele bindende norm de grens. Als een sjabloon „demografische vragen” aankondigt, horen opleiding en beroep er meestal gewoon bij. Voor je eigen werk telt de vraag welke kenmerken je echt gaat analyseren veel zwaarder dan het onderscheid.

Een derde term duikt op in marktonderzoeksrapporten en betekent iets anders: psychografische kenmerken, dus waarden, interesses en leefstijl. Dat zijn geen gegevens over de persoon in de hier bedoelde zin maar houdingen, en ze horen in het inhoudelijke deel van je vragenlijst.

Sociaal-demografisch zegt wie iemand is. Psychografisch zegt hoe iemand denkt.

De zes sociaal-demografische vragen en hun formulering

Het Nederlandse ijkpunt voor deze vragen zijn de standaardindelingen van het Centraal Bureau voor de Statistiek. Ze bestaan opdat verschillende onderzoeken onderling vergelijkbaar blijven, en dat is precies de reden om ze over te nemen in plaats van zelf categorieën te bedenken.

Vergelijkbaarheid is dus het praktische argument. Wie het opleidingsniveau in zelfbedachte treden uitvraagt, kan de steekproef achteraf met geen enkel gepubliceerd cijfer vergelijken, en bij een scriptie is die vergelijking vaak het enige bewijs over de kwaliteit van de steekproef. De formuleringen hieronder zijn onze werkversie voor korte online vragenlijsten.

KenmerkZo vraag je hetWaar je op let
Leeftijdgeboortejaar in vier cijfersklassen bouw je later, jaren komen niet terug
Geslachtgesloten lijst plus optie om niets te zeggenanders en zeg ik liever niet zijn twee dingen
Opleidinghoogst voltooide opleiding, één keuzembo, hbo en wo apart aanbieden
Arbeidspositiehuidige positie, één keuzestudenten, zzp en pensioen meenemen
Inkomennetto huishoudinkomen in klassenvooraf huishouden of persoon vastleggen
Woonplaatsprovincie of postcodegebiedhet volledige adres analyseert vrijwel niemand

Leeftijd vragen: geboortejaar of leeftijdsklasse?

Het geboortejaar is de betere uitgangsvorm, omdat je daaruit later elke gewenste indeling kunt maken. Een klasse geeft de jaren nooit terug. Wie in de vragenlijst „18 tot 25” laat aankruisen en bij de analyse merkt dat de grens bij 21 interessanter was, heeft pech.

Privacy trekt bij kleine onderzoeken de andere kant op. Een geboortejaar dat maar één keer voorkomt maakt iemand in een team van twintig meteen herkenbaar. Vuistregel: zodra een groep minder dan vijf personen bevat, is de belofte van anonimiteit niet meer houdbaar. Vraag in dat geval vanaf het begin in brede klassen.

Herkomst vragen: de nieuwe CBS-indeling

Herkomst is het kenmerk waar Nederlandse vragenlijsten het snelst verouderen. Het CBS introduceerde in februari 2022 een nieuwe indeling naar herkomst. Daarbij wordt het woord migratieachtergrond niet meer gebruikt, en de hoofdindeling westers tegenover niet-westers is vervangen door een indeling op basis van werelddelen en veelvoorkomende immigratielanden.

Twee dingen volgen daaruit voor je vragenlijst. Neem de nieuwe terminologie over als je met CBS-cijfers wilt vergelijken, want de oude termen sluiten niet meer aan. En bedenk dat gegevens over etnische afkomst onder artikel 9 van de AVG vallen: die vraag hoort niet zomaar tussen leeftijd en opleiding, maar vraagt om uitdrukkelijke toestemming met een eigen vinkje.

Opleiding vragen: houd de ladder herkenbaar

Opleiding is het kenmerk waarop zelfgemaakte vragenlijsten het vaakst misgaan. Een ladder die loopt van basisonderwijs via vmbo, havo en vwo naar mbo, hbo-bachelor, wo-bachelor en master blijft herkenbaar voor respondenten en is vergelijkbaar met gepubliceerde cijfers.

Twee toevoegingen worden makkelijk vergeten. Zet mbo, hbo en wo apart in plaats van ze samen te vegen, want dat is precies de indeling waarin Nederlandse cijfers worden gepubliceerd. En voeg een optie toe voor wie nog studeert, anders moet een derdejaars een diploma claimen dat nog niet bestaat.

Inkomen vragen: klassen in plaats van bedragen

De inkomensvraag is niet te analyseren zonder drie keuzes: netto of bruto, persoon of huishouden, maand of jaar. Ontbreekt er één, dan beantwoorden deelnemers verschillende vragen en betekent het gemiddelde niets. Een bruikbare formulering: „Wat is het netto maandinkomen van jouw huishouden, dus het bedrag na belastingen en premies?”

Klassen zijn de juiste antwoordvorm, omdat vrijwel geen analyse het exacte bedrag nodig heeft. Zes tot acht treden volstaan en de bovenste blijft open. Een optie „zeg ik liever niet” hoort erbij, anders raak je mensen kwijt die deze vraag simpelweg niet willen beantwoorden.

Waar horen sociaal-demografische vragen in de vragenlijst?

Sociaal-demografische vragen staan in de meeste vragenlijsten achteraan, en dat is een verstandige standaardkeuze. Een regel die door data wordt gedekt is het echter niet.

Vaak lees je dat deze vragen vooraan deelnemers afschrikken. Robert Teclaw, Mark C. Price en Katerine Osatuke hebben dat in 2012 in het Journal of Business and Psychology experimenteel getoetst: bij een online medewerkersonderzoek kreeg een deel de demografische vragen vooraan en een deel achteraan. De uitkomst was dat plaatsing vooraan de respons op juist die vragen verhoogde, zonder effect op de respons van de overige vragen of op hun gemiddelden.

Daaruit volgt geen nieuwe algemene regel, maar een keuze naar doel. Drie gevallen dekken vrijwel alles.

  1. Je moet filteren of quota halen. Dan gaan de vragen vooraan, anders vullen mensen buiten de doelgroep de hele lijst voor niets in.
  2. Je onderwerp ligt gevoelig. Dan helpt een lichte opening en gaan de persoonsgegevens achteraan.
  3. Je hebt maar een handvol kenmerken nodig. Dan maakt de plek nauwelijks uit en beslis je op leesbaarheid.

⚠️ Let op

Wie alle persoonsgegevens achteraan zet, raakt ze bij elke afhaker kwijt. Juist de kenmerken waarmee je zou kunnen beoordelen wie is afgehaakt ontbreken dan. Bij lange vragenlijsten loont het om twee of drie kernkenmerken naar voren te halen en de rest achteraan te laten.

Gratis enquête maken

Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.

  • Enquête met AI
  • Aanpassen met drag & drop
  • Analyse in realtime
Gratis beginnen

Welke sociaal-demografische vragen de AVG beperkt

Ras of etnische afkomst, religie, gezondheid, politieke opvattingen, vakbondslidmaatschap en seksuele gerichtheid zijn bijzondere categorieën van persoonsgegevens onder artikel 9 van de AVG. Verwerking ervan is in beginsel verboden, en in een onderzoek is uitdrukkelijke toestemming met een eigen vinkje in de praktijk de enige uitzondering die telt.

Artikel 9 is precies het punt waarop veel lijstjes met demografische vragen misgaan, ook een eerdere versie van dit artikel: religie en seksuele gerichtheid stonden daar gewoon tussen leeftijd en burgerlijke staat. Juridisch is dat niet dezelfde soort vraag, en het verschil kost je in het ergste geval de hele dataverzameling.

De tweede maatstaf is minimale gegevensverwerking uit artikel 5 van de AVG. Die eist dat je je beperkt tot het noodzakelijke en levert een heel praktische toets op: schrap elk gegeven waar je geen geplande analyse bij kunt noemen. Vragen naar de volledige geboortedatum terwijl je uiteindelijk in leeftijdsklassen rapporteert is precies het geval dat de bepaling bedoelt.

Daar komt de combinatievalkuil bij. Leeftijd, geslacht en afdeling zijn los onschuldig, maar samen wijzen ze in een team van twaalf vaak precies één persoon aan. Wie anonimiteit belooft, houdt deze vragen grof en laat liever een kenmerk weg. De uitwerking staat in het artikel over het anonieme onderzoek, en de grondslagen plus een voorbeeldtekst voor de privacyverklaring staan in dat over privacy bij onderzoek.

Bij twijfel telt het standpunt van de Autoriteit Persoonsgegevens of de regeling van je onderwijsinstelling. Dit artikel vervangt geen juridisch advies.

Veelgemaakte fouten bij sociaal-demografische vragen

De vier fouten hieronder komen steeds terug in vragenlijsten van studenten, verenigingen en kleine teams. Alle vier vallen ze pas bij de analyse op, en dan is het te laat.

Ze hebben één ding gemeen: geen ervan komt voort uit slordigheid. Ze komen voort uit het schrijven van de vraag voordat duidelijk is hoe de analyse eruit gaat zien.

Verplicht veld zonder uitweg

Een gedwongen antwoord op een persoonlijke vraag levert twee reacties op en beide schaden: sommigen haken af, anderen vinken willekeurig iets aan. De tweede groep is gevaarlijker, want die antwoorden zijn niet van echte te onderscheiden. Elke vraag over de persoon krijgt daarom de optie „zeg ik liever niet”, ook als de vraag verplicht is.

Tools als Google Forms, SurveyMonkey en empirio.ai laten je afzonderlijke vragen verplicht stellen. De uitwijkoptie ontstaat daardoor niet: die moet je zelf als antwoordmogelijkheid toevoegen.

Leeftijdsklassen die overlappen of gaten laten

„18 tot 25, 25 tot 35, 35 tot 45” is de klassieker: wie 25 is kan twee keer aankruisen. Een gat komt net zo vaak voor, meestal als er na „tot 65” niets meer volgt. Beide fouten ontstaan door snel typen en zijn in twee minuten verholpen als je de grenzen één keer hardop doorloopt.

Antwoordlijsten die niet bij de doelgroep passen

Een lijst met arbeidsposities zonder „student” is waardeloos voor een onderzoek onder studenten. Hetzelfde geldt voor opleidingslijsten zonder „nog studerend” en voor inkomensklassen die beginnen boven wat je respondenten verdienen. Toets elke lijst aan de mensen die de link daadwerkelijk krijgen.

Zelfbedachte categorieën in plaats van CBS-indelingen

Wie eigen opleidings- of inkomenstreden verzint, kan de steekproef achteraf met geen enkel gepubliceerd cijfer vergelijken. Daarmee vervalt de eenvoudigste uitspraak over de kwaliteit van de steekproef, en juist daar vraagt een begeleider naar. De CBS-indelingen overnemen kost vijf minuten en voorkomt dit probleem volledig.

Conclusie

Sociaal-demografische vragen zijn het deel van de vragenlijst waar creativiteit het minst oplevert. Neem de gangbare categorieën over, vraag leeftijd als geboortejaar, geef elke persoonlijke vraag een uitwijkoptie en schrap alles waarvoor je geen analyse hebt gepland.

Elk persoonsgegeven dat je verzamelt, moet je daarna ook beschermen.

Hoe je verdergaat


Een vragenlijst bouwen zonder de standaardvragen elke keer opnieuw te typen?

empirio.ai, een online enquêtetool uit Duitsland, verwerkt de antwoorden in de EU en laat je per vraag verplichte velden en uitwijkopties instellen.

Gratis een enquête maken

Veelgestelde vragen

Sociaal-demografische gegevens zijn de kenmerken die een respondent sociaal en demografisch plaatsen: leeftijd, geslacht, opleidingsniveau, beroep, arbeidspositie, inkomen, burgerlijke staat en woonplaats. Ze beschrijven de persoon en niet diens mening over het onderwerp. In een onderzoek dienen ze om antwoorden per groep te vergelijken en de samenstelling van de steekproef te beoordelen.

Demografische kenmerken beschrijven de bevolkingsstructuur in enge zin: leeftijd, geslacht, burgerlijke staat en woonplaats. Sociaal-demografische kenmerken voegen de sociale positie toe, dus opleiding, beroep, arbeidspositie en inkomen. Er is geen bindende norm die de grens trekt, en in sjablonen worden beide termen vrijwel door elkaar gebruikt.

Zes kenmerken volstaan voor de meeste onderzoeken: leeftijd, geslacht, hoogst voltooide opleiding, arbeidspositie, netto huishoudinkomen en provincie. Welke je echt nodig hebt bepaalt de geplande analyse. Elk gegeven zonder concrete analyse gaat eruit, want dat eist het beginsel van minimale gegevensverwerking uit artikel 5 van de AVG.

Sociaal-demografische vragen staan meestal achteraan, maar dat is gewoonte en geen regel. Teclaw, Price en Osatuke lieten in 2012 in het Journal of Business and Psychology zien dat plaatsing vooraan de respons op juist die vragen verhoogde, zonder effect op de overige vragen. Selectievragen en quotavragen horen sowieso vooraan.

Het geboortejaar in vier cijfers is de beste uitgangsvorm, want daaruit bouw je later elke leeftijdsklasse op, terwijl een klasse de jaren nooit teruggeeft. Bij kleine onderzoeken zijn vooraf bepaalde klassen veiliger, omdat een uniek geboortejaar iemand in een groep van twintig direct herkenbaar maakt.

Het CBS introduceerde in februari 2022 een nieuwe indeling naar herkomst. Het woord migratieachtergrond wordt daarbij niet meer gebruikt, en de hoofdindeling westers tegenover niet-westers is vervangen door een indeling op basis van werelddelen en veelvoorkomende immigratielanden. Neem die indeling over als je met CBS-cijfers wilt vergelijken.

Afzonderlijk vaak niet, in combinatie heel vaak wel. Leeftijd alleen zegt niets over een bepaalde persoon in een onderzoek met 400 respondenten. Leeftijd, geslacht en afdeling samen volstaan meestal om iemand in een team van twaalf te herkennen. Identificeerbaarheid ontstaat uit de combinatie en de context, niet uit het losse gegeven.

Vragen over ras of etnische afkomst, religie, gezondheid, politieke opvattingen, lidmaatschap van een vakbond en seksuele gerichtheid zijn bijzondere categorieën onder artikel 9 van de AVG. Verwerking is verboden tenzij een uitzondering geldt, en in een onderzoek is dat in de praktijk alleen uitdrukkelijke toestemming met een eigen vinkje.

Dit zou je ook kunnen interesseren