„Hoe tevreden ben je over de begeleiding van je afstudeeronderzoek?” Daaronder vijf hokjes, links „zeer ontevreden”, rechts „zeer tevreden”. Zo’n antwoordformat zit in bijna elke vragenlijst en het heeft een naam.
Een beoordelingsschaal, in vaktaal ook antwoordschaal en in het Engels rating scale, is een gesloten antwoordformat met meerdere geordende stappen waarop een respondent aangeeft hoe sterk een kenmerk bij hem of haar aanwezig is. Na dit artikel weet je hoeveel stappen je nodig hebt, hoe je ze benoemt en welk kengetal je mag rapporteren.
📌 Het belangrijkste in het kort
- Een beoordelingsschaal legt gradaties vast, geen ja-nee-antwoord.
- Vijf tot zeven stappen is de gangbare aanbeveling.
- Streng genomen meet een losse schaalvraag op ordinaal niveau.
- Het CBS benoemt elke stap, niet alleen de uiteinden.
- „Weet niet” hoort niet in het midden van de schaal.
Gratis enquête maken
Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.
- Enquête met AI
- Aanpassen met drag & drop
- Analyse in realtime
Wat is een beoordelingsschaal?
Een beoordelingsschaal is een gesloten antwoordformat met meerdere geordende categorieën waarmee een respondent inschat hoe sterk een kenmerk bij hem of haar aanwezig is, bijvoorbeeld van „zeer ontevreden” tot „zeer tevreden”. Een ja-nee-vraag splitst je deelnemers in twee groepen, terwijl een beoordelingsschaal laat zien hoe ver iemand tussen de uiteinden in staat. Binnen de vraagtypen in een enquête is dit het standaardformat voor houdingen en tevredenheid.
Over de naam bestaat in het Nederlands geen eensgezindheid, en dat is meteen het eerste wat verwarring geeft. Het Engelse rating scale heet hier meestal beoordelingsschaal of antwoordschaal, in enquêtetools vaak schaalvraag, en de leenvorm ratingschaal kom je vooral tegen in materiaal dat uit het Engels of het Duits is overgezet. Bedoeld wordt telkens hetzelfde format. Let ook op de spelling, want Nederlandse zelfstandige naamwoorden krijgen geen hoofdletter: beoordelingsschaal, antwoordschaal en ratingschaal schrijf je klein.
Beoordelingsschalen komen in twee rollen voor. Bij zelfbeoordeling schat iemand zichzelf in, bijvoorbeeld hoe zenuwachtig hij wordt van een presentatie. Bij beoordeling door een ander schat een stagebegeleider datzelfde kenmerk in. De schaal ziet er in beide gevallen hetzelfde uit, alleen de foutenbronnen lopen ver uiteen.
Een beoordelingsschaal meet niet hoe iets is, maar hoe iemand het ervaart.
Nog één afbakening hoort erbij, want bij het zoeken levert ze ruis op. In de financiële wereld betekent ratingschaal de trappen waarmee kredietbeoordelaars het risico van een lening of een land uitdrukken. Dit artikel gaat alleen over het antwoordformat in een online enquête of een papieren vragenlijst.
Welk meetniveau heeft een beoordelingsschaal?
Een losse beoordelingsschaal meet streng genomen op ordinaal niveau. De stappen staan in een duidelijke volgorde, maar niemand kan aantonen dat de afstand tussen „oneens” en „niet eens, niet oneens” even groot is als die tussen „eens” en „helemaal eens”.
In de praktijk wordt daar soepel mee omgegaan. De Methodenberatung van de Universiteit Zürich schrijft dat zulke items eigenlijk als ordinaal moeten gelden, omdat respondenten de afstanden niet per se als gelijk ervaren, en dat ze toch vaak als intervalgeschaald worden behandeld zodra die aanname plausibel lijkt (Methodenberatung, Universiteit Zürich).
Twee leerboeken kunnen je daardoor twee verschillende antwoorden geven zonder dat een van beide fout is. Voor je eigen onderzoek beslist één criterium: gaat het om één losse vraag of om meerdere vragen die samen tot één score worden verrekend?
Beoordelingsschaal en Likertschaal: waar het verschil zit
Een Likertschaal is een bouwvorm van de beoordelingsschaal en geen alternatief ervoor. Kenmerkend zijn een instemmingsdimensie, meerdere stellingen over hetzelfde kenmerk en één gezamenlijke score. Een losse vraag heet in de methodeliteratuur netter een Likert-item, en juist dat item blijft ordinaal. Wat die bouwvorm verder vraagt, staat in ons artikel over de Likertschaal.
Een somscore over meerdere items wordt daarentegen meestal als intervalschaal geanalyseerd. Niet omdat optellen het meetniveau optilt, want dat doet het niet, maar omdat zo’n score veel meer waarden kan aannemen en de gangbare methoden robuust blijken tegen die schending. Een aanname blijft het.
Voor je methodehoofdstuk
Wie uit antwoordstappen een gemiddelde berekent, schrijft er één zin bij: de antwoordstappen zijn als even groot behandeld. Die ene regel neemt de vraag van je beoordelaar alvast weg. Zonder die zin claimt je analyse een meetniveau dat de gegevens niet dragen.
Welke soorten beoordelingsschalen zijn er?
Beoordelingsschalen verschillen niet alleen in lengte. Drie ontwerpvragen bepalen hoe ze eruitzien: welke richting de schaal afbeeldt, waarmee de stappen gemarkeerd zijn en hoe fijn het antwoord mag uitvallen.
De combinatie bepaalt mee hoe bruikbaar je gegevens worden. Een schaal met twee tegenpolen en alleen benoemde uiteinden vraagt iets heel anders van je respondenten dan een schaal waarvan alle vijf de stappen een woord dragen. Loop de drie vragen daarom apart langs.
Unipolair of bipolair: hoeveel richtingen de schaal afbeeldt
Eén waarschuwing hoort vóór de voorbeelden. De GESIS Survey Guidelines stellen vast dat de literatuur geen eenduidige definitie van polariteit kent (Menold en Bogner 2015). Wie een schaal unipolair of bipolair noemt, schrijft er dus beter bij welke definitie hij aanhoudt.
Een unipolaire schaal beeldt de intensiteit van één kenmerk af, van helemaal niet tot heel sterk. Voorbeeld: „Hoeveel moeite kost het jou om een bijbaan met je studie te combineren?”, met stappen van „helemaal geen moeite” tot „heel veel moeite”. Een tegenpool ontbreekt, er is alleen meer of minder van hetzelfde.
Een bipolaire schaal zet twee tegengestelde kenmerken aan de uiteinden. Voorbeeld: „Het tempo van deze cursus vond ik ...”, met stappen van „veel te langzaam” tot „veel te snel”. De twee polen geven elkaar betekenis, en precies daarom is deze bouwvorm lastiger: het midden moet inhoudelijk iets voorstellen.
Woorden, cijfers, symbolen of een lijn: waarmee de stappen gemarkeerd zijn
De markering is wat respondenten daadwerkelijk zien. Vier vormen komen voor en elk heeft haar eigen terrein.
| Markering | Hoe het eruitziet | Waar het werkt |
|---|---|---|
| Verbaal | een woord per stap | standaardgeval, het minst misverstand |
| Numeriek | cijfers, bijvoorbeeld 1 tot 10 | vertrouwde systemen zoals schoolcijfers |
| Symbolisch | smileys, sterren, duimen | kinderen en korte feedbackvragen |
| Grafisch | een punt op een lijn | fijne gradaties, alleen online |
Cijfers lijken ondubbelzinnig en zijn dat lang niet altijd. Nederland gebruikt in het hele onderwijs hetzelfde cijfer van 1 tot en met 10, waarbij 10 het hoogst mogelijke cijfer is en 6 het laagste voldoende. Interessanter voor schaalbouw is wat de Rijksuniversiteit Groningen erbij vermeldt: „De cijfers 1 t/m 3 worden vrijwel niet gebruikt en ook een 10 wordt zelden gegeven” (RUG, ECTS-grading tabel).
Daar zit een les in die verder reikt dan het klaslokaal. Tien stappen op papier, ongeveer zes in gebruik: het aantal stappen dat je ontwerpt is niet vanzelf het aantal dat je meet. Zelfs de grens valt niet op een hele stap, want een 5,5 wordt in het voortgezet onderwijs afgerond naar een 6 (Nuffic over beoordelingssystemen). Bij een kale schaal van 1 tot 7 leggen twee respondenten stap 5 net zo goed anders uit. De Net Promoter Score is het bekendste voorbeeld van een cijferschaal met alleen benoemde uiteinden.
Vaste stappen of een schuifbalk: hoe fijn het antwoord mag uitvallen
Verreweg de meeste beoordelingsschalen hebben vaste stappen: een afgesproken aantal hokjes, en daartussen zit niets. Zo werkt het op papier en op het scherm, en voor bijna elk onderwerp is dat ruim voldoende.
Continue schalen werken in plaats daarvan met een schuifbalk of een lijn waarop een willekeurig punt gekozen mag worden. Online is die vorm bruikbaar, op papier nauwelijks, want dan moet er achteraf een liniaal aan te pas komen.

Hoeveel antwoordstappen heeft een schaal nodig?
Vijf tot zeven stappen is de gangbare aanbeveling. De GESIS Survey Guidelines vatten de onderzoekslijn zo samen dat een optimale meting wat betreft betrouwbaarheid, validiteit en onderscheidingsvermogen met vijf tot zeven categorieën haalbaar is, en dat respondenten datzelfde bereik ook zelf prettig vinden (Menold en Bogner 2015, GESIS Survey Guidelines).
Toch is de discussie daarmee niet gesloten. Dezelfde handreiking noemt nieuwer werk waarin de meetkwaliteit met meer categorieën verder blijft stijgen, getest tot tien, elf en zelfs honderd stappen. De vuistregel houdt niettemin stand, om een praktische reden: alleen zoveel stappen laten zich nog zinnig in woorden vangen.
Voor je eigen vragenlijst betekent dat: blijf bij vijf als je elke stap benoemt, en ga naar zeven als je fijnere verschillen nodig hebt. Onder de vijf stappen verlies je onderscheid, boven de zeven krijg je de schaal nauwelijks nog in woorden.
Even of oneven: de vraag naar het midden
Een oneven aantal stappen heeft een midden, een even aantal dwingt tot kiezen. De keuze hangt ervan af of een middenpositie inhoudelijk bestaat: bij „Hoe tevreden ben je over de begeleiding?” bestaat echte twijfel, bij „Zou je deze workshop aanraden?” eigenlijk niet.
De GESIS Survey Guidelines vatten samen dat de meeste onderzoekers aanraden de middencategorie aan te bieden. Niet uit gemakzucht, maar om de gegevens: ontbreekt het midden, dan wijken respondenten met een werkelijk neutrale houding uit naar een buurstap en kantelt je verdeling een kant op die er niet is.
Bij bipolaire schalen speelt nog iets extra’s. Het midden kan daar twee dingen betekenen: onverschilligheid in de zin van „geen van beide”, of ambivalentie in de zin van „deels dit, deels dat”. Oplossen laat zich dat alleen met een losse, apart gezette categorie.
Hoe het CBS het oplost
Het Centraal Bureau voor de Statistiek kiest per onderwerp een andere lengte. Voor vertrouwen in organisaties gebruikt het onderzoek Sociale samenhang vier stappen zonder midden, van heel veel vertrouwen tot helemaal geen vertrouwen. Voor de ernst van een probleem staan er juist vijf stappen, met een midden dat volledig is uitgeschreven (CBS, vragenlijsten Sociale Samenhang en Welzijn). Daaruit volgt een bruikbare regel: het midden komt erin als het iets betekent, en anders niet.
Let op
„Weet niet” en „wil ik niet zeggen” zijn geen schaalstappen en horen niet in het midden. Hun plaats is apart, onder aan de antwoordlijst, en in de analyse tellen ze als ontbrekende waarde. Of je ze aanbiedt, hangt volgens de GESIS Survey Guidelines af van het onderwerp, de manier van afnemen en je doelgroep. Dezelfde bron verwijst naar onderzoek van Sturgis en collega’s: zonder die optie gebruiken respondenten de middencategorie als vervanging.
Gratis enquête maken
Met empirio.ai maak je in enkele minuten een moderne online enquête — met hosting in de EU.
- Enquête met AI
- Aanpassen met drag & drop
- Analyse in realtime
De stappen benoemen: welke woorden je gebruikt
Benoem elke stap, niet alleen de twee uiteinden. De GESIS Survey Guidelines spreken zich uit voor volledig verbaal benoemde schalen, omdat die de betrouwbaarheid en de validiteit verhogen en omdat respondenten ze prettiger vinden.
Goede stapwoorden voldoen aan vier voorwaarden: ze zijn precies, ze verdelen zich symmetrisch over evenveel positieve als negatieve stappen, ze zijn voor iedereen begrijpelijk en hun onderlinge afstanden voelen ongeveer gelijk. De laatste voorwaarde is veruit de lastigste, want „vaak” en „soms” liggen voor de een dichter bij elkaar dan voor de ander.
Precies daaraan heeft Bernd Rohrmann in 1978 empirisch gewerkt: hij stelde voor het Duits reeksen woorden op waarvan de afstanden zo gelijkmatig mogelijk uitvallen. Gekalibreerd zijn die reeksen voor het Duits, en daarom laten ze zich niet vertalen. Een woord dat in het Duits precies tussen twee andere in ligt, doet dat in het Nederlands niet vanzelf. Verbale gradaties zijn taalgebonden, en die gelijkheid claimen zonder eigen vooronderzoek is fout.
Nederlandse antwoordreeksen uit een echte enquête
Voor het Nederlands kijk je dus beter naar reeksen die in een landelijke enquête al hun werk doen. Het CBS gebruikt in de vragenlijst van het onderzoek Sociale samenhang onder meer de vier reeksen hieronder, en samen dekken ze de meeste onderwerpen die jij zult meten (CBS, vragenlijst Sociale samenhang 2024):
- Instemming: helemaal eens, eens, niet eens, niet oneens, oneens, helemaal oneens
- Frequentie: dagelijks, wekelijks, maandelijks, minder dan maandelijks, nooit
- Ernst: geen probleem, een klein probleem, geen klein, maar ook geen groot probleem, een groot probleem, een heel groot probleem
- Vertrouwen: heel veel vertrouwen, tamelijk veel vertrouwen, niet zo veel vertrouwen, helemaal geen vertrouwen
Twee kanttekeningen horen erbij. Ten eerste zijn dit geen voorschriften, maar reeksen die het CBS voor zijn eigen vragen koos. Ten tweede werkt een reeks pas als de stappen voor jouw doelgroep ongeveer even ver uit elkaar liggen. Laat vijf mensen je lijst invullen en vraag ze daarna hoe ze de middelste stap lazen.
Tip
Vraag naar de zaak zelf in plaats van naar instemming. Dus niet „Ik gebruik enquêtes vaak” met een instemmingsschaal, maar „Hoe vaak gebruik je enquêtes?” met de frequentiereeks hierboven. De GESIS Survey Guidelines raden instemmingsschalen af, omdat ze hogere instemming opleveren dan een directe vraag.
Een beoordelingsschaal analyseren: welk kengetal mag je rapporteren?
Rapporteer altijd eerst de frequentieverdeling, dus hoeveel mensen elke stap hebben gekozen. Die opgave mag op elk meetniveau en ze laat juist de dingen zien die ieder los kengetal verbergt.
Een voorbeeld maakt dat concreet. Twee workshops worden door 24 deelnemers beoordeeld op een schaal van 1 tot en met 7, en allebei komen ze uit op een gemiddelde van 4,0. Bij de eerste koos iedereen een 4. Bij de tweede gaf de helft een 2 en de andere helft een 6. Ook de mediaan redt het niet, die is in beide gevallen 4. Pas de verdeling laat het verschil zien.
| Kengetal | Wanneer het past | Wat het laat zien |
|---|---|---|
| Frequentieverdeling | altijd | hoe vaak elke stap is gekozen |
| Modus | altijd | de meest gekozen stap |
| Mediaan | bij een losse schaalvraag | het middelste antwoord |
| Gemiddelde | bij een schaalscore | doorsnee over meerdere items |
| Standaardafwijking | bij een schaalscore | hoe ver de antwoorden uiteenlopen |
| Top-two box | voor rapportage en presentatie | aandeel van de twee hoogste stappen |
Verboden is het gemiddelde daarmee niet, maar het vraagt wel om onderbouwing. Bij één losse vraag is de mediaan de voorzichtige keuze, omdat die alleen een rangorde veronderstelt. Bij een schaalscore uit meerdere items is het gemiddelde gebruikelijk en verdedigbaar, mits je de gelijke afstanden in je methodehoofdstuk als aanname benoemt.
Voor vergelijkingen tussen groepen geldt dezelfde tweedeling: losse vragen vergelijk je met rangordemethoden, schaalscores ook met methoden die op gemiddelde en spreiding steunen. Waar de grens loopt, staat in ons artikel over beschrijvende en inferentiële statistiek.
De top-two box duikt in praktijkrapporten overal op: de twee meest instemmende stappen worden één percentage, bijvoorbeeld „81 procent is tevreden of zeer tevreden”. Toegestaan is dat, maar het kost informatie. Wie zo rapporteert, zet de volledige verdeling in de bijlage.
Veelgemaakte fouten bij beoordelingsschalen
De meeste zwakke plekken van een beoordelingsschaal ontstaan bij het formuleren, niet bij het rekenen. Antwoordtendensen heten in het enquêteonderzoek de verschijnselen waarbij respondenten hun antwoord los van de inhoud een kant op schuiven. Wie er last van heeft, schuift een voorspelbare kant op, en daarom middelen ze elkaar niet weg.
Vier patronen zijn goed gedocumenteerd en samengevat in de GESIS Survey Guidelines over antwoordtendensen (Bogner en Landrock 2015). Tegen geen van vieren helpt een grotere steekproef, wel een betere vragenlijst.
De neiging naar het midden trekt antwoorden naar binnen
Sommige respondenten kiezen los van de inhoud de middelste stappen, simpelweg omdat dat minder denkwerk kost. Het gevolg is een verdeling die evenwichtiger oogt dan de houdingen werkelijk zijn. Een volledig benoemde schaal helpt, want die maakt het kiezen makkelijker. Bestaat er inhoudelijk geen middenpositie, dan is een even aantal stappen de eenvoudigste oplossing.
De instemmingstendens laat respondenten overal ja zeggen
Acquiescentie heet de neiging om het met uitspraken eens te zijn ongeacht wat er staat, dus overal „eens” of „ja” aan te kruisen. De GESIS Survey Guidelines noemen daar maar één echt werkzaam middel tegen: geen instemmingsschalen gebruiken en rechtstreeks naar het kenmerk vragen. Wie toch bij instemmingsschalen blijft, formuleert de helft van de stellingen omgekeerd. Zichtbaar wordt de tendens daarmee wel, maar correlaties en factorstructuren redt het niet.
Sociale wenselijkheid maakt gevoelige vragen mooier
Bij onderwerpen die respondenten als gevoelig ervaren, geven ze het verwachte antwoord in plaats van het kloppende. Gedrag buiten de norm wordt kleiner gemaakt, gedrag erbinnen groter. Goed nieuws voor online enquêtes: volgens de GESIS Survey Guidelines valt deze tendens kleiner uit wanneer er geen interviewer bij is. Verdwijnen doet het effect daarmee niet, het wordt alleen zwakker.
Extreme antwoorden hangen niet alleen aan het onderwerp
Extreme antwoorden vormen de tegenhanger van de neiging naar het midden, dus de neiging om los van de inhoud de buitenste stappen te kiezen. Meten laat zich dat als aandeel extreme antwoorden over meerdere schalen heen. Of er een stabiele persoonlijke eigenschap achter zit, is in het onderzoek niet beslecht. Wel aangetoond is dat schriftelijke en online enquêtes er volgens de GESIS Survey Guidelines minder last van hebben dan interviews.
Eén onopvallende fout gaat tot slot over de vormgeving. Stappen moeten optisch even ver uit elkaar staan, anders vallen het inhoudelijke en het zichtbare midden uiteen. Meer knoppen om aan te draaien staan in ons artikel met tips voor online enquêtes.
Conclusie
Een beoordelingsschaal is snel ingebouwd en net zo snel bedorven. Vijf volledig benoemde stappen, een bewuste keuze over het midden en een even bewuste over de weet-niet-optie leveren je meer datakwaliteit op dan elke extra respondent.
Bij de analyse geldt één regel: de verdeling hoort altijd in het rapport, het gemiddelde alleen met onderbouwing. Voor je woordkeuze is de nuchterste route de Nederlandse, namelijk kijken hoe een landelijke enquête het formuleert en dat daarna op je eigen doelgroep testen.
Hoe je verdergaat
- Wil je alle meetniveaus in samenhang zien? Meetniveau bepalen
- Werk je met instemmingsstellingen? Likertschaal
- Zoek je het passende antwoordformat? Vraagtypen in enquêtes
- Bevraag je je eigen team over tevredenheid? Medewerkerstevredenheid meten
Wil je je schaal uitproberen voordat hij de deur uitgaat?
Bij empirio.ai, een online enquêtetool uit Duitsland, zet je een geordende schaal in een paar minuten op en zie je na een handvol testantwoorden of de verdeling draagt wat je wilt zeggen.
