Drei Personen beurteilen dieselbe Präsentation mit Gut, Befriedigend und Genügend. Klar ist danach, wem sie am besten gefallen hat. Offen bleibt, ob der Schritt von Gut auf Befriedigend derselbe ist wie der von Befriedigend auf Genügend.
Diese offene Stelle ist das Thema der Ordinalskala. Eine Ordinalskala ist ein Skalenniveau, das die Ausprägungen eines Merkmals in eine echte Rangordnung stellt, ohne über die Größe der Abstände zwischen den Rängen etwas zu behaupten. Tragfähig sind deshalb Reihenfolge, Median und Quartile, während das arithmetische Mittel eine Annahme braucht, die du begründen musst. Nach diesem Beitrag erkennst du jedes ordinale Merkmal in deinem Fragebogen.
📌 Das Wichtigste im Überblick
- Die Ordinalskala reiht Kategorien, ohne ihre Abstände festzulegen.
- Prüfungsnote, höchster Abschluss und Zufriedenheitsstufe sind ordinalskaliert.
- Median und Quartile halten, das arithmetische Mittel nur unter einer Annahme.
- Passend sind Mann-Whitney-U-Test, Kruskal-Wallis-Test und Rangkorrelation.
- Die Stufe „weiß nicht“ gehört aus der Reihe heraus.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Was ist eine Ordinalskala?
Eine Ordinalskala ist ein Skalenniveau, auf dem sich die Ausprägungen eines Merkmals nicht nur voneinander abgrenzen, sondern zusätzlich reihen lassen. Über zwei Antworten sind deshalb drei Aussagen möglich: größer, kleiner oder gleich. Wie weit sie auseinanderliegen, bleibt unbestimmt.
Der Begriff geht auf das lateinische ordo zurück, also Ordnung oder Reihe. Genau darin unterscheidet sich diese Stufe von der Nominalskala: Beide sortieren in Kategorien, nur die Ordinalskala behauptet dazu eine Reihenfolge. Das Statistik-Skriptum der WU Wien formuliert das knapp: Zwischen den einzelnen Merkmalsausprägungen gibt es eine natürliche Rangordnung, Differenzen lassen sich aber nicht quantifizieren (WU Wien, Beschreibende Statistik).
Die vier Skalenniveaus stammen vom Psychologen S. S. Stevens, der sie 1946 in der Zeitschrift Science veröffentlicht hat. Die Ordinalskala entsteht bei ihm aus der Operation des Rangordnens, und als klassisches Beispiel führt er die Härteskala der Minerale an (Stevens 1946). Dass Talk weicher ist als Quarz, lässt sich nachprüfen. Um wie viel weicher, gibt die Skala nicht her.
Eine Ordinalskala sagt dir, wer vorn liegt. Um wie viel, sagt sie nicht.
Trichotomie und Transitivität: die zwei Bedingungen einer Rangordnung
Eine Rangordnung hält nur, wenn zwei Bedingungen zutreffen. Die erste heißt Trichotomie: Für zwei beliebige Ausprägungen gilt entweder a größer b oder b größer a oder a gleich b, und stets genau eine dieser drei Möglichkeiten. Die zweite heißt Transitivität: Ist a größer als b und b größer als c, dann muss a ebenfalls größer als c sein.
Beide Bedingungen wirken einleuchtend und gehen in Fragebögen trotzdem regelmäßig verloren. Eine Zufriedenheitsskala, die neben den Stufen von sehr zufrieden bis sehr unzufrieden auch „trifft auf mich nicht zu“ anbietet, verletzt die Trichotomie, weil diese Antwort zu keiner anderen in einem Größer-Kleiner-Verhältnis steht. Wo die Ordinalskala zwischen den übrigen Stufen liegt, zeigt der Überblick zum Skalenniveau.
Beispiele für ordinalskalierte Merkmale
Ordinalskaliert sind alle Merkmale, deren Ausprägungen eine anerkannte Reihenfolge mitbringen, ohne dass die Abstände dazwischen feststehen: Prüfungsnote, höchster Abschluss, Zufriedenheit in Stufen, Platzierung bei einem Bewerb, Einkommensklasse, Bonitätsnote einer Ratingagentur oder die Lawinenwarnstufe.
Die Übersicht zeigt drei davon mit ihren Ausprägungen und dazu jenen Satz, der daraus gerade nicht folgt. Das ist die schnellste Probe im Alltag, denn der unzulässige Satz fällt fast immer früher auf als die richtige Einordnung.
| Merkmal | Mögliche Ausprägungen | Was daraus nicht folgt |
|---|---|---|
| Prüfungsnote | Sehr gut bis Nicht genügend | „von 1 auf 2 ist derselbe Schritt wie von 3 auf 4“ |
| Abschluss | Lehrabschluss, Matura, Bachelor | „die Matura ist doppelt so viel wie der Lehrabschluss“ |
| Platzierung | erster, zweiter, dritter Platz | „zwischen 1 und 2 lag so viel wie zwischen 2 und 3“ |
Zwei Bauformen: vergebene Ränge und geordnete Kategorien
Ordinale Daten kommen auf zwei Wegen zustande und die Unterscheidung spart dir später Arbeit. Direkt vergebene Ränge entstehen bei einer Reihungsfrage, etwa wenn Befragte fünf Angebote in eine Reihenfolge bringen sollen. Jeder Rang taucht dann pro Person nur ein einziges Mal auf und ausgewertet wird über Rangplätze.
Geordnete Kategorien gibst du dagegen selbst vor, etwa die Stufen von sehr zufrieden bis sehr unzufrieden. Viele Personen wählen dieselbe Stufe, je Kategorie entstehen Häufigkeiten und darauf setzen Median und Quartile auf. Eine Reihungsfrage mit acht Positionen bringt übrigens keine acht Antworten, sondern eine einzige geordnete Reihe pro Person, was in der Datei anders aussieht als gedacht.
Wenn aus einem metrischen Merkmal ein ordinales wird
Alter und Einkommen sind von Haus aus metrisch, solange der genaue Wert erhoben wird. Sobald du nach Altersgruppen oder Einkommensklassen fragst, liegen ordinale Daten vor, obwohl es weiterhin um dieselbe Sache geht. Verantwortlich dafür ist die Antwortvorgabe: Aus „37 Jahre“ wird „30 bis 39“ und wo genau innerhalb der Klasse jemand liegt, ist danach nicht mehr rekonstruierbar. Der Weg führt ausschließlich in diese Richtung, aus Klassen werden nie wieder Einzelwerte.
Ordinalskala, Nominalskala oder metrisch: die Abgrenzung in zwei Fragen
Das Skalenniveau eines Merkmals klärst du mit zwei Fragen in fester Reihenfolge und die erste trennt nominal von ordinal. Sie lautet: Ist eine Ausprägung von sich aus mehr, höher oder besser als eine andere? Fällt die Antwort nein aus, liegt eine Nominalskala vor.
Die zweite Frage trennt ordinal von metrisch: Sind die Abstände zwischen benachbarten Werten nachweislich gleich groß? Fällt auch hier die Antwort nein aus, bleibt es bei der Ordinalskala. Am Wort nachweislich hängt alles, denn eine von 1 bis 5 durchnummerierte Skala sieht nach gleichen Abständen aus und belegt sie nicht. Bleibt die Zuordnung strittig, nimmst du die niedrigere Stufe und begründest sie im Methodenteil.
Die Probe an drei Merkmalen
- Studienrichtung: keine Reihenfolge, also Nominalskala.
- Höchster Abschluss: Reihenfolge ja, gleiche Abstände nein, also Ordinalskala.
- Temperatur in Grad Celsius: gleiche Abstände nachweisbar, also Intervallskala.
Der Abschluss ist ordinal, die Studienrichtung ist nominal
Beide Merkmale bestehen aus einer Liste von Namen und sehen dadurch gleich aus. Der Abschluss trägt jedoch eine anerkannte Stufung vom Lehrabschluss über die Matura bis zum Studium, und diese Stufung gehört zur Sache und nicht zur Sortierung im Fragebogen. Wer ihn als nominal verbucht, verliert diese Information und kann anschließend keinen Median berichten, obwohl die Daten ihn hergeben. Bei der Studienrichtung dagegen steht Psychologie weder über noch unter Maschinenbau, jede Reihung wäre dort erfunden.
Was du mit ordinalskalierten Daten rechnen darfst
Mit ordinalskalierten Daten sind alle Verfahren erlaubt, die zählen oder sortieren, und alle ausgeschlossen, die feste Abstände brauchen. Stevens hat diese Zuordnung 1946 in einer Tabelle notiert und der Ordinalskala genau zwei Kennzahlen zugewiesen: den Median und die Perzentile. Dasselbe steht im Skriptum der WU Wien, wo der Median ausdrücklich dem ordinalen Skalenniveau zugeordnet ist und das arithmetische Mittel dem metrischen.
Zulässig sind außerdem sämtliche Umformungen, die die Reihenfolge bewahren. Stevens nennt diese Gruppe die isotone Gruppe: Jede streng monoton steigende Funktion darf auf die Werte angewendet werden, ohne dass die Skala ihre Aussage einbüßt. Praktisch heißt das, du kannst die Stufen 1 bis 5 durch 10, 20, 40, 80 und 160 ersetzen oder gleich durch die Buchstaben A bis E. Solange die Reihenfolge steht, bleibt die Information dieselbe und daran siehst du, dass die Zahlen hier keine Mengen bezeichnen.
| Rechenweg | Ordinalskala | Begründung |
|---|---|---|
| Absolute und relative Häufigkeit | ✓ | Zählen setzt keine Abstände voraus |
| Modus | ✓ | die am häufigsten besetzte Stufe |
| Median | ✓ | braucht nur eine Rangordnung |
| Quartile und Perzentile | ✓ | beruhen ebenfalls auf Rängen |
| Rangkorrelation nach Spearman | ✓ | rechnet mit Rangplätzen statt Werten |
| Arithmetisches Mittel und Standardabweichung | ✕ | setzen gleich große Abstände voraus |
| Korrelation nach Pearson | ✕ | rechnet mit Abweichungen vom Mittel |
| Verhältnisse wie „doppelt so gut“ | ✕ | brauchen einen absoluten Nullpunkt |
Der Median bei gerader Fallzahl: die Interpolationsfalle
Bei einer geraden Zahl von Antworten liegen zwei Werte in der Mitte und Tabellenkalkulationen mitteln die beiden stillschweigend. Aus den Stufen „teils, teils“ und „stimme zu“ wird dann der Median 3,5, also eine Stufe, die es in deinem Fragebogen nicht gibt. Stevens hat davor ausdrücklich gewarnt: Einen Wert durch lineare Interpolation innerhalb eines Klassenintervalls zu bestimmen, sei bei rangskalierten Daten streng genommen unzulässig, weil die Gleichabständigkeit der Skala ja gerade zur Debatte steht.
Nenne bei gerader Fallzahl deshalb die untere der beiden mittleren Kategorien und die obere gleich dazu. Ein Satz wie „Der Median liegt bei ‚teils, teils‘, die obere Nachbarkategorie ist ‚stimme zu‘“ ist ehrlicher als jede Nachkommastelle und in der Prüfung leichter zu vertreten.
Die Quartilsspanne statt der Standardabweichung
Zur Streuung ordinaler Daten passt die Spanne zwischen dem unteren und dem oberen Quartil, weil beide Quartile als Perzentile auf dieser Stufe zulässig sind. Sie zeigt, in welchem Bereich die mittleren 50 Prozent der Antworten liegen. Berichte sie als Spanne von Kategorie zu Kategorie: „Die mittleren 50 Prozent liegen zwischen ‚teils, teils‘ und ‚stimme zu‘.“
Die Differenz der beiden Quartile als einzelne Zahl auszurechnen, also den Interquartilsabstand im engeren Sinn, geht dagegen bereits einen Schritt zu weit, denn subtrahieren lässt sich nur, was gleich große Abstände hat. Die Standardabweichung scheidet ohnehin aus, weil sie auf dem Mittel aufbaut. Welche Auswertungsstufen es sonst gibt, steht im Beitrag zu deskriptiver Statistik und Inferenzstatistik.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Darf man bei ordinalskalierten Daten das arithmetische Mittel bilden?
Das arithmetische Mittel verlangt gleich große Abstände zwischen den Werten und genau die liefert eine Ordinalskala nicht. Als Lagemaß passt es hier also nicht, und in einer Diplom- oder Bachelorarbeit ist der Median die Angabe, die niemand angreifen kann.
Häufig liest man, Stevens habe das Rechnen mit Mittelwerten auf Ordinaldaten untersagt. In seinem Aufsatz von 1946 steht etwas anderes und deutlich Genaueres. Er hält fest, streng genommen sollten Mittel und Standardabweichung dort nicht zum Einsatz kommen, führt für dieses Vorgehen aber eine Art pragmatische Duldung an, weil es in vielen Fällen brauchbare Ergebnisse liefere. Ein Verbot hielt er ausdrücklich für wenig sinnvoll. Im selben Absatz steht die Bedingung, auf die es ankommt: Der Fehler wächst in genau dem Maß, in dem die aufeinanderfolgenden Abstände ungleich sind.
Für deine Arbeit ergibt sich daraus eine handhabbare Regel. Häufigkeiten und Median gehören immer in den Bericht, weil sie ohne Zusatzannahme auskommen. Ein Mittelwert darf zusätzlich dastehen, wenn deine Antwortstufen sprachlich gleichmäßig abgestuft sind und du die Annahme im Methodenteil offenlegst. Bei einem einzelnen Item bleibt er angreifbar, bei einer Skala aus mehreren Items gilt er in der Forschungspraxis als vertretbar. Die ganze Abwägung steht im Beitrag zur Likert-Skala.
⚠️ Achtung
Ein Notendurchschnitt ist derselbe Fall, nur fällt er niemandem auf. Prüfungsnoten sind ordinalskaliert, gemittelt wird trotzdem, im Zeugnis wie in der Studienordnung. In deiner Arbeit ist das kein Freibrief: Wenn du mittelst, schreib den Satz dazu, dass du die Stufen als gleich weit auseinanderliegend behandelst.
Welche Tests zu ordinalskalierten Daten passen
Zu ordinalskalierten Daten passen nichtparametrische Verfahren, die mit Rangplätzen statt mit Messwerten arbeiten. Eine Normalverteilung setzen sie nicht voraus und kommen deshalb auch mit kleinen oder schiefen Stichproben zurecht, wie sie bei studentischen Erhebungen die Regel sind.
Welches Verfahren passt, hängt an zwei Angaben: an der Zahl der Gruppen, die du vergleichst, und daran, ob diese Gruppen unabhängig sind oder dieselben Personen mehrfach gemessen wurden. Für jedes der folgenden Verfahren gilt ein mindestens ordinales Skalenniveau als Voraussetzung, während das metrische Gegenstück jeweils eine Normalverteilung verlangt.
| Verfahren | Wofür es gedacht ist | Metrisches Gegenstück |
|---|---|---|
| Mann-Whitney-U-Test | zwei unabhängige Gruppen vergleichen | t-Test für unabhängige Stichproben |
| Kruskal-Wallis-Test | mehr als zwei unabhängige Gruppen | einfaktorielle Varianzanalyse |
| Wilcoxon-Test | zwei Messungen derselben Gruppe | t-Test für verbundene Stichproben |
| Friedman-Test | mehr als zwei Messungen derselben Gruppe | Varianzanalyse mit Messwiederholung |
| Spearmans Rangkorrelation | Zusammenhang zweier Rangreihen | Korrelation nach Pearson |
Warum die Rangkorrelation bei Stevens in der falschen Zeile steht
Spearmans Rangkorrelation gilt heute als Standardverfahren für ordinale Zusammenhänge und in beinahe jeder Einführung steht sie in der Zeile der Ordinalskala. Bei Stevens selbst findet sie sich 1946 in der Zeile der Intervallskala und die Begründung steht in einer Klammer: Der Koeffizient unterstelle gleiche Abstände zwischen aufeinanderfolgenden Rängen und verlange daher eigentlich ein Intervallniveau. Durchgesetzt hat sich diese strenge Lesart nicht und für deine Arbeit zählt die heutige Praxis. Wer die Stelle kennt, versteht allerdings besser, warum die Zuordnung von Verfahren zu Skalenniveaus eine Konvention ist und kein Naturgesetz.
Ordinalskala im Fragebogen: die Antwortstufen entscheiden
Ob am Ende ordinale Daten vorliegen, entscheidet die Antwortvorgabe und nicht die Auswertung. Eine Frage liefert genau jenes Skalenniveau, das ihr Antwortformat hergibt, und nachträglich lässt sich ein Merkmal nur vergröbern, niemals verfeinern.
Fünf Punkte klärst du deshalb, bevor die Umfrage rausgeht. Zusammen kosten sie zehn Minuten und ersparen dir später die halbe Auswertung.
- Die Reihenfolge der Sache folgen lassen. Die Stufen stehen in jener Reihenfolge, die das Merkmal vorgibt, nicht in der, die beim Schreiben einfiel.
- Sprachlich gleichmäßig abstufen. Von „nie“ über „selten“ zu „manchmal“ ist gleichmäßiger als von „nie“ direkt zu „fast immer“.
- Ausweichkategorien aus der Reihe nehmen. „Weiß nicht“ und „keine Angabe“ gehören optisch abgesetzt und in der Auswertung als fehlender Wert behandelt.
- Klassengrenzen überschneidungsfrei setzen. Bei Altersgruppen heißt das 18 bis 24 und 25 bis 34, nicht 18 bis 25 und 25 bis 35.
- Vor dem Versand testen. Drei Personen aus der Zielgruppe sortieren die Stufen selbst, bevor die Frage live geht.

Punkt drei wird am häufigsten übergangen und richtet den größten Schaden an. Sobald „weiß nicht“ als weitere Stufe mitzählt, sitzt eine Kategorie in der Reihe, die weder über noch unter den anderen liegt, und bereits der Median wandert an die falsche Stelle. Bei empirio.ai, einem Online-Umfrage-Tool aus Deutschland, legst du eine solche Option als Ausweichantwort an, sodass sie in der Auswertung getrennt ausgewiesen wird. Welcher Fragetyp welche Daten bringt, zeigt die Übersicht zu den Fragetypen im Fragebogen.
💡 Tipp
Lies deine Antwortstufen einmal von unten nach oben vor. Fällt dabei eine Stufe auf, die nicht in die Reihe passt, steckt entweder eine Ausweichkategorie in der Skala oder es sind zwei Merkmale in einer Frage vermischt.
Typische Fehler bei der Ordinalskala
Die meisten Fehler rund um die Ordinalskala passieren nicht beim Rechnen, sondern eine Stufe davor, beim Einordnen des Merkmals. Ist diese Entscheidung einmal getroffen, folgt ihr alles Weitere und in der Auswertung fällt es niemandem mehr auf.
Bemerkenswert ist, dass die drei häufigsten Fälle in unterschiedliche Richtungen laufen. Einmal wird die Skala zu hoch eingeordnet und mit ihr gerechnet, als lägen Messwerte vor. Einmal wird sie zu niedrig eingeordnet und Information geht verloren. Und einmal stimmt die Einordnung, nur trägt die Skala selbst jene Rangordnung nicht, die der Auswertung unterstellt wird.
Rangplätze addieren
Wer die Platzierungen mehrerer Durchgänge zusammenzählt und teilt, behandelt Ränge wie Punkte. Das Ergebnis hängt dann davon ab, wie weit die Teilnehmenden im Einzelfall auseinanderlagen, und genau diese Information steckt in Rangplätzen nicht. Berichte stattdessen den Median der Platzierungen oder werte, sofern vorhanden, gleich die zugrunde liegenden Messwerte aus.
Ordinale Daten als nominal behandeln
Zufriedenheitsstufen, Häufigkeitsangaben wie nie, selten und oft oder der höchste Abschluss bringen eine Reihenfolge mit. Wer sie bloß auszählt, verschenkt Median, Quartile und alle Rangverfahren und kann danach keine Aussage über eine Richtung treffen. Die Prüfung dauert einen Augenblick: Lässt sich eine Ausprägung sinnvoll als mehr oder weniger bezeichnen, ist das Merkmal mindestens ordinal.
Die Skala in der Mitte aufbrechen
Eine fünfstufige Zustimmungsskala verträgt eine neutrale Mitte, keinesfalls aber eine inhaltlich fremde Stufe. Wird „teils, teils“ durch „kann ich nicht beurteilen“ ersetzt, bricht die Rangordnung an der empfindlichsten Stelle und beide Hälften der Skala sind nicht mehr vergleichbar. Wer eine Ausweichmöglichkeit braucht, hängt sie außerhalb der Skala an.
Fazit
Die Ordinalskala ist jene Stufe, auf der die meisten Fragebogendaten tatsächlich liegen, und zugleich die, deren Grenzen am häufigsten überschritten werden. Wer Häufigkeiten, Median und die Quartilsspanne berichtet, ist auf der sicheren Seite und sagt trotzdem alles, was die Daten hergeben. Was darüber hinausgeht, ist keine Rechnung, sondern eine Annahme, und Annahmen gehören in den Methodenteil.
Merk dir die eine Frage: Kenne ich die Reihenfolge, aber nicht die Abstände? Dann hast du eine Ordinalskala vor dir.
Wie es weitergeht
- Du willst wissen, wie die vier Stufen zusammenhängen? Skalenniveau bestimmen
- Dir fehlt die Stufe darunter? Nominalskala
- Du brauchst gleiche Abstände? Intervallskala
- Du stellst gerade deine Antwortstufen zusammen? Fragebogen erstellen
Willst du deine Antwortstufen vorher ausprobieren?
Bei empirio.ai legst du eine Frage mit geordneten Stufen in wenigen Minuten an, schickst sie an drei Testpersonen und änderst die Reihenfolge, bevor die echte Erhebung startet.
