Stell dir vor, du liest in einer Umfrage die Aussage „Ich fühle mich in meinem Verein gut aufgehoben“ und darunter stehen fünf Kästchen, von „trifft gar nicht zu“ bis „trifft völlig zu“. Fast jeder hat so etwas schon angekreuzt, ohne den Namen dafür zu kennen.
Der Name lautet Likert-Skala. Eine Likert-Skala misst Einstellungen, indem du mehreren Aussagen zum selben Thema dieselbe abgestufte Antwortskala gibst, meist fünf oder sieben Stufen von klarer Ablehnung bis klarer Zustimmung, und die Antworten der einzelnen Aussagen anschließend zu einem einzigen Wert pro befragter Person zusammenrechnest. Am Ende dieses Artikels weißt du, wie viele Stufen deine Skala braucht, wie du sie beschriftest und was du mit den Zahlen danach rechnen darfst.
📌 Das Wichtigste im Überblick
- Rensis Likert stellte das Verfahren 1932 in seiner Dissertation vor.
- Eine einzelne Frage ist ein Likert-Item, noch keine Likert-Skala.
- Fünf bis sieben Stufen empfehlen die GESIS Survey Guidelines.
- Jede Stufe bekommt ein Wort, nicht nur die beiden Enden.
- Likert selbst hat gleiche Abstände zwischen den Stufen nie behauptet.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Was ist eine Likert-Skala?
Eine Likert-Skala ist ein Messverfahren aus der Sozialforschung, bei dem Befragte mehreren Aussagen zum selben Thema zustimmen oder widersprechen, jeweils in denselben Abstufungen. Aus den Einzelantworten entsteht anschließend ein Summen- oder Mittelwert, der die Einstellung dieser Person beschreibt.
Entwickelt hat das Verfahren der amerikanische Sozialpsychologe Rensis Likert. Er beschrieb es 1932 in seiner Dissertation an der Columbia University, erschienen als Heft 140 der Reihe Archives of Psychology unter dem Titel A Technique for the Measurement of Attitudes. Sein Ziel war ausdrücklich Sparsamkeit, denn die etablierten Verfahren seiner Zeit verlangten aufwendige Vorstudien, und er wollte wissen, ob es auch einfacher geht. Es ging. Seine Skala zur Einstellung gegenüber internationalen Beziehungen erreichte mit 24 Aussagen dieselbe Zuverlässigkeit wie ein konkurrierendes Verfahren mit 44 Aussagen (Likert 1932, S. 33). Halb so viele Fragen, gleich verlässliches Ergebnis, und genau deshalb steckt das Verfahren heute in fast jedem Fragebogen.
In der Psychologie heißt ein solches Instrument psychometrische Skala. Sie misst ein Merkmal, das sich nicht direkt beobachten lässt, über Antworten, die sich beobachten lassen. Einstellung, Zufriedenheit oder Motivation kannst du niemandem ansehen. Was du sehen kannst, ist, welches Kästchen jemand ankreuzt.
Likert-Item und Likert-Skala sind nicht dasselbe
Dieser Unterschied wird im Alltag fast immer übergangen, auch in Lehrmaterial. Eine einzelne Frage mit fünf Abstufungen ist ein Likert-Item. Die Likert-Skala entsteht erst, wenn du mehrere solcher Items zum selben Merkmal stellst und ihre Werte zu einer Zahl zusammenfasst. Likert schreibt das im Original unmissverständlich: Jede Aussage sei „a scale in itself“, und die Einzelwerte würden anschließend über Median oder Mittelwert kombiniert (Likert 1932, S. 24).
Praktisch heißt das: Wenn du die Zufriedenheit mit deinem Kurs mit genau einer Frage misst, hast du ein Likert-Item erhoben. Wenn du sechs Aussagen zu Inhalt, Tempo, Betreuung, Material, Raum und Organisation stellst und daraus einen Zufriedenheitswert bildest, hast du eine Likert-Skala gebaut. Der Unterschied ist nicht akademische Erbsenzählerei, er entscheidet darüber, was du später rechnen darfst.
Ein einzelnes Ankreuzfeld ist ein Item. Eine Skala wird daraus erst durch mehrere Items und eine gemeinsame Auswertung.
Unser Literaturtipp: Likerts Originalarbeit ist frei zugänglich und mit 55 Seiten deutlich kürzer, als der Ruf des Klassikers vermuten lässt. Wer in einer Abschlussarbeit sauber zitieren will, kommt an ihr ohnehin nicht vorbei.
Likert-Skala: Beispiele für gute Antwortskalen
Die häufigste Frage in der Praxis lautet nicht, was eine Likert-Skala ist, sondern wie die Stufen heißen sollen. Für das Deutsche gibt es dafür eine belastbare Vorlage: Bernd Rohrmann entwickelte 1978 in der Zeitschrift für Sozialpsychologie Standardbeschriftungen für vier Kontinua, auf die auch die GESIS Survey Guidelines ausdrücklich verweisen.
Der Vorteil solcher geprüften Formulierungen liegt darin, dass die Abstände zwischen den Wörtern von den Befragten halbwegs einheitlich verstanden werden. Selbst gebastelte Stufen wie „eher schon“ oder „geht so“ leisten das nicht, weil jeder etwas anderes darunter versteht.
| Kontinuum | Wofür | Die fünf Stufen |
|---|---|---|
| Bewertung | Zustimmung zu einer Aussage | trifft … zu: gar nicht, wenig, teils-teils, ziemlich, völlig |
| Häufigkeit | wie oft etwas vorkommt | nie, selten, gelegentlich, oft, immer |
| Intensität | wie stark etwas wirkt | gar nicht, wenig, mittelmäßig, überwiegend, völlig |
| Wahrscheinlichkeit | wie sicher etwas eintritt | keinesfalls, wahrscheinlich nicht, vielleicht, ziemlich wahrscheinlich, ganz sicher |
Beschriftungen nach Rohrmann (1978), nachlesbar beim Staatsinstitut für Schulqualität und Bildungsforschung Bayern.
Die Zustimmungsskala und ihr Haken
Daneben steht die Variante, die den meisten zuerst einfällt: stimme überhaupt nicht zu, stimme nicht zu, teils, teils, stimme zu, stimme voll und ganz zu. Sie ist verbreitet und sofort verständlich, erzeugt aber nachweislich mehr Zustimmung als eine Skala, die direkt nach der Sache fragt (Menold und Bogner 2016).
Überall dort, wo du statt „Kurze Wartezeiten sind mir wichtig: stimme zu“ auch „Wie wichtig sind dir kurze Wartezeiten: sehr wichtig bis gar nicht wichtig“ fragen kannst, ist die zweite Form die bessere Wahl. Das ist einer der wenigen Ratschläge zur Fragebogengestaltung, der in der Methodenliteratur unstrittig ist und in der Praxis trotzdem fast nie befolgt wird.
Die Zufriedenheitsskala
Für Zufriedenheit ist die gängige fünfstufige Fassung: sehr unzufrieden, eher unzufrieden, teils, teils, eher zufrieden, sehr zufrieden. Sie ist ausgewogen, weil links und rechts von der Mitte gleich viele Stufen liegen.
Genau diese Symmetrie ist die Bedingung dafür, dass die Mitte auch als Mitte gelesen wird. Eine Skala mit drei positiven und zwei negativen Stufen verschiebt das Ergebnis, ohne dass jemand es merkt, weil die optische Mitte dann nicht mehr die inhaltliche Mitte ist.
Wie viele Stufen braucht eine Likert-Skala?
Fünf bis sieben Stufen sind der Richtwert. Die GESIS Survey Guidelines fassen den Forschungsstand zusammen und empfehlen genau diese Spanne, weil Skalen dieser Länge zugleich zuverlässig messen, fein genug unterscheiden und von Befragten bevorzugt werden (Menold und Bogner 2016).
Dahinter steckt ein Abwägen zwischen zwei Fehlern. Zu wenige Stufen zwingen unterschiedliche Meinungen in dasselbe Kästchen, dann verschwindet genau der Unterschied, den du messen wolltest. Zu viele Stufen machen die einzelne Stufe bedeutungslos, denn wer könnte erklären, worin sich Stufe 8 und Stufe 9 einer Elferskala unterscheiden?
Fünf, sechs oder sieben Stufen: was das jeweils ändert
Die ungerade Zahl hat eine Mitte, die gerade Zahl hat keine. Das ist der eigentliche Unterschied, nicht die Feinheit der Abstufung. Eine sechsstufige Likert-Skala ist deshalb vor allem eine erzwungene Entscheidung: Wer unentschieden ist, muss sich trotzdem auf eine Seite schlagen.
Ob das gut oder schlecht ist, hängt vom Zweck ab. In einer Evaluation, die Verbesserungen anstoßen soll, ist eine erzwungene Tendenz oft hilfreich, weil eine Kolonne mittlerer Kreuze niemandem weiterhilft. In einer Meinungsumfrage, in der echte Unentschiedenheit ein Ergebnis ist, verfälscht sie.
Braucht deine Skala eine neutrale Mitte?
Die Mittelkategorie ist die meistdiskutierte Einzelentscheidung beim Skalenbau, und sie hat auf beiden Seiten gute Argumente. Beide lassen sich in wenigen Zeilen gegeneinanderstellen.
Was die Mitte leistet
- Wer wirklich unentschieden ist, kann das ausdrücken.
- Neutrale Befragte weichen nicht auf eine falsche Nachbarstufe aus.
- Die Skala bleibt links und rechts symmetrisch.
Was du dafür in Kauf nimmst
- Die Mitte wird auch aus Bequemlichkeit angekreuzt.
- Manche wählen sie, statt „weiß nicht“ zu sagen.
- Die Auswertung unterscheidet beide Gründe nicht.
Die GESIS Survey Guidelines wägen genau diese Punkte ab und kommen zu einer klaren Empfehlung: Die Mitte gehört angeboten, weil der Schaden durch verdrängte neutrale Meinungen größer ausfällt als der Schaden durch bequeme Mittelkreuze (Menold und Bogner 2016).
Kurios ist dabei, dass Rensis Likert diese Frage nie diskutiert hat. In seiner Arbeit von 1932 taucht die Mittelkategorie „undecided“ ausschließlich als Rechenanweisung auf, nämlich mit dem Wert 3 (Likert 1932, Anhang). Die ganze Debatte über den neutralen Punkt ist erst nach ihm entstanden.
Likert-Skala erstellen: Schritt für Schritt
Eine Likert-Skala baust du nicht, indem du eine Frage schreibst und fünf Kästchen danebensetzt. Du baust sie, indem du ein Merkmal in mehrere Aussagen zerlegst, die alle dasselbe meinen, aber unterschiedlich ansetzen.
Die folgenden sechs Schritte funktionieren für eine Kursevaluation genauso wie für den empirischen Teil einer Abschlussarbeit. Rechne für den ersten Schritt mehr Zeit ein als für alle anderen zusammen.
- Merkmal festlegen. Schreibe in einem Satz auf, was du messen willst. „Zufriedenheit mit dem Kurs“ ist ein Merkmal, „Meinung zum Kurs“ ist keins.
- Aussagen formulieren. Fünf bis zehn kurze Sätze, jeder mit genau einem Gedanken. Zwei Themen in einem Satz machen die Antwort unbrauchbar.
- Einen Teil umpolen. Formuliere einige Aussagen negativ, damit auffällt, wer stumpf immer dieselbe Spalte ankreuzt. Diesen Kniff beschreibt Likert bereits 1932 im Anhang seiner Arbeit.
- Skala wählen und beibehalten. Entscheide dich einmal für fünf oder sieben Stufen und benutze im ganzen Fragebogen dieselbe.
- Alle Stufen beschriften. Jede Stufe bekommt ein Wort, nicht nur die beiden Enden. Zahlen allein reichen nicht.
- Testlauf machen. Lass fünf Personen ausfüllen, die dein Thema nicht kennen, und frage danach, wie sie die mittlere Stufe verstanden haben.
Technisch ist eine Likert-Skala eine Matrixfrage: mehrere Aussagen untereinander, dieselbe Antwortskala daneben. In empirio.ai, einem Online-Umfrage-Tool aus Deutschland, legst du sie als Matrix-Frage an und definierst die Skala nur einmal für alle Aussagen. Wie du den Rest des Bogens drumherum aufbaust, steht im Beitrag zum Fragebogen erstellen.

Genau diese Bauform meint der Begriff Matrixfrage: Die Skala steht einmal als Spaltenkopf, und jede Zeile darunter ist eine eigene Aussage zum selben Merkmal. Die vier Zeilen im Beispiel ergeben zusammen einen Zufriedenheitswert, eine einzelne Zeile für sich ergibt nur ein Likert-Item.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Welches Skalenniveau hat eine Likert-Skala?
Ein einzelnes Likert-Item ist ordinalskaliert. Du weißt, dass „stimme zu“ mehr Zustimmung bedeutet als „teils, teils“, aber du weißt nicht, ob der Abstand zwischen diesen beiden Stufen genauso groß ist wie der zwischen „teils, teils“ und „stimme nicht zu“.
Der Summenwert aus mehreren Items wird in der Forschungspraxis dagegen meist wie eine metrische Größe behandelt, also so, als wären die Abstände gleich. Das ist eine Konvention mit Begründung, keine mathematische Wahrheit: Je mehr Items in den Wert einfließen, desto feiner wird die entstehende Skala, und desto weniger fällt die Ungleichheit der einzelnen Schritte ins Gewicht.
Wenn du die Begriffe nachschlagen willst: Die Ordinalskala kennt nur eine Rangfolge, die Intervallskala zusätzlich gleiche Abstände. Welche Rechenoperationen an welcher Stufe hängen, steht im Überblick zum Skalenniveau.
Was Rensis Likert selbst dazu geschrieben hat
An dieser Stelle lohnt ein Blick ins Original, weil dort etwas anderes steht, als häufig behauptet wird. Likert hat gleiche Abstände ausdrücklich nur für sein aufwendiges Sigma-Verfahren beansprucht, nicht für die einfache Vergabe der Zahlen 1 bis 5.
Seine Tabelle II zeigt beides nebeneinander. Zu den fünf Stufen einer seiner Aussagen gehören die Sigma-Werte −1,63, −0,43, +0,43, +0,99 und +1,76 (Likert 1932, S. 23). Die Abstände betragen also 1,20, dann 0,86, dann 0,56, dann 0,77. Wer stattdessen 1, 2, 3, 4, 5 vergibt, unterstellt viermal denselben Abstand. Likert wusste das und begründete die Vereinfachung rein praktisch: Beide Verfahren korrelierten mit +0,99, deshalb sei die einfache Rechnung „for all ordinary purposes“ vertretbar (Likert 1932, S. 43).
Für dich folgt daraus zweierlei. Erstens gibt es auf die Frage „ordinal oder metrisch“ keine einzige richtige Antwort, sondern eine Entscheidung. Zweitens brauchst du für diese Entscheidung keinen Streit, sondern eine Regel, an die du dich hältst und die du im Methodenteil deiner Arbeit begründest.
Setzt eine Likert-Skala eine Normalverteilung voraus?
Nein, deine erhobenen Daten müssen nicht normalverteilt sein, damit du eine Likert-Skala einsetzen darfst. Diese Verwechslung entsteht daran, dass Likert für seine Sigma-Rechnung annahm, Einstellungen seien in der Bevölkerung annähernd normalverteilt.
Er schrieb aber gleich dazu, die Gefahren dieser Annahme seien ihm vollständig bewusst, sie sei nur ein experimenteller Zwischenschritt und müsse durch weitere Untersuchungen entweder überflüssig gemacht oder bestätigt werden (Likert 1932, S. 22). Für die einfache Auswertung mit den Zahlen 1 bis 5 spielt die Annahme ohnehin keine Rolle. Relevant wird Normalverteilung erst dann wieder, wenn du bestimmte statistische Tests auf deine Skalenwerte anwenden willst.
Likert-Skala auswerten: Median, Mittelwert oder Häufigkeiten?
Die Auswertung hängt daran, ob du ein einzelnes Item oder eine Skala aus mehreren Items vor dir hast. Diese eine Unterscheidung erspart dir die meisten Diskussionen mit deiner Betreuung.
Bei einem einzelnen Item ist die Häufigkeitsverteilung die ehrlichste Darstellung, also der Anteil der Befragten je Stufe. Dazu passen Median (= der Wert in der Mitte aller geordneten Antworten) und Modus (= die am häufigsten gewählte Stufe). Ein Mittelwert über ein einzelnes ordinales Item ist angreifbar, weil er gleiche Abstände unterstellt, die du nicht belegen kannst.
Bei einer Skala aus mehreren Items bildest du zuerst den Summen- oder Mittelwert pro Person und rechnest anschließend mit diesem Wert weiter. Genau so hat Likert es vorgeschlagen (Likert 1932, S. 26). Vorher prüfst du, ob die Items überhaupt dasselbe messen, üblicherweise über Cronbachs Alpha. Welche Verfahren danach infrage kommen, steht im Überblick zu den Auswertungsmethoden.
Likert-Skala dichotomisieren: die Top-Two-Box
In der Marktforschung ist es üblich, die beiden zustimmenden Stufen zu einer einzigen Kennzahl zusammenzufassen, der sogenannten Top-Two-Box. Aus „stimme zu“ und „stimme voll und ganz zu“ wird dann ein Prozentwert, der sich in einer Präsentation leicht berichten lässt.
Das ist zulässig und oft sinnvoll, kostet aber Information. Sobald du zusammenfasst, siehst du nicht mehr, ob die Zustimmung aus überzeugten oder aus vorsichtigen Antworten besteht. Berichte deshalb beides, die Top-Two-Box und die vollständige Verteilung.
💡 Tipp
Speichere bei der Auswertung immer mit, wie viele Personen eine Aussage übersprungen haben. Ein Mittelwert aus 40 Antworten und einer aus 120 sehen in der Tabelle gleich aus und sind es nicht.
Typische Fehler bei Likert-Skalen
Die folgenden fünf Fehler begegnen einem in Vereinsumfragen genauso wie in Bachelorarbeiten. Sie fallen alle erst in der Auswertung auf, wenn die Antworten schon da sind und sich nichts mehr ändern lässt.
Gemeinsam ist ihnen, dass sie sich vor dem Versand in einer halben Stunde beheben lassen. Danach nicht mehr.
Zustimmung abfragen, wo eine Sachfrage möglich wäre
Skalen vom Typ „stimme zu, stimme nicht zu“ erzeugen systematisch mehr Zustimmung als Skalen, die direkt nach der Sache fragen. Die GESIS Survey Guidelines nennen den Effekt Zustimmungstendenz und empfehlen deshalb, gegenstandsspezifische Skalen zu bevorzugen (Menold und Bogner 2016). Statt „Ich bin mit dem Kurs zufrieden: stimme zu“ fragst du besser „Wie zufrieden bist du mit dem Kurs: sehr zufrieden bis sehr unzufrieden“.
Nur die beiden Enden beschriften
Eine Skala, bei der links „sehr unzufrieden“ und rechts „sehr zufrieden“ steht und dazwischen nur Zahlen, ist schnell gebaut und schlechter. Vollständig beschriftete Skalen erreichen höhere Zuverlässigkeit und Gültigkeit, und Befragte bevorzugen sie. Besonders profitieren Menschen mit niedrigem oder mittlerem formalem Bildungsabschluss (Menold und Bogner 2016).
Mit Minuswerten nummerieren
Eine Nummerierung von −2 bis +2 sieht symmetrisch aus, wirkt aber nicht so. Befragte meiden die negative Seite und antworten insgesamt positiver, als sie es bei einer Nummerierung von 1 bis 5 täten. Die GESIS Survey Guidelines raten deshalb ausdrücklich von negativen Zahlenwerten in Ratingskalen ab (Menold und Bogner 2016).
Die Skala unterwegs wechseln
Wenn die erste Hälfte deiner Aussagen fünf Stufen hat und die zweite sieben, kannst du beide nicht gemeinsam auswerten. Genauso wenig darfst du die Reihenfolge einmal von Ablehnung nach Zustimmung und einmal umgekehrt anordnen, ohne die Werte vor der Auswertung umzupolen.
Zwei Aussagen in einem Satz
„Der Kurs war gut strukturiert und verständlich“ misst zwei Dinge. Wer die Struktur gut fand und die Erklärungen nicht, kann nicht antworten und kreuzt die Mitte an. Likert hat solche Doppelaussagen bereits 1932 als Ausschlusskriterium beschrieben. Wie du Fragen sauber trennst, steht im Beitrag zu den Fragetypen in Umfragen.
Fazit
Die Likert-Skala ist so verbreitet, weil sie mit wenig Aufwand zuverlässig misst, und sie wird so oft falsch eingesetzt, weil sie so einfach aussieht. Wenn du dir zwei Dinge merkst, hast du die meisten Fallstricke hinter dir: Eine Skala braucht mehrere Aussagen, und jede Stufe braucht ein Wort. Alles andere, von der Stufenzahl bis zur Mittelkategorie, ist eine Abwägung, die du in deiner Methodik begründen kannst. Nur eine Behauptung solltest du niemandem abnehmen, auch keinem Lehrbuch: dass die Abstände zwischen den Stufen gleich seien. Rensis Likert selbst hat das nie behauptet.
Wie es weitergeht
- Du willst die Skalenarten sortieren? Ratingskala: unipolar, bipolar und wie viele Stufen
- Du brauchst das passende Skalenniveau? Skalenniveau bestimmen und richtig rechnen
- Du baust gerade den ganzen Fragebogen? Fragebogen erstellen: Aufbau und Reihenfolge
- Du willst wissen, ob deine Ergebnisse tragen? Objektivität, Reliabilität und Validität
Skala steht, Umfrage fehlt noch?
Mit empirio.ai, einem Online-Umfrage-Tool aus Deutschland, legst du deine Likert-Aussagen als Matrixfrage an und teilst die Umfrage als Link oder QR-Code.
