Kaum ein Kapitel einer Bachelorarbeit wird so schnell überflogen und so streng benotet wie der Methodenteil. Ob deine Auswertung als Befund gilt oder als blosser Eindruck, entscheidet sich an den Gütekriterien, und qualitative Forschung misst hier mit anderen Massstäben als quantitative.
Gütekriterien sind die Massstäbe, an denen sich prüfen lässt, ob eine Untersuchung wissenschaftlich brauchbar ist. Quantitative Forschung stützt sich auf Objektivität, Reliabilität und Validität. Für qualitative Forschung existiert kein einheitlicher Katalog, sondern mehrere konkurrierende Vorschläge, am bekanntesten die sechs Kriterien von Philipp Mayring. Nach diesem Beitrag kennst du den Katalog, der zu deiner Methode passt, und kannst deine Wahl begründen.
📌 Das Wichtigste im Überblick
- Quantitative Forschung stützt sich auf Objektivität, Reliabilität und Validität.
- Mayring nennt sechs allgemeine Gütekriterien qualitativ orientierter Forschung.
- Steinke führt sieben Kernkriterien, Lincoln und Guba nur vier.
- Ein verbindlicher Katalog für qualitative Forschung fehlt bis heute.
- International zählt Objektivität nicht zu den Hauptgütekriterien.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Gütekriterien: was der Begriff in der Forschung bedeutet
Gütekriterien sind Massstäbe, mit denen sich die Qualität einer wissenschaftlichen Untersuchung beurteilen lässt. Beantwortet wird damit die Frage, ob ein Ergebnis auf dem gewählten Verfahren beruht oder auf der Person, die es angewendet hat.
Zwischen einer Alltagsbeobachtung und einer wissenschaftlichen Aussage liegt genau dieser Unterschied. «Die Stimmung im Team ist gekippt» beschreibt eine Wahrnehmung. Erst wenn offenliegt, mit welchem Instrument, an welchen Personen und nach welchen Regeln der Satz entstanden ist, wird daraus ein Befund, über den sich fachlich streiten lässt.
Ein Gütekriterium ist dabei keine Vorschrift, sondern eine wissenschaftliche Konvention. Weder ein Gesetz noch ein Studienreglement schreibt vor, welche Kriterien in einer Bachelor- oder Masterarbeit zu prüfen sind. Bewertet wird ohnehin nicht, ob du alle erfüllst, sondern ob du benennen kannst, welche du erfüllst und wo deine Erhebung an ihre Grenzen stösst. Massgeblich bleibt im Zweifel die Vorgabe deines Instituts.
Wo die Gütekriterien in der Gliederung stehen, ist ebenfalls offen. Üblich sind zwei Orte: ein eigener Unterpunkt im Kapitel zum Forschungsdesign oder ein Abschnitt in der Reflexion des eigenen Vorgehens. Vorzüge und Nachteile beider Varianten beschreibt der Beitrag zu Objektivität, Reliabilität, Validität.
Objektivität, Reliabilität und Validität in der quantitativen Forschung
Die Gütekriterien quantitativer Forschung heissen Objektivität, Reliabilität und Validität. Nacheinander beantworten sie drei Fragen: Hängt das Ergebnis an der messenden Person, wie gross ist der Messfehler, und wird überhaupt das gemeinte Merkmal erfasst?
| Gütekriterium | Die Frage dahinter | Woran du es festmachst |
|---|---|---|
| Objektivität | Hängt das Ergebnis an der Person? | feste Regeln für Durchführung, Auswertung, Interpretation |
| Reliabilität | Wie gross ist der Messfehler? | Reliabilitätskoeffizient zwischen 0 und 1 |
| Validität | Wird das gemeinte Merkmal gemessen? | inhaltliche, konstruktbezogene und kriterienbezogene Belege |
Die Reihenfolge der drei ist kein Zufall, sondern eine Kette. Eine unzuverlässige Messung kann nicht gültig sein, und eine Erhebung, bei der jede auswertende Person zu einem anderen Wert kommt, liefert kaum zuverlässige Werte. Umgekehrt gilt der Satz nicht: Eine Waage, die konstant zwei Kilogramm zu viel anzeigt, misst zuverlässig und trotzdem falsch. Wie sich die drei Kriterien im Einzelnen prüfen lassen, steht ausführlich im Beitrag zu Objektivität, Reliabilität, Validität.

Nebengütekriterien: warum kaum zwei Listen deckungsgleich sind
Neben den drei Hauptgütekriterien führt die Testtheorie weitere Anforderungen, die meist Nebengütekriterien heissen. Welche das genau sind, hängt vom Lehrbuch ab, in das du schaust. Fast alle Zusammenfassungen im Netz lassen diesen Punkt weg, und genau er erklärt, warum du in zwei Quellen zwei verschiedene Listen findest.
| Nebengütekriterium | Lienert und Raatz (1998) | Moosbrugger und Kelava (2020) |
|---|---|---|
| Normierung | ✓ | ✕ |
| Vergleichbarkeit | ✓ | ✕ |
| Ökonomie | ✓ | ✓ |
| Nützlichkeit | ✓ | ✓ |
| Zumutbarkeit | ✕ | ✓ |
| Unverfälschbarkeit | ✕ | ✓ |
| Fairness | ✕ | ✓ |
✕ bedeutet: Das Kriterium taucht in dieser Quelle nicht als eigener Listenpunkt auf. Die Normierung führen Moosbrugger und Kelava 2020 nicht separat, sondern ordnen sie der Interpretationsobjektivität zu.
Helfried Moosbrugger und Augustin Kelava haben den Zuschnitt ihrer Liste mit der 3. Auflage verändert. Standen in der 2. Auflage von 2012 noch zehn Gütekriterien nebeneinander, trennen die beiden in Kapitel 2 der 3. Auflage von «Testtheorie und Fragebogenkonstruktion» (Springer, 2020) zwischen «allgemeinen» und «speziellen, testtheoriebasierten» Gütekriterien. Zu den allgemeinen zählen dort die drei Objektivitätsarten sowie Ökonomie, Nützlichkeit, Zumutbarkeit, Fairness und Unverfälschbarkeit, zu den speziellen Reliabilität und Validität. Richtig sind beide Zählweisen mit demselben Recht: Stützt du dich auf die 2. Auflage von 2012, kommst du auf zehn Gütekriterien, nimmst du die 3. Auflage von 2020, auf eine anders geschnittene Liste.
Was das Prüfungsglossar der ETH Zürich zusätzlich führt
Einen dritten Zuschnitt liefert die Lehrentwicklung der ETH Zürich, und er deckt sich mit keiner der beiden Lehrbuchlisten. Als Nebengütekriterien nennt das Glossar Prüfungen der ETH Zürich Fairness, Unverfälschbarkeit, Ökonomie, Transparenz, Augenscheinvalidität und Zumutbarkeit. Transparenz und Augenscheinvalidität stehen weder bei Lienert und Raatz noch bei Moosbrugger und Kelava, Normierung und Vergleichbarkeit fehlen dafür an der ETH. Nenne deshalb Quelle und Auflage, aus der dein Katalog stammt, statt von «den Nebengütekriterien» zu schreiben, als gäbe es nur einen.
Die sechs Gütekriterien qualitativer Forschung nach Mayring
Die bekanntesten Gütekriterien qualitativer Forschung stammen von Philipp Mayring und sind sechs an der Zahl: Verfahrensdokumentation, argumentative Interpretationsabsicherung, Regelgeleitetheit, Nähe zum Gegenstand, kommunikative Validierung und Triangulation. An die Stelle einer Messung tritt bei ihm kein Ersatzmass, sondern die Pflicht, jeden Schritt offenzulegen.
Für Verwirrung sorgt regelmässig die Jahreszahl, denn Mayrings Buch ist seit 1990 in sieben Auflagen erschienen. Nachzulesen sind die Kriterien in «Einführung in die qualitative Sozialforschung», zuletzt in der 7. Auflage von 2023 (Beltz), dort in Abschnitt 6.3, der sechs allgemeine Gütekriterien qualitativer Forschung aufführt.
- Verfahrensdokumentation: Festgehalten wird das Vorgehen so genau, dass Aussenstehende es nachvollziehen können, samt Vorwissen, Erhebung und Auswertungsregeln.
- Argumentative Interpretationsabsicherung: Deutungen von Interviewmaterial lassen sich nicht nachrechnen. Begründet werden sie deshalb am Material selbst.
- Regelgeleitetheit: Die Analyse folgt einem vorab festgelegten Ablauf. Abweichungen sind erlaubt, werden aber dokumentiert und begründet.
- Nähe zum Gegenstand: Erhoben wird in der Alltagswelt der untersuchten Personen. Ein Vertrauensverhältnis gehört zur Methode und ist kein Störfaktor.
- Kommunikative Validierung: Ergebnisse und Deutungen gehen noch einmal an die Befragten zurück. Zustimmung ist ein Argument für die Deutung, kein Beweis.
- Triangulation: Betrachtet wird der Gegenstand aus mehr als einer Perspektive, über zwei Methoden, zwei Datenquellen, zwei Theorien oder zwei forschende Personen.
Bei interpretativem Vorgehen hält Mayring die Beurteilerübereinstimmung für besonders wichtig, also die Frage, ob zwei Personen dasselbe Material gleich kodieren. An dieser einen Stelle seines Katalogs steht eine Zahl.
💡 Tipp
Gib fünf deiner Interviewpassagen einer zweiten Person zum unabhängigen Kodieren und vergleiche danach die Ergebnisse. Schon diese kleine Stichprobe zeigt, ob dein Kategoriensystem trägt, und liefert dir einen belastbaren Satz für den Methodenteil. Ohne einen solchen Abgleich bleibt die Verfahrensdokumentation eine Behauptung.
Weitere Kataloge: Steinke sowie Lincoln und Guba
Neben Mayring kursieren drei weitere Kataloge, die in Abschlussarbeiten regelmässig auftauchen: die sieben Kernkriterien von Ines Steinke, die vier Kriterien von Yvonna Lincoln und Egon Guba sowie die fünf Kriterien aus dem Jahr 2018, die auf Jörg Strübing und vier Mitautorinnen und Mitautoren zurückgehen.
Welchen du wählst, ist keine Geschmacksfrage, sondern hängt an deinem Vorgehen. Wer mit der qualitativen Inhaltsanalyse arbeitet, greift naheliegend zu Mayring, weil beides aus derselben Werkstatt stammt. Geht es um die Bewertung eines Forschungsprozesses im Ganzen, bietet Steinke den breiteren Rahmen. Und wer überwiegend englischsprachige Literatur zitiert, kommt an Lincoln und Guba ohnehin nicht vorbei.
Die sieben Kernkriterien nach Ines Steinke
Ines Steinke legt sieben Kernkriterien vor: intersubjektive Nachvollziehbarkeit, Indikation des Forschungsprozesses, empirische Verankerung, Limitation, Kohärenz, Relevanz und reflektierte Subjektivität. Nachzuschlagen sind sie unter anderem im Dorsch Lexikon der Psychologie (Hogrefe), das den Katalog auf Steinke (1999) datiert.
Intersubjektive Nachvollziehbarkeit trägt bei Steinke den ganzen Katalog. Gemeint ist, dass eine aussenstehende Person allein anhand deiner Dokumentation beurteilen kann, wie du zu deinen Ergebnissen gekommen bist. Steinke nennt drei Wege dorthin: den Forschungsprozess gründlich dokumentieren, das Material in einer Gruppe interpretieren und kodifizierte Verfahren anwenden. Zwei Jahreszahlen kursieren, weil der Katalog 1999 als Monografie bei Juventa erschien und kurz darauf als Beitrag im Handbuch von Flick, von Kardorff und Steinke.
Die vier Kriterien von Lincoln und Guba
Yvonna Lincoln und Egon Guba schlagen in «Naturalistic Inquiry» (Sage, 1985) vier Kriterien vor, die sie unter dem Begriff trustworthiness bündeln. Im deutschsprachigen Ratgeberumfeld werden die beiden erstaunlich selten genannt, obwohl fast jede englischsprachige Methodenliteratur auf sie zurückgreift.
| Kriterium | Deutsche Entsprechung | Quantitatives Gegenstück |
|---|---|---|
| Credibility | Glaubwürdigkeit | interne Validität |
| Transferability | Übertragbarkeit | externe Validität |
| Dependability | Zuverlässigkeit | Reliabilität |
| Confirmability | Bestätigbarkeit | Objektivität |
Die Gegenüberstellung in der rechten Spalte stammt von Lincoln und Guba selbst; sie führen ihre vier Kriterien ausdrücklich als grobe Entsprechungen zu den konventionellen Begriffen ein. Die deutschen Bezeichnungen in der mittleren Spalte gehen auf Bortz und Döring zurück und stehen so in den Lehrmaterialien der Abteilung Methodenlehre der Universität Mainz. Gemeint ist in beiden Fällen eine Übersetzungshilfe, keine Gleichsetzung: Credibility fragt, ob deine Deutung zum Material passt, interne Validität dagegen, ob ein Ursachenschluss trägt. Vier Jahre später ergänzten Guba und Lincoln in «Fourth Generation Evaluation» (Sage, 1989) fünf weitere Kriterien unter dem Stichwort authenticity, die im deutschsprachigen Raum kaum aufgegriffen wurden.
Kostenlos Umfrage erstellen
Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.
- Umfrage per KI
- Per Drag & Drop anpassen
- Auswertung in Echtzeit
Weshalb ein verbindlicher Katalog bis heute fehlt
Einen verbindlichen Katalog für qualitative Forschung gibt es nicht, weil sich die Fachwelt bis heute nicht auf einen geeinigt hat. Der Grund liegt in der Sache selbst: Qualitative Verfahren sind bewusst offen angelegt, und ein einheitlicher Standard würde genau die Offenheit beschneiden, die ihren Zweck ausmacht.
Wie lebendig der Streit geblieben ist, zeigt der jüngste Anlauf. Jörg Strübing hat 2018 zusammen mit vier Kolleginnen und Kollegen in der Zeitschrift für Soziologie fünf Kriterien vorgeschlagen: Gegenstandsangemessenheit, empirische Sättigung, theoretische Durchdringung, Originalität und textuelle Performanz. Der Beitrag trägt den Untertitel «Ein Diskussionsanstoß», und genau das wurde er. In derselben Zeitschrift erschienen Repliken, von denen eine schon im Titel die Möglichkeit allgemeiner Gütekriterien bezweifelt.
Studierenden empfiehlt die Arbeitsstelle QUASUS der Pädagogischen Hochschule Freiburg inzwischen ausdrücklich die fünf Kriterien von Strübing und Kollegen als Orientierung. Steinkes Katalog sei zwar breit, lasse aber offen, welche Kriterien besonders zählen. Für deine eigene Arbeit ist diese Uneinigkeit keine schlechte Nachricht, sondern eine Erleichterung.
Ein begründet gewählter Katalog, konsequent angewendet, zählt mehr als eine vollständige Aufzählung aller vier.
Objektivität als Sonderweg des deutschsprachigen Raums
Objektivität als drittes Hauptgütekriterium ist eine Besonderheit des deutschsprachigen Raums. Die massgebliche englischsprachige Referenz, die «Standards for Educational and Psychological Testing», führt im Grundlagenteil drei Kapitel, und Objektivität ist keines davon.
Herausgegeben werden diese Standards gemeinsam von der American Educational Research Association, der American Psychological Association und dem National Council on Measurement in Education. Die Ausgabe von 2014 gliedert ihren ersten Teil in Validity, Reliability/Precision and Errors of Measurement sowie Fairness in Testing. Fairness, im deutschsprachigen Kanon ein Nebengütekriterium, steht dort gleichrangig neben den beiden anderen.
An Schweizer Hochschulen sitzt die Dreierfolge dagegen fest. Die Teaching Tools der Universität Zürich bringen sie auf drei Fragen: Wer misst, wie wird gemessen, was wird gemessen? Die erste Frage zielt auf die Objektivität, die zweite auf die Reliabilität, die dritte auf die Validität. Das Prüfungsglossar der ETH Zürich ordnet die drei zusätzlich hierarchisch: Validität setzt Reliabilität voraus, Reliabilität setzt Objektivität voraus. In der englischsprachigen Systematik fehlt dieser Kette schlicht das erste Glied.
Für deine Arbeit hat der Unterschied zwei praktische Folgen. Findest du in englischsprachiger Literatur kein Wort zur Objektivität, ist das kein Versäumnis der Quelle, sondern ein Unterschied in der Systematik. Und schreibst du selbst auf Englisch, übersetze Objektivität nicht einfach mit objectivity, sondern beschreibe, was gemeint ist: standardisierte Durchführung, Auswertung und Interpretation.
Drei Fehler, die im Methodenteil Punkte kosten
Die meisten Abzüge im Methodenteil entstehen nicht durch schwache Kennwerte, sondern durch Sätze, die mehr behaupten, als die Daten hergeben. Drei Muster tauchen dabei besonders häufig auf.
Gemeinsam ist ihnen, dass ein Gütekriterium für etwas in Anspruch genommen wird, wofür es nicht gemacht ist. Wer die Kataloge sauber auseinanderhält, umgeht alle drei fast von allein, und der Methodenteil wird dabei kürzer statt länger.
Objektivität mit der Erhebungssituation verwechseln
Objektivität meint Unabhängigkeit von der forschenden Person, nicht Unabhängigkeit von der Umgebung. Häufig liest man, eine Erhebung sei objektiv gewesen, weil sie in einem neutralen Raum stattfand. Ein neutraler Raum betrifft aber die Durchführungsbedingungen. Objektiv wird eine Erhebung erst dadurch, dass Instruktion, Auswertungsregeln und Interpretationsregeln vorab feststehen und für alle Befragten gleich gelten.
Mayring und Steinke mit der falschen Jahreszahl zitieren
Mayrings «Einführung in die qualitative Sozialforschung» ist erstmals 1990 erschienen und liegt seit 2023 in der 7. Auflage vor. Steinkes Kernkriterien gibt es als Monografie von 1999 und als Handbuchbeitrag, der je nach benutzter Auflage mit 2000, 2008 oder 2010 datiert wird. Zitiert wird immer die Auflage, die du tatsächlich in der Hand hattest. Zwei verschiedene Jahre für dieselbe Quelle im selben Verzeichnis fallen sofort auf.
Einen Katalog aufzählen, ohne ihn auf die eigene Arbeit zu beziehen
Eine Liste der sechs Kriterien nach Mayring ist noch keine Prüfung der eigenen Güte. Bewertet wird, ob du für jedes Kriterium sagen kannst, wie du es eingelöst hast und wo du an eine Grenze gestossen bist. Ein Satz wie «Eine kommunikative Validierung war aus Zeitgründen nicht möglich, weshalb die Deutungen ausschliesslich argumentativ abgesichert wurden» wiegt schwerer als eine vollständige Aufzählung ohne Bezug.
Fazit
Für die quantitative Forschung ist die Frage nach den Gütekriterien beantwortet, für die qualitative nicht, und darin liegt kein Mangel, sondern das Ergebnis einer laufenden Fachdebatte. Wähle einen Katalog, nenne die Quelle, aus der er stammt, und arbeite ihn an deiner eigenen Erhebung durch. Mehr verlangt ein guter Methodenteil nicht.
Wie es weitergeht
- Brauchst du die drei quantitativen Kriterien im Detail? Objektivität, Reliabilität, Validität: Definition, Beispiel
- Unsicher, welcher Ansatz zu deiner Frage passt? Qualitativ vs. quantitativ: Definition und Unterschiede
- Führst du Interviews statt einer Umfrage? Qualitative Befragung: Definition, Formen und Ablauf
- Suchst du das passende Auswertungsverfahren? Auswertungsmethoden: welches Verfahren zu deinen Daten passt
- Willst du den ganzen Ablauf im Blick behalten? Empirische Forschung: Definition, Methoden, Leitfaden
Unser Literaturtipp: Mayring, Philipp (2023): Einführung in die qualitative Sozialforschung. 7. Auflage. Beltz: Weinheim und Basel. Kapitel 6 behandelt die Gütekriterien kompakt und bleibt der kürzeste seriöse Einstieg ins Thema. Für die quantitative Seite: Moosbrugger, Helfried und Kelava, Augustin (Hrsg.) (2020): Testtheorie und Fragebogenkonstruktion. 3. Auflage. Springer: Berlin und Heidelberg.
Soll deine Erhebung bei allen Befragten identisch ablaufen?
Mit empirio.ai, einem Online-Umfrage-Tool aus Deutschland, bekommen alle Teilnehmenden denselben Fragebogen in derselben Reihenfolge, und die Antworten liegen sofort strukturiert vor. Die Durchführungsobjektivität ist damit weitgehend gesichert. Für die Regeln der Auswertung und der Interpretation bleibst du zuständig.
