empirio.ai

Gütekriterien qualitativer und quantitativer Forschung

Für qualitative Forschung konkurrieren mehrere Kataloge, für quantitative gelten eigene Hauptkriterien. Welche Quelle in deine Arbeit gehört, ordnen wir dir hier ein.

Autorin bei empirio.ai - Maria Malzewvon Maria MalzewAktualisiert am 31. August 2026Lesezeit 12 Min.

Kaum ein Kapitel einer Bachelorarbeit wird so schnell überflogen und so streng benotet wie der Methodenteil. Ob deine Auswertung als Befund gilt oder als blosser Eindruck, entscheidet sich an den Gütekriterien, und qualitative Forschung misst hier mit anderen Massstäben als quantitative.

Gütekriterien sind die Massstäbe, an denen sich prüfen lässt, ob eine Untersuchung wissenschaftlich brauchbar ist. Quantitative Forschung stützt sich auf Objektivität, Reliabilität und Validität. Für qualitative Forschung existiert kein einheitlicher Katalog, sondern mehrere konkurrierende Vorschläge, am bekanntesten die sechs Kriterien von Philipp Mayring. Nach diesem Beitrag kennst du den Katalog, der zu deiner Methode passt, und kannst deine Wahl begründen.


📌 Das Wichtigste im Überblick

  • Quantitative Forschung stützt sich auf Objektivität, Reliabilität und Validität.
  • Mayring nennt sechs allgemeine Gütekriterien qualitativ orientierter Forschung.
  • Steinke führt sieben Kernkriterien, Lincoln und Guba nur vier.
  • Ein verbindlicher Katalog für qualitative Forschung fehlt bis heute.
  • International zählt Objektivität nicht zu den Hauptgütekriterien.

Kostenlos Umfrage erstellen

Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.

  • Umfrage per KI
  • Per Drag & Drop anpassen
  • Auswertung in Echtzeit
Jetzt kostenlos starten

Gütekriterien: was der Begriff in der Forschung bedeutet

Gütekriterien sind Massstäbe, mit denen sich die Qualität einer wissenschaftlichen Untersuchung beurteilen lässt. Beantwortet wird damit die Frage, ob ein Ergebnis auf dem gewählten Verfahren beruht oder auf der Person, die es angewendet hat.

Zwischen einer Alltagsbeobachtung und einer wissenschaftlichen Aussage liegt genau dieser Unterschied. «Die Stimmung im Team ist gekippt» beschreibt eine Wahrnehmung. Erst wenn offenliegt, mit welchem Instrument, an welchen Personen und nach welchen Regeln der Satz entstanden ist, wird daraus ein Befund, über den sich fachlich streiten lässt.

Ein Gütekriterium ist dabei keine Vorschrift, sondern eine wissenschaftliche Konvention. Weder ein Gesetz noch ein Studienreglement schreibt vor, welche Kriterien in einer Bachelor- oder Masterarbeit zu prüfen sind. Bewertet wird ohnehin nicht, ob du alle erfüllst, sondern ob du benennen kannst, welche du erfüllst und wo deine Erhebung an ihre Grenzen stösst. Massgeblich bleibt im Zweifel die Vorgabe deines Instituts.

Wo die Gütekriterien in der Gliederung stehen, ist ebenfalls offen. Üblich sind zwei Orte: ein eigener Unterpunkt im Kapitel zum Forschungsdesign oder ein Abschnitt in der Reflexion des eigenen Vorgehens. Vorzüge und Nachteile beider Varianten beschreibt der Beitrag zu Objektivität, Reliabilität, Validität.

Objektivität, Reliabilität und Validität in der quantitativen Forschung

Die Gütekriterien quantitativer Forschung heissen Objektivität, Reliabilität und Validität. Nacheinander beantworten sie drei Fragen: Hängt das Ergebnis an der messenden Person, wie gross ist der Messfehler, und wird überhaupt das gemeinte Merkmal erfasst?

GütekriteriumDie Frage dahinterWoran du es festmachst
ObjektivitätHängt das Ergebnis an der Person?feste Regeln für Durchführung, Auswertung, Interpretation
ReliabilitätWie gross ist der Messfehler?Reliabilitätskoeffizient zwischen 0 und 1
ValiditätWird das gemeinte Merkmal gemessen?inhaltliche, konstruktbezogene und kriterienbezogene Belege

Die Reihenfolge der drei ist kein Zufall, sondern eine Kette. Eine unzuverlässige Messung kann nicht gültig sein, und eine Erhebung, bei der jede auswertende Person zu einem anderen Wert kommt, liefert kaum zuverlässige Werte. Umgekehrt gilt der Satz nicht: Eine Waage, die konstant zwei Kilogramm zu viel anzeigt, misst zuverlässig und trotzdem falsch. Wie sich die drei Kriterien im Einzelnen prüfen lassen, steht ausführlich im Beitrag zu Objektivität, Reliabilität, Validität.

Schematische Darstellung der drei Gütekriterien quantitativer Forschung: Objektivität, Reliabilität und Validität

Nebengütekriterien: warum kaum zwei Listen deckungsgleich sind

Neben den drei Hauptgütekriterien führt die Testtheorie weitere Anforderungen, die meist Nebengütekriterien heissen. Welche das genau sind, hängt vom Lehrbuch ab, in das du schaust. Fast alle Zusammenfassungen im Netz lassen diesen Punkt weg, und genau er erklärt, warum du in zwei Quellen zwei verschiedene Listen findest.

NebengütekriteriumLienert und Raatz (1998)Moosbrugger und Kelava (2020)
Normierung
Vergleichbarkeit
Ökonomie
Nützlichkeit
Zumutbarkeit
Unverfälschbarkeit
Fairness

✕ bedeutet: Das Kriterium taucht in dieser Quelle nicht als eigener Listenpunkt auf. Die Normierung führen Moosbrugger und Kelava 2020 nicht separat, sondern ordnen sie der Interpretationsobjektivität zu.

Helfried Moosbrugger und Augustin Kelava haben den Zuschnitt ihrer Liste mit der 3. Auflage verändert. Standen in der 2. Auflage von 2012 noch zehn Gütekriterien nebeneinander, trennen die beiden in Kapitel 2 der 3. Auflage von «Testtheorie und Fragebogenkonstruktion» (Springer, 2020) zwischen «allgemeinen» und «speziellen, testtheoriebasierten» Gütekriterien. Zu den allgemeinen zählen dort die drei Objektivitätsarten sowie Ökonomie, Nützlichkeit, Zumutbarkeit, Fairness und Unverfälschbarkeit, zu den speziellen Reliabilität und Validität. Richtig sind beide Zählweisen mit demselben Recht: Stützt du dich auf die 2. Auflage von 2012, kommst du auf zehn Gütekriterien, nimmst du die 3. Auflage von 2020, auf eine anders geschnittene Liste.

Was das Prüfungsglossar der ETH Zürich zusätzlich führt

Einen dritten Zuschnitt liefert die Lehrentwicklung der ETH Zürich, und er deckt sich mit keiner der beiden Lehrbuchlisten. Als Nebengütekriterien nennt das Glossar Prüfungen der ETH Zürich Fairness, Unverfälschbarkeit, Ökonomie, Transparenz, Augenscheinvalidität und Zumutbarkeit. Transparenz und Augenscheinvalidität stehen weder bei Lienert und Raatz noch bei Moosbrugger und Kelava, Normierung und Vergleichbarkeit fehlen dafür an der ETH. Nenne deshalb Quelle und Auflage, aus der dein Katalog stammt, statt von «den Nebengütekriterien» zu schreiben, als gäbe es nur einen.

Die sechs Gütekriterien qualitativer Forschung nach Mayring

Die bekanntesten Gütekriterien qualitativer Forschung stammen von Philipp Mayring und sind sechs an der Zahl: Verfahrensdokumentation, argumentative Interpretationsabsicherung, Regelgeleitetheit, Nähe zum Gegenstand, kommunikative Validierung und Triangulation. An die Stelle einer Messung tritt bei ihm kein Ersatzmass, sondern die Pflicht, jeden Schritt offenzulegen.

Für Verwirrung sorgt regelmässig die Jahreszahl, denn Mayrings Buch ist seit 1990 in sieben Auflagen erschienen. Nachzulesen sind die Kriterien in «Einführung in die qualitative Sozialforschung», zuletzt in der 7. Auflage von 2023 (Beltz), dort in Abschnitt 6.3, der sechs allgemeine Gütekriterien qualitativer Forschung aufführt.

  • Verfahrensdokumentation: Festgehalten wird das Vorgehen so genau, dass Aussenstehende es nachvollziehen können, samt Vorwissen, Erhebung und Auswertungsregeln.
  • Argumentative Interpretationsabsicherung: Deutungen von Interviewmaterial lassen sich nicht nachrechnen. Begründet werden sie deshalb am Material selbst.
  • Regelgeleitetheit: Die Analyse folgt einem vorab festgelegten Ablauf. Abweichungen sind erlaubt, werden aber dokumentiert und begründet.
  • Nähe zum Gegenstand: Erhoben wird in der Alltagswelt der untersuchten Personen. Ein Vertrauensverhältnis gehört zur Methode und ist kein Störfaktor.
  • Kommunikative Validierung: Ergebnisse und Deutungen gehen noch einmal an die Befragten zurück. Zustimmung ist ein Argument für die Deutung, kein Beweis.
  • Triangulation: Betrachtet wird der Gegenstand aus mehr als einer Perspektive, über zwei Methoden, zwei Datenquellen, zwei Theorien oder zwei forschende Personen.

Bei interpretativem Vorgehen hält Mayring die Beurteilerübereinstimmung für besonders wichtig, also die Frage, ob zwei Personen dasselbe Material gleich kodieren. An dieser einen Stelle seines Katalogs steht eine Zahl.

💡 Tipp

Gib fünf deiner Interviewpassagen einer zweiten Person zum unabhängigen Kodieren und vergleiche danach die Ergebnisse. Schon diese kleine Stichprobe zeigt, ob dein Kategoriensystem trägt, und liefert dir einen belastbaren Satz für den Methodenteil. Ohne einen solchen Abgleich bleibt die Verfahrensdokumentation eine Behauptung.

Weitere Kataloge: Steinke sowie Lincoln und Guba

Neben Mayring kursieren drei weitere Kataloge, die in Abschlussarbeiten regelmässig auftauchen: die sieben Kernkriterien von Ines Steinke, die vier Kriterien von Yvonna Lincoln und Egon Guba sowie die fünf Kriterien aus dem Jahr 2018, die auf Jörg Strübing und vier Mitautorinnen und Mitautoren zurückgehen.

Welchen du wählst, ist keine Geschmacksfrage, sondern hängt an deinem Vorgehen. Wer mit der qualitativen Inhaltsanalyse arbeitet, greift naheliegend zu Mayring, weil beides aus derselben Werkstatt stammt. Geht es um die Bewertung eines Forschungsprozesses im Ganzen, bietet Steinke den breiteren Rahmen. Und wer überwiegend englischsprachige Literatur zitiert, kommt an Lincoln und Guba ohnehin nicht vorbei.

Die sieben Kernkriterien nach Ines Steinke

Ines Steinke legt sieben Kernkriterien vor: intersubjektive Nachvollziehbarkeit, Indikation des Forschungsprozesses, empirische Verankerung, Limitation, Kohärenz, Relevanz und reflektierte Subjektivität. Nachzuschlagen sind sie unter anderem im Dorsch Lexikon der Psychologie (Hogrefe), das den Katalog auf Steinke (1999) datiert.

Intersubjektive Nachvollziehbarkeit trägt bei Steinke den ganzen Katalog. Gemeint ist, dass eine aussenstehende Person allein anhand deiner Dokumentation beurteilen kann, wie du zu deinen Ergebnissen gekommen bist. Steinke nennt drei Wege dorthin: den Forschungsprozess gründlich dokumentieren, das Material in einer Gruppe interpretieren und kodifizierte Verfahren anwenden. Zwei Jahreszahlen kursieren, weil der Katalog 1999 als Monografie bei Juventa erschien und kurz darauf als Beitrag im Handbuch von Flick, von Kardorff und Steinke.

Die vier Kriterien von Lincoln und Guba

Yvonna Lincoln und Egon Guba schlagen in «Naturalistic Inquiry» (Sage, 1985) vier Kriterien vor, die sie unter dem Begriff trustworthiness bündeln. Im deutschsprachigen Ratgeberumfeld werden die beiden erstaunlich selten genannt, obwohl fast jede englischsprachige Methodenliteratur auf sie zurückgreift.

KriteriumDeutsche EntsprechungQuantitatives Gegenstück
CredibilityGlaubwürdigkeitinterne Validität
TransferabilityÜbertragbarkeitexterne Validität
DependabilityZuverlässigkeitReliabilität
ConfirmabilityBestätigbarkeitObjektivität

Die Gegenüberstellung in der rechten Spalte stammt von Lincoln und Guba selbst; sie führen ihre vier Kriterien ausdrücklich als grobe Entsprechungen zu den konventionellen Begriffen ein. Die deutschen Bezeichnungen in der mittleren Spalte gehen auf Bortz und Döring zurück und stehen so in den Lehrmaterialien der Abteilung Methodenlehre der Universität Mainz. Gemeint ist in beiden Fällen eine Übersetzungshilfe, keine Gleichsetzung: Credibility fragt, ob deine Deutung zum Material passt, interne Validität dagegen, ob ein Ursachenschluss trägt. Vier Jahre später ergänzten Guba und Lincoln in «Fourth Generation Evaluation» (Sage, 1989) fünf weitere Kriterien unter dem Stichwort authenticity, die im deutschsprachigen Raum kaum aufgegriffen wurden.

Kostenlos Umfrage erstellen

Mit empirio.ai erstellst du in wenigen Minuten eine moderne Online-Umfrage – mit Hosting in der EU.

  • Umfrage per KI
  • Per Drag & Drop anpassen
  • Auswertung in Echtzeit
Jetzt kostenlos starten

Weshalb ein verbindlicher Katalog bis heute fehlt

Einen verbindlichen Katalog für qualitative Forschung gibt es nicht, weil sich die Fachwelt bis heute nicht auf einen geeinigt hat. Der Grund liegt in der Sache selbst: Qualitative Verfahren sind bewusst offen angelegt, und ein einheitlicher Standard würde genau die Offenheit beschneiden, die ihren Zweck ausmacht.

Wie lebendig der Streit geblieben ist, zeigt der jüngste Anlauf. Jörg Strübing hat 2018 zusammen mit vier Kolleginnen und Kollegen in der Zeitschrift für Soziologie fünf Kriterien vorgeschlagen: Gegenstandsangemessenheit, empirische Sättigung, theoretische Durchdringung, Originalität und textuelle Performanz. Der Beitrag trägt den Untertitel «Ein Diskussionsanstoß», und genau das wurde er. In derselben Zeitschrift erschienen Repliken, von denen eine schon im Titel die Möglichkeit allgemeiner Gütekriterien bezweifelt.

Studierenden empfiehlt die Arbeitsstelle QUASUS der Pädagogischen Hochschule Freiburg inzwischen ausdrücklich die fünf Kriterien von Strübing und Kollegen als Orientierung. Steinkes Katalog sei zwar breit, lasse aber offen, welche Kriterien besonders zählen. Für deine eigene Arbeit ist diese Uneinigkeit keine schlechte Nachricht, sondern eine Erleichterung.

Ein begründet gewählter Katalog, konsequent angewendet, zählt mehr als eine vollständige Aufzählung aller vier.

Objektivität als Sonderweg des deutschsprachigen Raums

Objektivität als drittes Hauptgütekriterium ist eine Besonderheit des deutschsprachigen Raums. Die massgebliche englischsprachige Referenz, die «Standards for Educational and Psychological Testing», führt im Grundlagenteil drei Kapitel, und Objektivität ist keines davon.

Herausgegeben werden diese Standards gemeinsam von der American Educational Research Association, der American Psychological Association und dem National Council on Measurement in Education. Die Ausgabe von 2014 gliedert ihren ersten Teil in Validity, Reliability/Precision and Errors of Measurement sowie Fairness in Testing. Fairness, im deutschsprachigen Kanon ein Nebengütekriterium, steht dort gleichrangig neben den beiden anderen.

An Schweizer Hochschulen sitzt die Dreierfolge dagegen fest. Die Teaching Tools der Universität Zürich bringen sie auf drei Fragen: Wer misst, wie wird gemessen, was wird gemessen? Die erste Frage zielt auf die Objektivität, die zweite auf die Reliabilität, die dritte auf die Validität. Das Prüfungsglossar der ETH Zürich ordnet die drei zusätzlich hierarchisch: Validität setzt Reliabilität voraus, Reliabilität setzt Objektivität voraus. In der englischsprachigen Systematik fehlt dieser Kette schlicht das erste Glied.

Für deine Arbeit hat der Unterschied zwei praktische Folgen. Findest du in englischsprachiger Literatur kein Wort zur Objektivität, ist das kein Versäumnis der Quelle, sondern ein Unterschied in der Systematik. Und schreibst du selbst auf Englisch, übersetze Objektivität nicht einfach mit objectivity, sondern beschreibe, was gemeint ist: standardisierte Durchführung, Auswertung und Interpretation.

Drei Fehler, die im Methodenteil Punkte kosten

Die meisten Abzüge im Methodenteil entstehen nicht durch schwache Kennwerte, sondern durch Sätze, die mehr behaupten, als die Daten hergeben. Drei Muster tauchen dabei besonders häufig auf.

Gemeinsam ist ihnen, dass ein Gütekriterium für etwas in Anspruch genommen wird, wofür es nicht gemacht ist. Wer die Kataloge sauber auseinanderhält, umgeht alle drei fast von allein, und der Methodenteil wird dabei kürzer statt länger.

Objektivität mit der Erhebungssituation verwechseln

Objektivität meint Unabhängigkeit von der forschenden Person, nicht Unabhängigkeit von der Umgebung. Häufig liest man, eine Erhebung sei objektiv gewesen, weil sie in einem neutralen Raum stattfand. Ein neutraler Raum betrifft aber die Durchführungsbedingungen. Objektiv wird eine Erhebung erst dadurch, dass Instruktion, Auswertungsregeln und Interpretationsregeln vorab feststehen und für alle Befragten gleich gelten.

Mayring und Steinke mit der falschen Jahreszahl zitieren

Mayrings «Einführung in die qualitative Sozialforschung» ist erstmals 1990 erschienen und liegt seit 2023 in der 7. Auflage vor. Steinkes Kernkriterien gibt es als Monografie von 1999 und als Handbuchbeitrag, der je nach benutzter Auflage mit 2000, 2008 oder 2010 datiert wird. Zitiert wird immer die Auflage, die du tatsächlich in der Hand hattest. Zwei verschiedene Jahre für dieselbe Quelle im selben Verzeichnis fallen sofort auf.

Einen Katalog aufzählen, ohne ihn auf die eigene Arbeit zu beziehen

Eine Liste der sechs Kriterien nach Mayring ist noch keine Prüfung der eigenen Güte. Bewertet wird, ob du für jedes Kriterium sagen kannst, wie du es eingelöst hast und wo du an eine Grenze gestossen bist. Ein Satz wie «Eine kommunikative Validierung war aus Zeitgründen nicht möglich, weshalb die Deutungen ausschliesslich argumentativ abgesichert wurden» wiegt schwerer als eine vollständige Aufzählung ohne Bezug.

Fazit

Für die quantitative Forschung ist die Frage nach den Gütekriterien beantwortet, für die qualitative nicht, und darin liegt kein Mangel, sondern das Ergebnis einer laufenden Fachdebatte. Wähle einen Katalog, nenne die Quelle, aus der er stammt, und arbeite ihn an deiner eigenen Erhebung durch. Mehr verlangt ein guter Methodenteil nicht.

Wie es weitergeht

Unser Literaturtipp: Mayring, Philipp (2023): Einführung in die qualitative Sozialforschung. 7. Auflage. Beltz: Weinheim und Basel. Kapitel 6 behandelt die Gütekriterien kompakt und bleibt der kürzeste seriöse Einstieg ins Thema. Für die quantitative Seite: Moosbrugger, Helfried und Kelava, Augustin (Hrsg.) (2020): Testtheorie und Fragebogenkonstruktion. 3. Auflage. Springer: Berlin und Heidelberg.


Soll deine Erhebung bei allen Befragten identisch ablaufen?

Mit empirio.ai, einem Online-Umfrage-Tool aus Deutschland, bekommen alle Teilnehmenden denselben Fragebogen in derselben Reihenfolge, und die Antworten liegen sofort strukturiert vor. Die Durchführungsobjektivität ist damit weitgehend gesichert. Für die Regeln der Auswertung und der Interpretation bleibst du zuständig.

Umfrage kostenlos erstellen

Häufig gestellte Fragen

Gütekriterien sind Massstäbe, mit denen sich die Qualität einer wissenschaftlichen Untersuchung beurteilen lässt. Beantwortet wird damit die Frage, ob ein Ergebnis auf dem gewählten Verfahren beruht oder auf der Person, die es angewendet hat. In der quantitativen Forschung sind die drei bekanntesten Objektivität, Reliabilität und Validität.

Für qualitative Forschung existiert kein einheitlicher Katalog, sondern eine Reihe konkurrierender Vorschläge. Philipp Mayring nennt sechs Kriterien, Ines Steinke sieben, Yvonna Lincoln und Egon Guba vier, das Team um Jörg Strübing fünf. Für eine Bachelorarbeit genügt es, einen Katalog zu wählen, die Quelle dazu zu nennen und ihn konsequent auf die eigene Erhebung anzuwenden.

Die drei Hauptgütekriterien quantitativer Forschung heissen Objektivität, Reliabilität und Validität. Objektivität bedeutet, dass ein Ergebnis nicht von der forschenden Person abhängt. Reliabilität steht für eine genaue Messung mit kleinem Messfehler. Validität steht dafür, dass tatsächlich das gemeinte Merkmal erfasst wird und kein anderes. Validität setzt Reliabilität voraus, Reliabilität setzt Objektivität voraus.

Philipp Mayring nennt sechs allgemeine Gütekriterien qualitativ orientierter Forschung: Verfahrensdokumentation, argumentative Interpretationsabsicherung, Regelgeleitetheit, Nähe zum Gegenstand, kommunikative Validierung und Triangulation. Nachzulesen sind sie in «Einführung in die qualitative Sozialforschung», zuletzt in der 7. Auflage von 2023 in Kapitel 6.3. Erschienen ist das Buch erstmals 1990, weshalb zu diesem Katalog mehrere Jahreszahlen kursieren.

Quantitative Gütekriterien bewerten ein Messinstrument, qualitative Gütekriterien bewerten einen Forschungsprozess. Eine standardisierte Messung, wie sie Objektivität, Reliabilität und Validität voraussetzen, findet im offenen Interview gar nicht statt. Qualitative Kataloge fragen deshalb nach Dokumentation, Begründung und Nachvollziehbarkeit statt nach Kennwerten. Beide Seiten wollen dasselbe erreichen: nachvollziehbar machen, wie ein Ergebnis zustande gekommen ist.

Objektivität, Reliabilität und Validität lassen sich nicht unverändert auf qualitative Forschung übertragen. Ein Leitfadeninterview soll gerade nicht bei jeder Wiederholung dasselbe ergeben, weil es auf die einzelne Person eingeht. Verbreitet ist die Übersetzung in Intersubjektivität, Transparenz und Reichweite. Eingängig ist sie durchaus, sie stammt aber weder von Mayring noch von Steinke.

Eine einzelne Urheberschaft für die Gütekriterien qualitativer Forschung gibt es nicht. Im deutschsprachigen Raum werden am häufigsten Philipp Mayring und Ines Steinke zitiert, international Yvonna Lincoln und Egon Guba mit «Naturalistic Inquiry» von 1985. Der jüngste Vorschlag stammt aus dem Jahr 2018 und löste in der Zeitschrift für Soziologie eine breite Debatte aus.

Nebengütekriterien sind zusätzliche Anforderungen an ein Testverfahren neben Objektivität, Reliabilität und Validität. Welche dazuzählen, hängt von der Quelle ab. Lienert und Raatz führen Normierung, Vergleichbarkeit, Ökonomie und Nützlichkeit, Moosbrugger und Kelava stattdessen Ökonomie, Nützlichkeit, Zumutbarkeit, Unverfälschbarkeit und Fairness. Das Prüfungsglossar der ETH Zürich nennt zusätzlich Transparenz und Augenscheinvalidität.

Das könnte dich auch interessieren