Methodik und Statistik

Kategoriensystem nach Mayring: so baust du es auf

Zuletzt aktualisiert im · Lesezeit etwa 9 Minuten

Fünfzehn Interviews, dreihundert Seiten Transkript, und irgendwo darin steckt deine Auswertung. Die Frage ist nur, wie du sie herausbekommst.

Ein Kategoriensystem entsteht nicht dadurch, dass man das Material lange genug anstarrt. Es entsteht durch eine Regel, die du vorher festlegst und dann konsequent anwendest. Dieser Artikel zeigt dir die Regel – und danach ein vollständiges Beispiel vom Rohtranskript bis zur fertigen Kategorie.

Induktiv oder deduktiv – die erste Entscheidung

Mayring unterscheidet drei Grundformen: Zusammenfassung, Explikation und Strukturierung. Für Abschlussarbeiten sind zwei Wege relevant, und die stammen aus der ersten und der dritten Form.

Deduktiv heißt: Du leitest deine Kategorien aus der Theorie ab, bevor du ins Material gehst. Das passt, wenn dein Theorieteil ein Modell liefert, das du am Material prüfen willst. Mayring nennt das deduktive Kategorienanwendung.

Induktiv heißt: Du entwickelst die Kategorien aus dem Material selbst, in einem geregelten Verfahren aus Paraphrasierung, Generalisierung und Reduktion. Das passt, wenn du ein Feld erkundest, zu dem es wenig gibt.

In der Praxis ist es oft eine Mischung: ein deduktives Grundgerüst aus der Theorie, das im Material um induktive Unterkategorien ergänzt wird. Das ist legitim und in vielen Arbeiten der sinnvollste Weg. Wichtig ist nur, dass du im Methodenteil benennst, welchen Weg du gegangen bist und an welcher Stelle du gewechselt hast.

Zwei Festlegungen, bevor du anfängst

Bevor die erste Textstelle markiert wird, brauchst du zwei Sätze auf einem Blatt. Diese zwei Sätze entscheiden darüber, ob du in drei Wochen ein System hast oder ein Durcheinander.

Das Selektionskriterium

Welche Textstellen sind überhaupt relevant? Nicht jeder Satz in einem Interview gehört in deine Auswertung. Beispiel: „Berücksichtigt werden alle Aussagen, die das eigene Erleben der Betreuungsbeziehung während der Abschlussarbeit beschreiben." Alles, was nicht darunter fällt – Anekdoten aus dem Grundstudium, Kommentare zur Mensa – bleibt draußen. Das darf es, und du musst es nicht begründen, wenn dein Kriterium sauber formuliert ist.

Das Abstraktionsniveau

Wie konkret oder allgemein soll eine Kategorie sein? Das ist der häufigste Grund für sich überschneidende Kategorien. Wenn eine Kategorie „Kommunikation im Team" heißt und die nächste „Missverständnisse in Meetings", dann liegen sie nicht nebeneinander – die zweite gehört unter die erste. Formuliere es so: „Kategorien beschreiben konkrete, auf die Betreuungssituation bezogene Erfahrungen, nicht allgemeine Haltungen zum Studium." Dieser Zettel rettet dich später vor Wochen Umbauarbeit.

Das vollständige Beispiel: vom Transkript zur Kategorie

Forschungsfrage: Wie erleben Studierende die Betreuung ihrer Bachelorarbeit? Datenmaterial: sechs leitfadengestützte Interviews. Selektionskriterium und Abstraktionsniveau wie oben. Jetzt der Durchgang in vier Stufen.

Stufe 1 · Rohmaterial

So sieht eine Fundstelle im Transkript aus, mit Sprecherkennung und Zeilennummern. Diese Angabe brauchst du später, um jede Kategorie zurückverfolgen zu können.

B3, Z. 112–118: „Also ich hab ihm dann geschrieben, dreimal, und ähm, da kam halt einfach nichts zurück. Und irgendwann denkst du dir, okay, vielleicht ist meine Frage einfach zu blöd. Also ich hab dann aufgehört zu fragen."

Stufe 2 · Paraphrasieren

Du streichst alles Ausschmückende und schreibst den inhaltlichen Kern in einem knappen, grammatikalisch vollständigen Satz. Keine Deutung, keine Interpretation – nur das, was dasteht, in kürzerer Form. Aus dem Zitat oben wird:

Schrieb dreimal ohne Antwort; deutete das Ausbleiben als Hinweis auf eine unangemessene eigene Frage; stellte die Kontaktaufnahme ein.

Stufe 3 · Generalisieren

Jetzt hebst du die Paraphrase auf dein festgelegtes Abstraktionsniveau. Konkrete Einzelheiten – „dreimal", „er" – fallen weg. Was bleibt, ist der Vorgang:

Ausbleibende Rückmeldung wird auf eigenes Unvermögen zurückgeführt und führt zum Abbruch der Kontaktaufnahme.

Stufe 4 · Reduzieren und bündeln

Mayring nennt das zwei Reduktionen: Erst streichst du bedeutungsgleiche Generalisierungen (Z1), dann bündelst du inhaltlich verwandte zu einer Kategorie (Z2). Hier die Tabelle für sechs Fundstellen aus drei Interviews:

Nr.FundstelleParaphraseGeneralisierungKategorie
P1B3, 112–118Schrieb dreimal ohne Antwort; deutete das als eigene unangemessene Frage; stellte Nachfragen einAusbleibende Rückmeldung wird auf eigenes Unvermögen zurückgeführtK1 Selbstzuschreibung bei Funkstille
P2B5, 47–52Traute sich nicht nachzufragen, weil sie den Betreuer für sehr beschäftigt hieltNachfragen wird unterlassen aus Rücksicht auf vermutete BelastungK1 Selbstzuschreibung bei Funkstille
P3B1, 203–209Bekam Rückmeldung nur in Halbsätzen; wusste danach nicht, was zu ändern warFeedback bleibt so unbestimmt, dass daraus keine Handlung ableitbar istK2 Unbestimmtes Feedback
P4B3, 289–294Hörte „nicht wissenschaftlich genug", ohne zu erfahren, worauf sich das bezogFeedback bleibt so unbestimmt, dass daraus keine Handlung ableitbar istK2 Unbestimmtes Feedback
P5B5, 130–137Legte sich vor jedem Termin drei Fragen zurecht und schickte sie vorabEigene Struktur wird geschaffen, um die Betreuung nutzbar zu machenK3 Aktive Steuerung der Betreuung
P6B1, 88–93Schlug selbst Termine vor, statt auf Angebote zu wartenEigene Struktur wird geschaffen, um die Betreuung nutzbar zu machenK3 Aktive Steuerung der Betreuung
P3 und P4 haben dieselbe Generalisierung – hier greift die erste Reduktion: Eine der beiden verschwindet aus der Liste, die Fundstelle bleibt der Kategorie zugeordnet.

Aus sechs Fundstellen sind drei Kategorien geworden. Bei sechs Interviews mit je fünfzehn bis dreißig Fundstellen läuft dieselbe Mechanik – nur mit mehr Zeilen. Das Verfahren ändert sich nicht.

Der Kodierleitfaden

Zu jeder Kategorie gehören drei Dinge. Zusammen ergeben sie den Kodierleitfaden, der als Tabelle in den Anhang gehört.

BestandteilBeispiel für K1
DefinitionAussagen, in denen das Ausbleiben oder die Knappheit einer Rückmeldung auf die eigene Person oder die eigene Leistung zurückgeführt wird.
Ankerbeispiel„… vielleicht ist meine Frage einfach zu blöd. Also ich hab dann aufgehört zu fragen." (B3, Z. 115–118)
KodierregelWird sowohl eine Selbstzuschreibung als auch eine Kritik am Betreuungsverhalten geäußert, wird die Stelle K1 zugeordnet, wenn die Selbstzuschreibung die Handlung erklärt. Reine Kritik ohne Selbstbezug gehört zu K2.

Die Kodierregel ist der Teil, den fast alle weglassen und der später am meisten wert ist. Sie beantwortet die Frage: Was mache ich, wenn eine Aussage zu zwei Kategorien passt? Ohne Regel entscheidest du jedes Mal neu – und deine Auswertung wird unsystematisch, ohne dass es dir auffällt.

Die Revision nach 30 Prozent

Mayring sieht einen Schritt vor, der in vielen Arbeiten fehlt: Nach etwa zehn bis fünfzig Prozent des Materials hältst du an und prüfst dein bisheriges System, bevor du weitermachst. Drei Fragen:

Passen die Kategorien noch auf das Abstraktionsniveau, das du festgelegt hast? Gibt es Kategorien, die fast nie besetzt sind? Gibt es Textstellen, die du in keine Kategorie bekommst, obwohl sie nach deinem Selektionskriterium hineingehören?

Wenn du hier etwas änderst – und das ist die Regel, nicht die Ausnahme – gehst du das bereits kodierte Material noch einmal durch. Das ist mühsam und genau der Grund, warum die Revision früh stattfindet und nicht am Ende.

Diese Revision gehört in den Methodenteil. Nicht als Eingeständnis, sondern als Beleg dafür, dass du das Verfahren verstanden hast. Ein Kategoriensystem, das sich im Kontakt mit dem Material nie verändert hat, ist verdächtig.

Intercoderreliabilität

Um zu zeigen, dass deine Zuordnungen nicht beliebig sind, lässt du einen Teil des Materials von einer zweiten Person kodieren – meist zehn bis zwanzig Prozent – und berechnest die Übereinstimmung. Üblich ist Cohens Kappa, weil es die zufällig zu erwartende Übereinstimmung herausrechnet.

Für die Einordnung der Werte wird meist die Einteilung von Landis und Koch herangezogen; Werte ab etwa ,61 gelten dort als substanzielle Übereinstimmung, ab ,81 als fast vollständige. In Abschlussarbeiten wird ,70 häufig als Richtwert genannt.

Wie viele Kategorien sind sinnvoll?

Für eine Bachelorarbeit sind fünf bis zehn Hauptkategorien mit jeweils zwei bis vier Unterkategorien ein guter Rahmen. Mehr wird unübersichtlich, weniger wird zu grob.

Wenn du beim Kodieren merkst, dass eine Kategorie nur ein einziges Mal besetzt ist, hast du zwei Möglichkeiten: streichen oder mit einer verwandten zusammenfassen. Beides ist Teil des Verfahrens und gehört dokumentiert. Was nicht geht: sie stehen lassen und hoffen, dass niemand nachzählt.

MAXQDA, Atlas.ti oder Excel

Für kleinere Projekte reicht Excel: eine Spalte für die Fundstelle, eine für die Paraphrase, eine für die Generalisierung, eine für die Kategorie. Genau die Tabelle von oben. Ab etwa zehn Interviews lohnt sich MAXQDA, weil das Verwalten sonst mehr Zeit frisst als das Auswerten.

Praktisch in MAXQDA: Das Memo-Feld an jedem Code ist der richtige Ort für Definition, Ankerbeispiel und Kodierregel. Dann steht der Leitfaden im Projekt statt in einer Datei, die du irgendwann nicht mehr findest. Und die Funktion „Code-Matrix" zeigt dir auf einen Blick, welche Kategorie in welchem Interview vorkommt – dort siehst du sofort, welche Kategorie fast leer ist.

Was keine Software leistet: die Entscheidung, welche Kategorie richtig ist. Die triffst du.

Wie du die Ergebnisse darstellst

Das Kategoriensystem ist nicht das Ergebnis, sondern das Werkzeug. Im Ergebnisteil gehst du Kategorie für Kategorie durch, und jeder Abschnitt hat denselben Aufbau: Was besagt die Kategorie? Wie oft und in wie vielen Interviews kommt sie vor? Ein bis zwei Belegzitate mit Fundstelle. Und dann der Satz, der die meisten fehlt – was folgt daraus für deine Forschungsfrage?

Häufigkeitsangaben sind bei qualitativen Daten heikel. „Vier von sechs Befragten" ist in Ordnung, weil es nachvollziehbar ist. Prozentangaben bei sechs Interviews sind es nicht, weil sie eine Genauigkeit vortäuschen, die die Stichprobe nicht hergibt. Eine Häufigkeitsübersicht aller Kategorien als Tabelle im Anhang ist trotzdem hilfreich: Sie zeigt auf einen Blick, wo dein Material dicht ist und wo dünn.

Die Interpretation gehört anschließend in die Diskussion, nicht in den Ergebnisteil. Diese Trennung ist der zweithäufigste Punkt, den ich in Textfeedbacks anmerke.

Fünf Fehler, die im Kolloquium auffallen

Kategorien aus der Theorie ohne Materialbezug. Deduktiv arbeiten heißt nicht, das Material zu ignorieren. Zu jeder Kategorie gehört ein Ankerbeispiel aus deinen Daten. Findest du keins, existiert die Kategorie in deinem Material nicht.

Kategorien auf verschiedenen Abstraktionsebenen. Siehe oben. Das ist der Fehler, der am schnellsten auffällt, weil er in der Ergebnisgliederung sichtbar wird.

Fehlende Fundstellen. Jede Kategorie muss zurückverfolgbar sein. Interview, Zeilennummer. Wer das nicht hat, kann die Nachfrage „woher wissen Sie das?" nicht beantworten.

Zitate als Ergebnis. Eine Aneinanderreihung schöner Zitate ist keine Auswertung. Das Ergebnis ist die Kategorie und was sie über dein Material aussagt; das Zitat belegt sie nur.

Der Methodenteil beschreibt Mayring, aber nicht dich. Zwei Seiten Verfahrensdarstellung aus dem Lehrbuch, aber kein Wort dazu, was du als Selektionskriterium festgelegt hast. Prüfende lesen Mayring nicht in deiner Arbeit nach – sie wollen deine Entscheidungen sehen.

Wenn du dich noch zwischen Verfahren entscheidest, hilft dir vielleicht der Vergleich Grounded Theory oder qualitative Inhaltsanalyse.

Verwirrt beim Kodieren? Im Einzeltermin bauen wir aus deinem ersten Transkript ein Kategoriensystem, das trägt – mit Selektionskriterium, Abstraktionsniveau und Kodierleitfaden.