Kategoriensystem nach Mayring: so baust du es auf
Zuletzt aktualisiert im · Lesezeit etwa 9 Minuten
Fünfzehn Interviews, dreihundert Seiten Transkript, und irgendwo darin steckt deine Auswertung. Die Frage ist nur, wie du sie herausbekommst.
Ein Kategoriensystem entsteht nicht dadurch, dass man das Material lange genug anstarrt. Es entsteht durch eine Regel, die du vorher festlegst und dann konsequent anwendest. Dieser Artikel zeigt dir die Regel – und danach ein vollständiges Beispiel vom Rohtranskript bis zur fertigen Kategorie.
- Induktiv oder deduktiv – die erste Entscheidung
- Zwei Festlegungen, bevor du anfängst
- Das vollständige Beispiel: vom Transkript zur Kategorie
- Der Kodierleitfaden
- Die Revision nach 30 Prozent
- Intercoderreliabilität
- Wie viele Kategorien sind sinnvoll?
- MAXQDA, Atlas.ti oder Excel
- Wie du die Ergebnisse darstellst
- Fünf Fehler, die im Kolloquium auffallen
Induktiv oder deduktiv – die erste Entscheidung
Mayring unterscheidet drei Grundformen: Zusammenfassung, Explikation und Strukturierung. Für Abschlussarbeiten sind zwei Wege relevant, und die stammen aus der ersten und der dritten Form.
Deduktiv heißt: Du leitest deine Kategorien aus der Theorie ab, bevor du ins Material gehst. Das passt, wenn dein Theorieteil ein Modell liefert, das du am Material prüfen willst. Mayring nennt das deduktive Kategorienanwendung.
Induktiv heißt: Du entwickelst die Kategorien aus dem Material selbst, in einem geregelten Verfahren aus Paraphrasierung, Generalisierung und Reduktion. Das passt, wenn du ein Feld erkundest, zu dem es wenig gibt.
In der Praxis ist es oft eine Mischung: ein deduktives Grundgerüst aus der Theorie, das im Material um induktive Unterkategorien ergänzt wird. Das ist legitim und in vielen Arbeiten der sinnvollste Weg. Wichtig ist nur, dass du im Methodenteil benennst, welchen Weg du gegangen bist und an welcher Stelle du gewechselt hast.
Zwei Festlegungen, bevor du anfängst
Bevor die erste Textstelle markiert wird, brauchst du zwei Sätze auf einem Blatt. Diese zwei Sätze entscheiden darüber, ob du in drei Wochen ein System hast oder ein Durcheinander.
Das Selektionskriterium
Welche Textstellen sind überhaupt relevant? Nicht jeder Satz in einem Interview gehört in deine Auswertung. Beispiel: „Berücksichtigt werden alle Aussagen, die das eigene Erleben der Betreuungsbeziehung während der Abschlussarbeit beschreiben." Alles, was nicht darunter fällt – Anekdoten aus dem Grundstudium, Kommentare zur Mensa – bleibt draußen. Das darf es, und du musst es nicht begründen, wenn dein Kriterium sauber formuliert ist.
Das Abstraktionsniveau
Wie konkret oder allgemein soll eine Kategorie sein? Das ist der häufigste Grund für sich überschneidende Kategorien. Wenn eine Kategorie „Kommunikation im Team" heißt und die nächste „Missverständnisse in Meetings", dann liegen sie nicht nebeneinander – die zweite gehört unter die erste. Formuliere es so: „Kategorien beschreiben konkrete, auf die Betreuungssituation bezogene Erfahrungen, nicht allgemeine Haltungen zum Studium." Dieser Zettel rettet dich später vor Wochen Umbauarbeit.
Das vollständige Beispiel: vom Transkript zur Kategorie
Forschungsfrage: Wie erleben Studierende die Betreuung ihrer Bachelorarbeit? Datenmaterial: sechs leitfadengestützte Interviews. Selektionskriterium und Abstraktionsniveau wie oben. Jetzt der Durchgang in vier Stufen.
Stufe 1 · Rohmaterial
So sieht eine Fundstelle im Transkript aus, mit Sprecherkennung und Zeilennummern. Diese Angabe brauchst du später, um jede Kategorie zurückverfolgen zu können.
B3, Z. 112–118: „Also ich hab ihm dann geschrieben, dreimal, und ähm, da kam halt einfach nichts zurück. Und irgendwann denkst du dir, okay, vielleicht ist meine Frage einfach zu blöd. Also ich hab dann aufgehört zu fragen."
Stufe 2 · Paraphrasieren
Du streichst alles Ausschmückende und schreibst den inhaltlichen Kern in einem knappen, grammatikalisch vollständigen Satz. Keine Deutung, keine Interpretation – nur das, was dasteht, in kürzerer Form. Aus dem Zitat oben wird:
Schrieb dreimal ohne Antwort; deutete das Ausbleiben als Hinweis auf eine unangemessene eigene Frage; stellte die Kontaktaufnahme ein.
Stufe 3 · Generalisieren
Jetzt hebst du die Paraphrase auf dein festgelegtes Abstraktionsniveau. Konkrete Einzelheiten – „dreimal", „er" – fallen weg. Was bleibt, ist der Vorgang:
Ausbleibende Rückmeldung wird auf eigenes Unvermögen zurückgeführt und führt zum Abbruch der Kontaktaufnahme.
Stufe 4 · Reduzieren und bündeln
Mayring nennt das zwei Reduktionen: Erst streichst du bedeutungsgleiche Generalisierungen (Z1), dann bündelst du inhaltlich verwandte zu einer Kategorie (Z2). Hier die Tabelle für sechs Fundstellen aus drei Interviews:
| Nr. | Fundstelle | Paraphrase | Generalisierung | Kategorie |
|---|---|---|---|---|
| P1 | B3, 112–118 | Schrieb dreimal ohne Antwort; deutete das als eigene unangemessene Frage; stellte Nachfragen ein | Ausbleibende Rückmeldung wird auf eigenes Unvermögen zurückgeführt | K1 Selbstzuschreibung bei Funkstille |
| P2 | B5, 47–52 | Traute sich nicht nachzufragen, weil sie den Betreuer für sehr beschäftigt hielt | Nachfragen wird unterlassen aus Rücksicht auf vermutete Belastung | K1 Selbstzuschreibung bei Funkstille |
| P3 | B1, 203–209 | Bekam Rückmeldung nur in Halbsätzen; wusste danach nicht, was zu ändern war | Feedback bleibt so unbestimmt, dass daraus keine Handlung ableitbar ist | K2 Unbestimmtes Feedback |
| P4 | B3, 289–294 | Hörte „nicht wissenschaftlich genug", ohne zu erfahren, worauf sich das bezog | Feedback bleibt so unbestimmt, dass daraus keine Handlung ableitbar ist | K2 Unbestimmtes Feedback |
| P5 | B5, 130–137 | Legte sich vor jedem Termin drei Fragen zurecht und schickte sie vorab | Eigene Struktur wird geschaffen, um die Betreuung nutzbar zu machen | K3 Aktive Steuerung der Betreuung |
| P6 | B1, 88–93 | Schlug selbst Termine vor, statt auf Angebote zu warten | Eigene Struktur wird geschaffen, um die Betreuung nutzbar zu machen | K3 Aktive Steuerung der Betreuung |
Aus sechs Fundstellen sind drei Kategorien geworden. Bei sechs Interviews mit je fünfzehn bis dreißig Fundstellen läuft dieselbe Mechanik – nur mit mehr Zeilen. Das Verfahren ändert sich nicht.
Der Kodierleitfaden
Zu jeder Kategorie gehören drei Dinge. Zusammen ergeben sie den Kodierleitfaden, der als Tabelle in den Anhang gehört.
| Bestandteil | Beispiel für K1 |
|---|---|
| Definition | Aussagen, in denen das Ausbleiben oder die Knappheit einer Rückmeldung auf die eigene Person oder die eigene Leistung zurückgeführt wird. |
| Ankerbeispiel | „… vielleicht ist meine Frage einfach zu blöd. Also ich hab dann aufgehört zu fragen." (B3, Z. 115–118) |
| Kodierregel | Wird sowohl eine Selbstzuschreibung als auch eine Kritik am Betreuungsverhalten geäußert, wird die Stelle K1 zugeordnet, wenn die Selbstzuschreibung die Handlung erklärt. Reine Kritik ohne Selbstbezug gehört zu K2. |
Die Kodierregel ist der Teil, den fast alle weglassen und der später am meisten wert ist. Sie beantwortet die Frage: Was mache ich, wenn eine Aussage zu zwei Kategorien passt? Ohne Regel entscheidest du jedes Mal neu – und deine Auswertung wird unsystematisch, ohne dass es dir auffällt.
Die Revision nach 30 Prozent
Mayring sieht einen Schritt vor, der in vielen Arbeiten fehlt: Nach etwa zehn bis fünfzig Prozent des Materials hältst du an und prüfst dein bisheriges System, bevor du weitermachst. Drei Fragen:
Passen die Kategorien noch auf das Abstraktionsniveau, das du festgelegt hast? Gibt es Kategorien, die fast nie besetzt sind? Gibt es Textstellen, die du in keine Kategorie bekommst, obwohl sie nach deinem Selektionskriterium hineingehören?
Wenn du hier etwas änderst – und das ist die Regel, nicht die Ausnahme – gehst du das bereits kodierte Material noch einmal durch. Das ist mühsam und genau der Grund, warum die Revision früh stattfindet und nicht am Ende.
Diese Revision gehört in den Methodenteil. Nicht als Eingeständnis, sondern als Beleg dafür, dass du das Verfahren verstanden hast. Ein Kategoriensystem, das sich im Kontakt mit dem Material nie verändert hat, ist verdächtig.
Intercoderreliabilität
Um zu zeigen, dass deine Zuordnungen nicht beliebig sind, lässt du einen Teil des Materials von einer zweiten Person kodieren – meist zehn bis zwanzig Prozent – und berechnest die Übereinstimmung. Üblich ist Cohens Kappa, weil es die zufällig zu erwartende Übereinstimmung herausrechnet.
Für die Einordnung der Werte wird meist die Einteilung von Landis und Koch herangezogen; Werte ab etwa ,61 gelten dort als substanzielle Übereinstimmung, ab ,81 als fast vollständige. In Abschlussarbeiten wird ,70 häufig als Richtwert genannt.
Wie viele Kategorien sind sinnvoll?
Für eine Bachelorarbeit sind fünf bis zehn Hauptkategorien mit jeweils zwei bis vier Unterkategorien ein guter Rahmen. Mehr wird unübersichtlich, weniger wird zu grob.
Wenn du beim Kodieren merkst, dass eine Kategorie nur ein einziges Mal besetzt ist, hast du zwei Möglichkeiten: streichen oder mit einer verwandten zusammenfassen. Beides ist Teil des Verfahrens und gehört dokumentiert. Was nicht geht: sie stehen lassen und hoffen, dass niemand nachzählt.
MAXQDA, Atlas.ti oder Excel
Für kleinere Projekte reicht Excel: eine Spalte für die Fundstelle, eine für die Paraphrase, eine für die Generalisierung, eine für die Kategorie. Genau die Tabelle von oben. Ab etwa zehn Interviews lohnt sich MAXQDA, weil das Verwalten sonst mehr Zeit frisst als das Auswerten.
Praktisch in MAXQDA: Das Memo-Feld an jedem Code ist der richtige Ort für Definition, Ankerbeispiel und Kodierregel. Dann steht der Leitfaden im Projekt statt in einer Datei, die du irgendwann nicht mehr findest. Und die Funktion „Code-Matrix" zeigt dir auf einen Blick, welche Kategorie in welchem Interview vorkommt – dort siehst du sofort, welche Kategorie fast leer ist.
Was keine Software leistet: die Entscheidung, welche Kategorie richtig ist. Die triffst du.
Wie du die Ergebnisse darstellst
Das Kategoriensystem ist nicht das Ergebnis, sondern das Werkzeug. Im Ergebnisteil gehst du Kategorie für Kategorie durch, und jeder Abschnitt hat denselben Aufbau: Was besagt die Kategorie? Wie oft und in wie vielen Interviews kommt sie vor? Ein bis zwei Belegzitate mit Fundstelle. Und dann der Satz, der die meisten fehlt – was folgt daraus für deine Forschungsfrage?
Häufigkeitsangaben sind bei qualitativen Daten heikel. „Vier von sechs Befragten" ist in Ordnung, weil es nachvollziehbar ist. Prozentangaben bei sechs Interviews sind es nicht, weil sie eine Genauigkeit vortäuschen, die die Stichprobe nicht hergibt. Eine Häufigkeitsübersicht aller Kategorien als Tabelle im Anhang ist trotzdem hilfreich: Sie zeigt auf einen Blick, wo dein Material dicht ist und wo dünn.
Die Interpretation gehört anschließend in die Diskussion, nicht in den Ergebnisteil. Diese Trennung ist der zweithäufigste Punkt, den ich in Textfeedbacks anmerke.
Fünf Fehler, die im Kolloquium auffallen
Kategorien aus der Theorie ohne Materialbezug. Deduktiv arbeiten heißt nicht, das Material zu ignorieren. Zu jeder Kategorie gehört ein Ankerbeispiel aus deinen Daten. Findest du keins, existiert die Kategorie in deinem Material nicht.
Kategorien auf verschiedenen Abstraktionsebenen. Siehe oben. Das ist der Fehler, der am schnellsten auffällt, weil er in der Ergebnisgliederung sichtbar wird.
Fehlende Fundstellen. Jede Kategorie muss zurückverfolgbar sein. Interview, Zeilennummer. Wer das nicht hat, kann die Nachfrage „woher wissen Sie das?" nicht beantworten.
Zitate als Ergebnis. Eine Aneinanderreihung schöner Zitate ist keine Auswertung. Das Ergebnis ist die Kategorie und was sie über dein Material aussagt; das Zitat belegt sie nur.
Der Methodenteil beschreibt Mayring, aber nicht dich. Zwei Seiten Verfahrensdarstellung aus dem Lehrbuch, aber kein Wort dazu, was du als Selektionskriterium festgelegt hast. Prüfende lesen Mayring nicht in deiner Arbeit nach – sie wollen deine Entscheidungen sehen.
Wenn du dich noch zwischen Verfahren entscheidest, hilft dir vielleicht der Vergleich Grounded Theory oder qualitative Inhaltsanalyse.
Verwirrt beim Kodieren? Im Einzeltermin bauen wir aus deinem ersten Transkript ein Kategoriensystem, das trägt – mit Selektionskriterium, Abstraktionsniveau und Kodierleitfaden.