Transkriptionsregeln nach Dresing & Pehl einfach erklärt
Transkriptionsregeln nach Dresing & Pehl verständlich erklärt: einfaches vs. erweitertes System, Vorher-nachher-Beispiel und was du bei KI-Transkripten ergänzt.
Warum überhaupt Transkriptionsregeln?
Gesprochene Sprache ist chaotisch: Menschen brechen Sätze ab, setzen neu an, lachen, zögern, sprechen Dialekt. Wer ein Interview verschriftlicht, muss ständig entscheiden, was davon ins Transkript gehört – und wie es aussehen soll. Ohne feste Regeln entscheidest du bei Interview 1 anders als bei Interview 7, und deine Auswertung wird angreifbar.
Transkriptionsregeln sorgen dafür, dass alle deine Transkripte einheitlich, nachvollziehbar und vergleichbar sind. Im deutschsprachigen Raum wird dafür in vielen Fächern auf das Transkriptionssystem von Thorsten Dresing und Thorsten Pehl zurückgegriffen. In diesem Artikel erklären wir die Grundprinzipien in eigenen Worten – als Einstieg, nicht als Ersatz für die Originalquelle.
Originalquelle nutzen: Die vollständigen Regeln findest du im Buch „Praxisbuch Interview, Transkription & Analyse“ von Thorsten Dresing und Thorsten Pehl. Es ist über die Website der Autoren auch kostenlos als PDF erhältlich. Zitiere in deiner Arbeit immer die Originalquelle und die dort verwendete Auflage – und stimme mit deiner Betreuung ab, welches Regelsystem (und welche Anpassungen) für dein Projekt gelten.
Einfaches und erweitertes Transkriptionssystem
Dresing & Pehl unterscheiden grob zwei Detailstufen:
- Einfaches Transkriptionssystem: Der Fokus liegt auf dem Inhalt des Gesagten. Der Text wird gut lesbar geglättet, ohne dass Inhalte verloren gehen. Das reicht für die meisten Abschlussarbeiten, bei denen du z. B. mit einer qualitativen Inhaltsanalyse arbeitest.
- Erweitertes Transkriptionssystem: Hier werden zusätzlich sprachliche und parasprachliche Details festgehalten – etwa Verzögerungslaute, Betonungen oder die genaue Länge von Pausen. Das ist sinnvoll, wenn es auch darum geht, wie etwas gesagt wird, zum Beispiel bei Gesprächs- oder Diskursanalysen.
Für eine Bachelor- oder Masterarbeit mit inhaltlichem Fokus ist das einfache System meist die richtige Wahl. Es spart dir auch erheblich Zeit.
Die Grundprinzipien des einfachen Systems – in eigenen Worten
Die folgende Übersicht fasst die zentralen Ideen zusammen. Die genauen Formulierungen und Sonderfälle stehen im Original.
1. Wörtlich, aber geglättet
Es wird wörtlich transkribiert, nicht zusammengefasst oder lautsprachlich. Gleichzeitig wird die Sprache leicht geglättet: Satzbau-Fehler bleiben erhalten, aber umgangssprachliche Verschleifungen werden an die Schriftsprache angenähert (aus „hamma“ wird „haben wir“).
2. Dialekt ins Hochdeutsche
Dialektale Ausdrücke werden möglichst ins Hochdeutsche übertragen. Wenn es kein passendes hochdeutsches Wort gibt, bleibt der Dialektausdruck stehen.
3. Stottern und Wortabbrüche weglassen
Wortdoppelungen, Stottern und abgebrochene Wörter werden in der Regel nicht übernommen. Eine Ausnahme sind Wiederholungen, die bewusst zur Betonung eingesetzt werden („nie, nie wieder“).
4. Satzabbrüche markieren
Bricht jemand einen Satz ab und beginnt neu, wird das mit einem Schrägstrich / gekennzeichnet.
5. Pausen kennzeichnen
Deutliche Pausen werden durch Auslassungspunkte in Klammern (...) dargestellt. Im einfachen System reicht diese einheitliche Markierung, ohne die Länge in Sekunden anzugeben.
6. Hörersignale des Interviewers
Verständnis- und Bestätigungslaute der interviewenden Person („mhm“, „ja“), die den Redefluss des Gegenübers nicht unterbrechen, werden üblicherweise nicht transkribiert – außer sie sind eine inhaltliche Antwort, etwa ein „Mhm“ als Zustimmung auf eine Frage.
7. Nonverbales in Klammern
Emotionale oder nonverbale Äußerungen, die eine Aussage einordnen – zum Beispiel Lachen oder Seufzen –, werden in Klammern notiert: (lacht), (seufzt).
8. Unverständliches markieren
Nicht verständliche Wörter oder Passagen werden mit (unv.) gekennzeichnet und mit einer Zeitmarke versehen, damit du oder andere die Stelle später prüfen können. Liegt die Ursache auf der Hand (Störgeräusch, Mikrofon), kann sie ergänzt werden.
9. Sprecherkürzel und Absätze
Die interviewende Person wird mit I gekennzeichnet, befragte Personen mit B (bei mehreren mit Nummer: B1, B2). Jeder Sprecherwechsel beginnt einen neuen Absatz, meist mit Leerzeile dazwischen.
10. Zeitmarken am Absatzende
Am Ende jedes Absatzes steht eine Zeitmarke, z. B. #00:03:41#. So findest du jede Stelle in der Aufnahme sofort wieder.
Was das erweiterte System zusätzlich erfasst
Im erweiterten System kommen weitere Details hinzu, unter anderem:
- Verzögerungslaute wie „äh“ oder „ähm“ werden mittranskribiert.
- Betonungen einzelner Wörter werden markiert.
- Pausenlängen werden genauer angegeben, etwa nach Sekunden.
- Teilweise werden auch Überlappungen (gleichzeitiges Sprechen) und Lautstärke- oder Tonfalländerungen festgehalten.
Wie genau diese Markierungen aussehen, legt das Original fest. Wenn du das erweiterte System nutzt, halte dich exakt daran und dokumentiere eventuelle Abweichungen.
Vorher-nachher: KI-Rohtext vs. einfache Regeln
So sieht ein typischer Ausschnitt aus, wie ihn eine KI-Transkription ausgibt. Der Text ist bereits interpunktiert und weitgehend flüssig, aber es fehlen Sprecher, Zeitmarken und Markierungen:
Kannst du erzählen, wie das bei euch im Team angefangen hat? Ja, also am
Anfang war das, das war eigentlich total chaotisch. Wir hatten keinen, wir
wussten nicht, wer wofür zuständig ist. Und dann hat die Sabine gesagt,
wir müssen das jetzt mal klären. Okay. Das war im März in Freiburg, glaub
ich.
Und so nach den Grundprinzipien des einfachen Systems, inklusive Anonymisierung:
I: Kannst du erzählen, wie das bei euch im Team angefangen hat? #00:03:12#
B1: Ja, also am Anfang war das eigentlich total chaotisch. Wir hatten
keinen / Wir wussten nicht, wer wofür zuständig ist. (...) Und dann hat
[Name Kollegin] gesagt, wir müssen das jetzt mal klären. (lacht) Das war
im [Frühjahr] in [Stadt], glaube ich. #00:03:38#
Was sich geändert hat:
- Sprecherkürzel I und B1 gesetzt, Absätze beim Sprecherwechsel
- Wortdoppelung „das, das war“ geglättet
- Satzabbruch „Wir hatten keinen /“ markiert
- Pause
(...)und Lachen(lacht)ergänzt – beides hört man nur in der Aufnahme - Hörersignal „Okay.“ des Interviewers entfernt, weil es den Redefluss nicht unterbricht
- „glaub ich“ an die Schriftsprache angenähert
- Name, Monat und Ort anonymisiert
- Zeitmarken am Absatzende ergänzt
Was die KI schon erledigt – und was du ergänzen musst
Moderne Spracherkennung auf Basis von Whisper liefert einen Text, der einigen Regeln des einfachen Systems bereits nahekommt. Trotzdem ersetzt sie die Nachbearbeitung nicht.
| Aufgabe | KI-Rohfassung | Deine Nacharbeit |
|---|---|---|
| Interpunktion, Groß-/Kleinschreibung | meist vorhanden | stichprobenartig prüfen |
| Geglätteter Lesetext | oft weitgehend, teils zu stark geglättet | Wortlaut mit Audio abgleichen |
| Füllwörter „äh“, „ähm“ | werden oft weggelassen | im erweiterten System ergänzen |
| Sprecherkürzel I/B | je nach Tool fehlend oder automatisch vergeben | setzen bzw. prüfen |
Satzabbrüche / | selten markiert | ergänzen |
Pausen (...), (lacht) | fehlen | beim Hören ergänzen |
Unverständliche Stellen (unv.) | KI „rät“ oft stattdessen | Unsicheres prüfen und markieren |
| Zeitmarken | vorhanden, aber nicht im Format #hh:mm:ss# | ins Regelformat übertragen |
| Anonymisierung | nicht vorhanden | vollständig manuell |
Besonders tückisch ist die vorletzte Zeile der Tabelle: Wo ein Mensch „(unv.)“ schreiben würde, produziert eine KI häufig ein plausibel klingendes, aber falsches Wort. Hör deshalb bei allen Stellen mit Störgeräuschen, leiser Stimme oder überlappendem Sprechen besonders genau hin.
Praxistipps für einheitliche Transkripte
- Regeln schriftlich fixieren. Lege ein kurzes Dokument an, in dem du dein Regelsystem und eventuelle Anpassungen festhältst (z. B. „Hörersignale werden nicht transkribiert“). Das kommt später in den Methodenteil.
- Kopfbereich nutzen. Notiere in jedem Transkript, nach welchen Regeln es erstellt wurde. Eine kopierbare Vorlage findest du in unserem Artikel zur Bachelorarbeit.
- Suchen & Ersetzen clever einsetzen. Zeitmarken-Format, Sprecherkürzel und Anonymisierung lassen sich mit der Suchfunktion deines Textprogramms systematisch prüfen.
- Erst Inhalt, dann Form. Korrigiere zuerst den Wortlaut mit Audio, danach in einem zweiten Durchgang Markierungen und Formatierung.
- Zeit realistisch einplanen. Das erweiterte System kostet spürbar mehr Zeit als das einfache. Wie viel du mit einer KI-Rohfassung gegenüber reinem Abtippen einsparen kannst, schätzt du mit dem Transkriptions-Kosten-Rechner ab.
- Sensible Daten bedenken. Dürfen deine Aufnahmen nicht in eine Cloud, ist ein lokales Tool die sauberere Lösung – einen fairen Vergleich findest du unter noScribe-Alternative.
- Mit der Betreuung abstimmen. Zeig nach dem ersten Interview einen Ausschnitt deines Transkripts. Ein kurzes Feedback früh spart dir das Überarbeiten aller Transkripte am Ende.
Fazit
Die Regeln nach Dresing & Pehl sind kein Selbstzweck: Sie sorgen dafür, dass deine Transkripte lesbar, einheitlich und wissenschaftlich nachvollziehbar sind. Das einfache System reicht für die meisten Abschlussarbeiten. Eine KI-Rohfassung nimmt dir das Abtippen ab – Sprecherkürzel, Markierungen und Anonymisierung bleiben aber deine Aufgabe.
Mehr zum kompletten Workflow findest du auf den Seiten Interview transkribieren und Transkription für Studenten.