8. September 2026·7 Min. Lesezeit·Scriptivo Team

Transkriptionsregeln nach Dresing & Pehl einfach erklärt

Transkriptionsregeln nach Dresing & Pehl verständlich erklärt: einfaches vs. erweitertes System, Vorher-nachher-Beispiel und was du bei KI-Transkripten ergänzt.

TranskriptionsregelnDresing & PehlQualitative ForschungStudiumInterview

Warum überhaupt Transkriptionsregeln?

Gesprochene Sprache ist chaotisch: Menschen brechen Sätze ab, setzen neu an, lachen, zögern, sprechen Dialekt. Wer ein Interview verschriftlicht, muss ständig entscheiden, was davon ins Transkript gehört – und wie es aussehen soll. Ohne feste Regeln entscheidest du bei Interview 1 anders als bei Interview 7, und deine Auswertung wird angreifbar.

Transkriptionsregeln sorgen dafür, dass alle deine Transkripte einheitlich, nachvollziehbar und vergleichbar sind. Im deutschsprachigen Raum wird dafür in vielen Fächern auf das Transkriptionssystem von Thorsten Dresing und Thorsten Pehl zurückgegriffen. In diesem Artikel erklären wir die Grundprinzipien in eigenen Worten – als Einstieg, nicht als Ersatz für die Originalquelle.

Originalquelle nutzen: Die vollständigen Regeln findest du im Buch „Praxisbuch Interview, Transkription & Analyse“ von Thorsten Dresing und Thorsten Pehl. Es ist über die Website der Autoren auch kostenlos als PDF erhältlich. Zitiere in deiner Arbeit immer die Originalquelle und die dort verwendete Auflage – und stimme mit deiner Betreuung ab, welches Regelsystem (und welche Anpassungen) für dein Projekt gelten.

Einfaches und erweitertes Transkriptionssystem

Dresing & Pehl unterscheiden grob zwei Detailstufen:

  • Einfaches Transkriptionssystem: Der Fokus liegt auf dem Inhalt des Gesagten. Der Text wird gut lesbar geglättet, ohne dass Inhalte verloren gehen. Das reicht für die meisten Abschlussarbeiten, bei denen du z. B. mit einer qualitativen Inhaltsanalyse arbeitest.
  • Erweitertes Transkriptionssystem: Hier werden zusätzlich sprachliche und parasprachliche Details festgehalten – etwa Verzögerungslaute, Betonungen oder die genaue Länge von Pausen. Das ist sinnvoll, wenn es auch darum geht, wie etwas gesagt wird, zum Beispiel bei Gesprächs- oder Diskursanalysen.

Für eine Bachelor- oder Masterarbeit mit inhaltlichem Fokus ist das einfache System meist die richtige Wahl. Es spart dir auch erheblich Zeit.

Die Grundprinzipien des einfachen Systems – in eigenen Worten

Die folgende Übersicht fasst die zentralen Ideen zusammen. Die genauen Formulierungen und Sonderfälle stehen im Original.

1. Wörtlich, aber geglättet

Es wird wörtlich transkribiert, nicht zusammengefasst oder lautsprachlich. Gleichzeitig wird die Sprache leicht geglättet: Satzbau-Fehler bleiben erhalten, aber umgangssprachliche Verschleifungen werden an die Schriftsprache angenähert (aus „hamma“ wird „haben wir“).

2. Dialekt ins Hochdeutsche

Dialektale Ausdrücke werden möglichst ins Hochdeutsche übertragen. Wenn es kein passendes hochdeutsches Wort gibt, bleibt der Dialektausdruck stehen.

3. Stottern und Wortabbrüche weglassen

Wortdoppelungen, Stottern und abgebrochene Wörter werden in der Regel nicht übernommen. Eine Ausnahme sind Wiederholungen, die bewusst zur Betonung eingesetzt werden („nie, nie wieder“).

4. Satzabbrüche markieren

Bricht jemand einen Satz ab und beginnt neu, wird das mit einem Schrägstrich / gekennzeichnet.

5. Pausen kennzeichnen

Deutliche Pausen werden durch Auslassungspunkte in Klammern (...) dargestellt. Im einfachen System reicht diese einheitliche Markierung, ohne die Länge in Sekunden anzugeben.

6. Hörersignale des Interviewers

Verständnis- und Bestätigungslaute der interviewenden Person („mhm“, „ja“), die den Redefluss des Gegenübers nicht unterbrechen, werden üblicherweise nicht transkribiert – außer sie sind eine inhaltliche Antwort, etwa ein „Mhm“ als Zustimmung auf eine Frage.

7. Nonverbales in Klammern

Emotionale oder nonverbale Äußerungen, die eine Aussage einordnen – zum Beispiel Lachen oder Seufzen –, werden in Klammern notiert: (lacht), (seufzt).

8. Unverständliches markieren

Nicht verständliche Wörter oder Passagen werden mit (unv.) gekennzeichnet und mit einer Zeitmarke versehen, damit du oder andere die Stelle später prüfen können. Liegt die Ursache auf der Hand (Störgeräusch, Mikrofon), kann sie ergänzt werden.

9. Sprecherkürzel und Absätze

Die interviewende Person wird mit I gekennzeichnet, befragte Personen mit B (bei mehreren mit Nummer: B1, B2). Jeder Sprecherwechsel beginnt einen neuen Absatz, meist mit Leerzeile dazwischen.

10. Zeitmarken am Absatzende

Am Ende jedes Absatzes steht eine Zeitmarke, z. B. #00:03:41#. So findest du jede Stelle in der Aufnahme sofort wieder.

Was das erweiterte System zusätzlich erfasst

Im erweiterten System kommen weitere Details hinzu, unter anderem:

  • Verzögerungslaute wie „äh“ oder „ähm“ werden mittranskribiert.
  • Betonungen einzelner Wörter werden markiert.
  • Pausenlängen werden genauer angegeben, etwa nach Sekunden.
  • Teilweise werden auch Überlappungen (gleichzeitiges Sprechen) und Lautstärke- oder Tonfalländerungen festgehalten.

Wie genau diese Markierungen aussehen, legt das Original fest. Wenn du das erweiterte System nutzt, halte dich exakt daran und dokumentiere eventuelle Abweichungen.

Vorher-nachher: KI-Rohtext vs. einfache Regeln

So sieht ein typischer Ausschnitt aus, wie ihn eine KI-Transkription ausgibt. Der Text ist bereits interpunktiert und weitgehend flüssig, aber es fehlen Sprecher, Zeitmarken und Markierungen:

Kannst du erzählen, wie das bei euch im Team angefangen hat? Ja, also am
Anfang war das, das war eigentlich total chaotisch. Wir hatten keinen, wir
wussten nicht, wer wofür zuständig ist. Und dann hat die Sabine gesagt,
wir müssen das jetzt mal klären. Okay. Das war im März in Freiburg, glaub
ich.

Und so nach den Grundprinzipien des einfachen Systems, inklusive Anonymisierung:

I: Kannst du erzählen, wie das bei euch im Team angefangen hat? #00:03:12#

B1: Ja, also am Anfang war das eigentlich total chaotisch. Wir hatten
keinen / Wir wussten nicht, wer wofür zuständig ist. (...) Und dann hat
[Name Kollegin] gesagt, wir müssen das jetzt mal klären. (lacht) Das war
im [Frühjahr] in [Stadt], glaube ich. #00:03:38#

Was sich geändert hat:

  • Sprecherkürzel I und B1 gesetzt, Absätze beim Sprecherwechsel
  • Wortdoppelung „das, das war“ geglättet
  • Satzabbruch „Wir hatten keinen /“ markiert
  • Pause (...) und Lachen (lacht) ergänzt – beides hört man nur in der Aufnahme
  • Hörersignal „Okay.“ des Interviewers entfernt, weil es den Redefluss nicht unterbricht
  • „glaub ich“ an die Schriftsprache angenähert
  • Name, Monat und Ort anonymisiert
  • Zeitmarken am Absatzende ergänzt

Was die KI schon erledigt – und was du ergänzen musst

Moderne Spracherkennung auf Basis von Whisper liefert einen Text, der einigen Regeln des einfachen Systems bereits nahekommt. Trotzdem ersetzt sie die Nachbearbeitung nicht.

AufgabeKI-RohfassungDeine Nacharbeit
Interpunktion, Groß-/Kleinschreibungmeist vorhandenstichprobenartig prüfen
Geglätteter Lesetextoft weitgehend, teils zu stark geglättetWortlaut mit Audio abgleichen
Füllwörter „äh“, „ähm“werden oft weggelassenim erweiterten System ergänzen
Sprecherkürzel I/Bje nach Tool fehlend oder automatisch vergebensetzen bzw. prüfen
Satzabbrüche /selten markiertergänzen
Pausen (...), (lacht)fehlenbeim Hören ergänzen
Unverständliche Stellen (unv.)KI „rät“ oft stattdessenUnsicheres prüfen und markieren
Zeitmarkenvorhanden, aber nicht im Format #hh:mm:ss#ins Regelformat übertragen
Anonymisierungnicht vorhandenvollständig manuell

Besonders tückisch ist die vorletzte Zeile der Tabelle: Wo ein Mensch „(unv.)“ schreiben würde, produziert eine KI häufig ein plausibel klingendes, aber falsches Wort. Hör deshalb bei allen Stellen mit Störgeräuschen, leiser Stimme oder überlappendem Sprechen besonders genau hin.

Praxistipps für einheitliche Transkripte

  1. Regeln schriftlich fixieren. Lege ein kurzes Dokument an, in dem du dein Regelsystem und eventuelle Anpassungen festhältst (z. B. „Hörersignale werden nicht transkribiert“). Das kommt später in den Methodenteil.
  2. Kopfbereich nutzen. Notiere in jedem Transkript, nach welchen Regeln es erstellt wurde. Eine kopierbare Vorlage findest du in unserem Artikel zur Bachelorarbeit.
  3. Suchen & Ersetzen clever einsetzen. Zeitmarken-Format, Sprecherkürzel und Anonymisierung lassen sich mit der Suchfunktion deines Textprogramms systematisch prüfen.
  4. Erst Inhalt, dann Form. Korrigiere zuerst den Wortlaut mit Audio, danach in einem zweiten Durchgang Markierungen und Formatierung.
  5. Zeit realistisch einplanen. Das erweiterte System kostet spürbar mehr Zeit als das einfache. Wie viel du mit einer KI-Rohfassung gegenüber reinem Abtippen einsparen kannst, schätzt du mit dem Transkriptions-Kosten-Rechner ab.
  6. Sensible Daten bedenken. Dürfen deine Aufnahmen nicht in eine Cloud, ist ein lokales Tool die sauberere Lösung – einen fairen Vergleich findest du unter noScribe-Alternative.
  7. Mit der Betreuung abstimmen. Zeig nach dem ersten Interview einen Ausschnitt deines Transkripts. Ein kurzes Feedback früh spart dir das Überarbeiten aller Transkripte am Ende.

Fazit

Die Regeln nach Dresing & Pehl sind kein Selbstzweck: Sie sorgen dafür, dass deine Transkripte lesbar, einheitlich und wissenschaftlich nachvollziehbar sind. Das einfache System reicht für die meisten Abschlussarbeiten. Eine KI-Rohfassung nimmt dir das Abtippen ab – Sprecherkürzel, Markierungen und Anonymisierung bleiben aber deine Aufgabe.

Mehr zum kompletten Workflow findest du auf den Seiten Interview transkribieren und Transkription für Studenten.

KI-Rohfassung deines Interviews kostenlos erstellen →


Jetzt kostenlos Audio transkribieren

Teste Scriptivo gratis — keine Registrierung nötig.