Erklärt

Interview transkribieren: Welche Regeln in Bachelor- und Masterarbeiten gelten

Wer ein Interview für die Bachelor- oder Masterarbeit transkribiert, braucht vor allem ein festes Regelwerk, das im Methodenteil benannt und dann konsequent angewendet wird. Meist ist das eine einfache Transkription nach Dresing/Pehl oder Kuckartz; ein KI-Rohtranskript spart das Abtippen, die Regelanwendung, Sprecherkürzel und Anonymisierung bleiben aber Ihre Aufgabe.

9 Min. Lesezeit · Aktualisiert

Hinweis: Die Oberfläche von mydubly ist auf Englisch. Deutsche Aufnahmen transkribieren, ins Deutsche übersetzen und eine deutsche Stimme erzeugen funktioniert trotzdem – nur die Schaltflächen sind englisch beschriftet.

Warum Transkriptionsregeln in der Abschlussarbeit zählen

Ein Transkript ist in einer qualitativen Arbeit kein Nebenprodukt, sondern Ihr eigentliches Datenmaterial. Alles, was Sie später kodieren, zitieren und interpretieren, stützt sich auf diesen Text. Gutachterinnen und Gutachter achten deshalb weniger darauf, welches Regelwerk Sie wählen, sondern darauf, ob Sie es nachvollziehbar begründen und durchgehend einhalten.

Praktisch heißt das: Im Methodenkapitel steht ein Satz wie „Die Interviews wurden nach den einfachen Transkriptionsregeln von Dresing und Pehl verschriftlicht“, idealerweise mit Literaturangabe. Im Anhang finden sich die Transkripte selbst, oft mit Zeilennummern, damit Sie im Text sauber zitieren können, etwa „(B2, Z. 145–150)“. Wer zwischendurch die Regeln wechselt, mal „ähm“ mitschreibt und mal nicht, macht das Material angreifbar.

Bevor Sie anfangen, lohnt sich ein kurzer Blick in die Vorgaben Ihres Lehrstuhls oder ein Gespräch mit der Betreuung. Manche Institute haben eigene Transkriptionsrichtlinien, andere überlassen die Wahl ausdrücklich Ihnen.

Einfache und erweiterte Transkription im Vergleich

Die wichtigste Entscheidung betrifft den Detailgrad. In den Sozial- und Erziehungswissenschaften, in der Pflegeforschung oder in BWL-Arbeiten mit Experteninterviews interessiert in der Regel der Inhalt: Was sagt die befragte Person? Dafür genügt eine einfache, leicht geglättete Transkription. Geht es dagegen um das Wie, also um Zögern, Überlappungen, Betonung oder Gesprächsdynamik, brauchen Sie eine erweiterte oder feinere Transkription.

Einfache Transkription
Wörtlich, aber an die Schriftsprache angenähert; Fokus auf Inhalt; üblich bei Experten- und Leitfadeninterviews
Erweiterte Transkription
Zusätzlich Pausenlängen, Füllwörter, Abbrüche, Betonungen und Überlappungen; sinnvoll bei Biografie- oder Narrationsanalyse
Aufwand
Einfache Varianten gehen deutlich schneller; erweiterte Transkripte erfordern mehrfaches Hören jeder Passage
Typische Fächer
Einfach: Soziologie, BWL, Pädagogik, Gesundheitswissenschaften; erweitert: Linguistik, Gesprächsforschung, Psychologie mit Fokus auf Sprechweise

Eine Faustregel: Transkribieren Sie so genau, wie es Ihre Forschungsfrage verlangt, und nicht genauer. Wer für eine inhaltlich-strukturierende Inhaltsanalyse jede Pause in Zehntelsekunden notiert, verliert Wochen ohne Erkenntnisgewinn. Einen guten Überblick über diese Abwägung bietet unser englischer Beitrag zu wörtlicher und geglätteter Transkription (Englisch).

Die gängigen Regelsysteme richtig einordnen

Im deutschsprachigen Raum begegnen Ihnen vor allem drei Ansätze:

  • Dresing/Pehl: Aus dem „Praxisbuch Interview, Transkription & Analyse“ stammen ein einfaches und ein erweitertes Regelsystem. Das einfache System ist an vielen Hochschulen der De-facto-Standard für Abschlussarbeiten, weil es kurz, gut lesbar und leicht zu zitieren ist.
  • Kuckartz: In den Lehrbüchern zur qualitativen Inhaltsanalyse finden sich ähnliche, ebenfalls inhaltsorientierte Regeln. Wer methodisch mit Kuckartz arbeitet, greift oft auch zu dessen Transkriptionsvorgaben.
  • GAT 2: Das Gesprächsanalytische Transkriptionssystem kommt aus der Linguistik und kennt mehrere Genauigkeitsstufen vom Minimal- bis zum Feintranskript. Für eine inhaltliche Auswertung ist es meist zu detailliert.

Achten Sie darauf, welche Auflage Sie zitieren. Die Regeln wurden über die Jahre angepasst, zum Beispiel bei der Notation von Pausen. Wenn Sie eine Regel bewusst abwandeln, etwa weil Sie Dialektfärbung beibehalten möchten, dokumentieren Sie die Abweichung im Methodenteil. Weitere Hintergründe zu Konventionen in der Forschung finden Sie in unserem Artikel über Transkriptionskonventionen (Englisch).

Typische Regeln einer einfachen Transkription

Die folgenden Punkte geben wieder, wie einfache, inhaltsorientierte Regelwerke üblicherweise aufgebaut sind. Maßgeblich bleibt immer die Fassung, die Sie im Methodenteil angeben.

  • Es wird wörtlich transkribiert, nicht zusammengefasst. Dialekt wird in der Regel ins Hochdeutsche übertragen, sofern das ohne Sinnverlust möglich ist.
  • Wortverschleifungen werden an die Schriftsprache angenähert: Aus „so'n Buch“ wird „so ein Buch“, aus „hamma“ wird „haben wir“.
  • Die Satzstellung bleibt erhalten, auch wenn sie grammatisch holpert. Glätten heißt nicht umformulieren.
  • Wort- und Satzabbrüche werden mit einem Schrägstrich markiert, zum Beispiel „Ich wollte eigentlich / also wir haben dann“.
  • Deutliche Pausen werden durch Auslassungspunkte in Klammern gekennzeichnet.
  • Besonders betonte Wörter erscheinen in Großbuchstaben.
  • Zustimmende Laute der interviewenden Person wie „mhm“ werden nur notiert, wenn sie den Redefluss unterbrechen oder inhaltlich bedeutsam sind.
  • Nonverbales steht in Klammern, etwa (lacht) oder (seufzt), unverständliche Passagen als (unv.), am besten mit Zeitmarke.
  • Jeder Sprecherwechsel beginnt einen neuen Absatz; die interviewende Person erhält das Kürzel I, die befragte Person B, bei mehreren Befragten B1, B2 und so weiter.
Beispiel: Ausschnitt nach einfachen Regeln

I: Wie sind Sie damals zur Pflege gekommen? #00:03:12# B: Eigentlich über meine Oma. (...) Die war lange krank, und ich hab / also ich habe sie dann mitversorgt. Das war für mich KEIN Plan, das hat sich so ergeben. (lacht) #00:03:31#

Zeitmarken: wie oft und wozu

Zeitmarken verbinden den Text mit der Aufnahme. Sie helfen Ihnen, beim Kodieren schnell zur Originalstelle zurückzuspringen, wenn ein Satz mehrdeutig klingt, und sie machen unverständliche Stellen überprüfbar. Üblich ist eine Zeitmarke am Ende jedes Sprecherbeitrags oder zumindest bei jedem Sprecherwechsel. Bei langen Monologen setzen manche Lehrstühle zusätzlich etwa jede Minute eine Marke.

Im Anhang der fertigen Arbeit sind Zeitmarken nicht zwingend, schaden aber selten. Wichtiger sind dort Zeilennummern, weil Sie im Fließtext nach Zeilen zitieren. Klären Sie mit Ihrer Betreuung, ob die Transkripte vollständig in den Anhang gehören oder ob ein separater Datenträger beziehungsweise ein Upload genügt.

Anonymisierung: mehr als Namen schwärzen

Sobald Sie Interviews mit realen Personen führen, verarbeiten Sie personenbezogene Daten. Die Datenschutz-Grundverordnung erwartet im Allgemeinen eine informierte Einwilligung, Datensparsamkeit und den Schutz vor Re-Identifizierung. Was genau Ihre Hochschule verlangt, steht meist in einer Vorlage für die Einwilligungserklärung; bei Unsicherheit fragen Sie die Betreuung oder die Datenschutzbeauftragte Ihrer Hochschule. Unser Beitrag zum Datenschutz bei der Transkription vertieft das Thema.

Für das Transkript selbst haben sich diese Schritte bewährt:

  • Namen von Personen, Firmen, Kliniken, Schulen und Orten durch Platzhalter in eckigen Klammern ersetzen, etwa [Name Kollegin], [Klinik A] oder [Kleinstadt in Niederbayern].
  • Indirekte Merkmale prüfen: Eine seltene Berufsbezeichnung plus Ortsangabe plus Alter kann eine Person eindeutig machen, auch ohne Namen.
  • Eine Zuordnungstabelle zwischen Pseudonym und echter Identität getrennt vom Transkript und geschützt aufbewahren oder, wenn nicht mehr benötigt, löschen.
  • Die Originalaufnahme nach Abschluss so behandeln, wie es die Einwilligung vorsieht, und nicht unbegrenzt auf dem Laptop liegen lassen.

Anonymisieren Sie am besten in einem eigenen Durchgang nach der Korrektur, mit der Suchfunktion Ihres Textprogramms. So übersehen Sie keine Stelle, an der ein Name später noch einmal fällt.

Was ein KI-Rohtranskript leistet und was Handarbeit bleibt

Die zeitaufwendigste Phase ist das reine Abtippen. Je nach Tippgeschwindigkeit und Tonqualität brauchen viele Studierende ein Vielfaches der Interviewdauer dafür. Genau diesen Schritt kann automatische Spracherkennung übernehmen. Mit mydubly laden Sie Ihre Aufnahme im Audio-Bereich unter „Drop audio here“ hoch, lassen den Schalter „Audio and text output“ ausgeschaltet, damit nur ein Transkript mit Zeitangaben entsteht, und starten mit „Transcribe audio“. Die Sprache wird automatisch erkannt, Sie müssen also nichts einstellen. Anschließend laden Sie mit „Download transcript“ den reinen Text oder mit „Download timestamped transcript“ die Fassung mit Zeitangaben als TXT-Datei herunter. Mehr zur Funktion steht auf der Seite Audio in Text (Englisch).

Die Spracherkennung basiert auf Whisper, einem quelloffenen Modell. Die Qualität hängt stark von der Aufnahme ab: Ein ruhiger Raum und ein nahes Mikrofon helfen mehr als jede Software, Nebengeräusche, starker Dialekt, Fachbegriffe und Eigennamen führen zu Fehlern. Laufende Aufnahmen kann mydubly nicht live mitschreiben, es arbeitet ausschließlich mit fertigen Dateien bis zu zwei Stunden Länge. Formate wie MP3, M4A, WAV oder FLAC werden angenommen, Sprachmemos vom iPhone liegen meist ohnehin als M4A vor.

Ebenso wichtig ist, was das Rohtranskript nicht liefert:

  • Keine Sprecherkennzeichnung: Wer I und wer B ist, tragen Sie selbst ein.
  • Keine Regelanwendung: Pausen in Klammern, Großbuchstaben für Betonung, (lacht) oder Schrägstriche bei Abbrüchen fügen Sie beim Korrekturhören ein.
  • Keine Anonymisierung und keine Zeilennummern.
  • Keine Bearbeitungsoberfläche: Die TXT-Datei öffnen Sie in Word, LibreOffice oder einem Analyseprogramm Ihrer Wahl und bearbeiten sie dort.

Füllwörter, Stottern und abgebrochene Sätze erfasst KI-Spracherkennung oft nicht vollständig, weil sie auf lesbaren Text hin trainiert ist. Für eine einfache Transkription ist das eher ein Vorteil, für eine erweiterte bedeutet es zusätzliche Nacharbeit.

Zum Datenschutz: Bei mydubly wird die Audiodatei über HTTPS verarbeitet, und hochgeladene Audiodateien sowie Ergebnisse werden innerhalb von 30 Minuten nach Abschluss des Auftrags vom Server gelöscht. Ob ein externer Dienst für Ihre Daten überhaupt zulässig ist, entscheidet Ihre Einwilligungserklärung, nicht die Software. Klären Sie das vorab mit Ihrer Hochschule.

Rechenbeispiel: vier Leitfadeninterviews

Sie haben vier Interviews mit 38, 52, 45 und 61 Minuten aufgenommen. Abgerechnet wird pro angefangener Minute im Transkript-Tarif mit 1 Credit pro Minute: 38 + 52 + 45 + 61 = 196 Credits. Die 100 Gratis-Credits nach der Registrierung decken die ersten beiden Interviews vollständig ab; für die übrigen 96 Credits reicht eine Aufladung von einem Dollar, die 1.000 Credits bringt.

Vom Rohtranskript zum zitierfähigen Text

Ein bewährter Ablauf für die Nachbearbeitung sieht so aus:

  1. Rohtranskript erzeugen und die Datei sofort unter einem neutralen Dateinamen speichern, etwa „Interview_B3_roh.txt“.
  2. Beim ersten Korrekturhören die Aufnahme mit leicht reduzierter Geschwindigkeit abspielen und Erkennungsfehler, falsch verstandene Fachbegriffe und Eigennamen korrigieren.
  3. Sprecherkürzel I und B setzen und an jedem Sprecherwechsel einen neuen Absatz beginnen.
  4. Im zweiten Durchgang die Notation nach Ihrem Regelwerk ergänzen: Pausen, Abbrüche, Betonungen, nonverbale Äußerungen, (unv.) mit Zeitmarke.
  5. Anonymisieren und die Zuordnungstabelle separat ablegen.
  6. Zeilennummern einfügen, Kopfzeile mit Interviewcode, Datum, Dauer und Transkriptionsregeln ergänzen.
  7. Stichprobenartig einige Minuten gegenhören, ob die Regeln über alle Interviews hinweg gleich angewendet wurden.

Hilfreich für Schritt 2 ist unsere englische Anleitung zum Korrekturlesen eines KI-Transkripts (Englisch). Wer wissen möchte, wie lange die Nacharbeit realistisch dauert, findet Anhaltspunkte im Beitrag wie lange das Transkribieren eines Interviews dauert (Englisch).

Häufige Fehler, die in Gutachten auftauchen

  • Kein Regelwerk genannt oder nur „in Anlehnung an“ ohne Erläuterung, welche Regeln abgewandelt wurden.
  • KI-Ausgabe ungeprüft in den Anhang übernommen, inklusive offensichtlich falsch erkannter Begriffe.
  • Uneinheitliche Notation zwischen den Interviews, weil sie zu unterschiedlichen Zeitpunkten oder von verschiedenen Personen transkribiert wurden.
  • Anonymisierung nur bei Namen, während Arbeitgeber, Wohnort und Funktion im Klartext stehen bleiben.
  • Zitate im Fließtext ohne Fundstelle, sodass niemand die Aussage im Anhang wiederfindet.
  • Glättung, die in Umformulierung kippt: Wer Aussagen grammatisch „verbessert“, verändert Daten.

Wenn Sie neben Interviews auch Gruppendiskussionen oder Arbeitstreffen auswerten, lohnt ein Blick in den Beitrag zum Protokoll aus einer Meeting-Aufnahme, denn bei vielen Sprechenden wird die Zuordnung noch aufwendiger.

Häufige Fragen

Welche Transkriptionsregeln soll ich für meine Bachelorarbeit nehmen?

Wenn Ihr Lehrstuhl nichts vorgibt, ist die einfache Transkription nach Dresing/Pehl oder nach Kuckartz für inhaltliche Auswertungen eine verbreitete und gut begründbare Wahl. Entscheidend ist, dass Sie das Regelwerk im Methodenteil mit Quelle nennen und es in allen Interviews gleich anwenden. Für gesprächsanalytische Fragestellungen ist ein detaillierteres System wie GAT 2 passender.

Darf ich ein Interview für die Abschlussarbeit mit KI transkribieren lassen?

Viele Hochschulen erlauben KI-gestützte Transkription, wenn Sie das Ergebnis selbst prüfen und im Methodenteil offenlegen, wie das Transkript entstanden ist. Prüfen Sie außerdem, ob Ihre Einwilligungserklärung die Verarbeitung durch einen externen Dienst abdeckt. Im Zweifel fragen Sie Ihre Betreuung oder die Datenschutzstelle der Hochschule.

Muss ich „ähm“ und „äh“ mittranskribieren?

Bei einer einfachen Transkription werden Fülllaute meist weggelassen oder nur notiert, wenn sie inhaltlich etwas bedeuten, etwa langes Zögern vor einer heiklen Antwort. Bei erweiterten Systemen gehören sie dazu. Legen Sie die Regel einmal fest und bleiben Sie dabei.

Wie anonymisiere ich ein Interviewtranskript richtig?

Ersetzen Sie Namen von Personen, Organisationen und Orten durch neutrale Platzhalter in eckigen Klammern und prüfen Sie zusätzlich Kombinationen aus Alter, Beruf und Region, die eine Person erkennbar machen. Die Zuordnung zwischen Pseudonym und echter Person bewahren Sie getrennt und geschützt auf. Was im Einzelfall nötig ist, hängt von Ihrer Einwilligungserklärung und den Vorgaben der Hochschule ab.

Erkennt mydubly, wer im Interview spricht?

Nein, mydubly kennzeichnet keine Sprecher. Sie erhalten fortlaufenden Text mit Zeitangaben und setzen die Kürzel I und B beim Korrekturhören selbst. Bei einem klassischen Zweiergespräch geht das schnell, bei Gruppeninterviews kostet es mehr Zeit.

Was kostet die Transkription eines einstündigen Interviews mit mydubly?

Ein 60-minütiges Interview kostet im Transkript-Tarif 60 Credits, also sechs US-Cent. Die 100 Gratis-Credits, die Sie bei der Registrierung erhalten, reichen dafür, und es bleiben 40 Credits übrig. Weitere Credits laden Sie ohne Abo in ganzen Dollarbeträgen auf.

Mein Interview liegt als WhatsApp-Sprachnachricht vor. Geht das?

WhatsApp-Sprachnachrichten im Format .opus nimmt mydubly nicht direkt an. Wandeln Sie die Datei zunächst mit einem Konverter Ihres Vertrauens in MP3 oder M4A um und laden Sie sie dann hoch. Für ein ernsthaftes Forschungsinterview ist eine eigene Aufnahme mit gutem Mikrofon aber ohnehin die bessere Grundlage.