Uitwerken is meer dan uittypen
Wie een interview uitwerkt, maakt van een gesprek een tekst waarmee je verder kunt: citeren in je scriptie, coderen voor je analyse of quotes kiezen voor een artikel. Uittypen is daar maar een deel van. Je beslist ook hoe letterlijk je werkt, hoe je de sprekers aanduidt, wat je weglaat om deelnemers te beschermen en hoe je nagaat of de tekst klopt met de opname.
Die keuzes verschillen per situatie. Een masterstudent sociologie die tien diepte-interviews thematisch analyseert, heeft een ander transcript nodig dan een journalist van een regionale krant die drie bruikbare quotes zoekt, of een student aan een Vlaamse hogeschool die voor haar bachelorproef één expert spreekt. Kijk daarom eerst in je scriptiehandleiding of onderzoeksprotocol. Veel opleidingen willen de transcripten in een bijlage zien, of verwachten dat je ze op verzoek aan je begeleider of examencommissie kunt laten zien.
Werk zo uit dat een ander met jouw transcript en jouw methodehoofdstuk precies kan nagaan waar een citaat vandaan komt. Dat betekent: tijdcodes of regelnummers bewaren, in elk interview dezelfde sprekeraanduiding gebruiken en elke ingreep (weggelaten namen, ingekorte passages) zichtbaar maken.
Letterlijk, opgeschoond of samengevat uitwerken
Er zijn grofweg drie manieren om een interview uit te werken. Welke je kiest, hangt af van je onderzoeksvraag en niet van wat het snelst gaat.
- Letterlijk (verbatim)
- Alles wat gezegd wordt, inclusief herhalingen, ‘eh’ en ‘uhm’, afgebroken zinnen, pauzes en gelach. Nodig bij gespreksanalyse, discourseanalyse of taalkundig onderzoek.
- Licht opgeschoond (clean verbatim)
- Inhoudelijk letterlijk, maar zonder stopwoorden, haperingen en dubbele zinsaanzetten. De gebruikelijke keuze voor scripties met een thematische analyse of inhoudsanalyse.
- Samengevat
- Per vraag of thema de kern in eigen woorden, aangevuld met een paar letterlijke citaten. Geschikt voor oriënterende gesprekken, journalistiek vooronderzoek of een expertinterview dat je alleen als achtergrond gebruikt.
Het verschil zie je het best aan één fragment. Stel dat een respondent, een wijkverpleegkundige, vertelt over haar werkdruk:
Letterlijk: "Nou ja, kijk, eh… je hebt dan, je hebt dan acht cliënten op je lijst en dan, eh, dan belt er weer iemand af (lacht)." Opgeschoond: "Je hebt dan acht cliënten op je lijst en dan belt er weer iemand af." Samengevat: R3 beschrijft dat afzeggingen haar dagplanning regelmatig in de war sturen.
Twijfel je tussen letterlijk en opgeschoond, lees dan het Engelstalige stuk over verbatim versus clean verbatim (Engels). In je methodehoofdstuk leg je in een paar zinnen uit welke variant je hebt gekozen en waarom. Begeleiders letten daar meer op dan je zou denken.
Voorbereiding: toestemming, opname en bestandsformaat
Een goed transcript begint al vóór het gesprek. Vraag schriftelijk toestemming om op te nemen en leg uit wat je met de opname en de uitwerking doet, hoe lang je ze bewaart en wie ze te zien krijgt. Universiteiten en hogescholen hebben daar meestal een standaardformulier voor (informed consent). De AVG verwacht in het algemeen dat je niet meer persoonsgegevens verzamelt dan nodig, dat je ze veilig opslaat en dat je ze zo vroeg mogelijk pseudonimiseert. Hoe dat binnen jouw onderzoek werkt, bespreek je met je begeleider of met de privacyfunctionaris van je instelling; dit artikel is geen juridisch advies.
Voor de opname zelf geldt: een rustige ruimte en een telefoon dicht bij beide sprekers doen meer dan welk programma achteraf ook. Leg de telefoon niet op een tafel waar kopjes worden neergezet, zet meldingen uit en neem een paar seconden proef op. Bij een online interview gebruik je de opnamefunctie van het videobelprogramma, uiteraard met instemming van je gesprekspartner. Je krijgt dan meestal een MP4- of M4A-bestand.
Let ook op het formaat. Een opname met de Dictafoon-app op een iPhone of met de standaardrecorder van veel Android-toestellen is doorgaans een M4A-bestand, en dat werkt zonder omzetten. Een WhatsApp-spraakbericht (.opus) of een telefoongesprek dat als .amr is opgeslagen, moet je eerst omzetten naar MP3 of M4A met een converter die je vertrouwt.
Zo werk je een interview uit met mydubly
mydubly is een webapp die opnames omzet in tekst. Voor interviews gebruik je de audiowerkplek; een video-opname van een Teams- of Zoomgesprek kan in de videowerkplek. Er is geen koppeling met die programma's: je uploadt gewoon het opnamebestand dat je zelf hebt bewaard. De interface is Engelstalig, dus de knoppen staan hieronder zoals je ze op het scherm ziet.
- Open mydubly in je browser en sleep je opname naar het vak ‘Drop audio here’ (of ‘Drop a video here’ bij een video-opname). Bestanden tot 2 uur per stuk worden geaccepteerd.
- Laat de schakelaar ‘Audio and text output’ uit staan. Je krijgt dan ‘Timestamped transcript only’: alleen een uitwerking, zonder nieuwe stem.
- De brontaal wordt automatisch herkend (‘Source: Auto detect’); je kunt Nederlands niet zelf instellen. Bij ‘Select language’ kies je wel altijd een taal: kies Nederlands voor een uitwerking in het Nederlands, die dan onvertaald terugkomt. Kies een andere taal als je de tekst vertaald wilt hebben, bijvoorbeeld Engels voor een internationale begeleider.
- Klik op ‘Transcribe audio’ en laat het tabblad open tot de uitwerking klaar is. Sluit je het tabblad, dan wordt de opdracht geannuleerd en krijg je de credits daarvan terug.
- Download de tekst met ‘Download transcript’ (platte tekst) en ‘Download timestamped transcript’ (dezelfde tekst met tijdcodes). Bewaar beide: de versie met tijdcodes heb je straks nodig om terug te luisteren.
Transcriberen kost 1 credit per minuut, met een minimum van 5 credits per bestand. Een interview van een uur kost dus 60 credits (US$ 0,06). Bij aanmelding krijg je 100 gratis credits, genoeg voor maximaal 100 minuten aan opnames. Er is geen abonnement: je waardeert op in hele dollars.
Je hebt acht interviews van 50 minuten en één lang gesprek van precies 2 uur. Acht keer 50 minuten is 400 minuten, dus 400 credits. Het lange gesprek kost 120 credits (US$ 0,12). Samen is dat 520 credits, oftewel US$ 0,52. De eerste 100 minuten vallen weg tegen je welkomstcredits; voor de rest is één opwaardering van US$ 1 ruim voldoende.
Over privacy: bij audio gaat het bestand via een HTTPS-verbinding naar de server; bij video blijft het videobestand zelf in je browser en wordt alleen de audio verstuurd. Geüploade audio en resultaten worden binnen 30 minuten na afronding van de opdracht van de server verwijderd. Of dat past binnen je datamanagementplan, beslis je samen met je instelling.
Wat mydubly niet doet, is net zo belangrijk. Het herkent geen sprekers, dus je krijgt doorlopende tekst zonder ‘interviewer’ en ‘respondent’. Er is geen bewerkscherm, geen samenvattingsfunctie en geen automatische anonimisering. Die stappen doe je zelf in Word of een andere teksteditor, zoals hieronder beschreven. Meer over de functie zelf lees je op de pagina over audio omzetten naar tekst (Engels).
Sprekers handmatig markeren
Omdat de ruwe uitwerking geen sprekers onderscheidt, voeg je die zelf toe. Dat gaat sneller dan het klinkt, zeker bij een klassiek interview waarin jij vraagt en de ander antwoordt.
- Kies één vaste notatie, bijvoorbeeld I: voor de interviewer en R1:, R2: enzovoort voor respondenten. Gebruik geen echte namen, ook niet tijdelijk.
- Begin elke spreekbeurt op een nieuwe regel. Vragen zijn meestal kort en eindigen op een vraagteken, dus de wissel zie je vaak al zonder te luisteren.
- Luister alleen bij twijfel terug: bij korte instemmende reacties (‘ja’, ‘precies’), bij onderbrekingen en wanneer iemand een ander citeert.
- Bij een focusgroep van vijf of zes deelnemers is markeren lastiger. Noteer tijdens het gesprek wie welke beurt begint, of vraag deelnemers zich bij hun eerste bijdrage kort voor te stellen.
Waarom software dit niet vanzelf goed doet, lees je in het Engelstalige stuk over sprekerherkenning of diarisatie (Engels).
I: Hoe ziet een gewone werkdag er voor jou uit? — R3: Ik begin om half acht met de overdracht en dan is het eigenlijk meteen rijden. — I: Rijden? — R3: Ja, van cliënt naar cliënt. Ik zit meer in de auto dan je zou denken.
Anonimiseren zonder je analyse te beschadigen
Anonimiseren betekent: alles weghalen of vervangen waarmee een lezer een deelnemer kan herkennen. Namen zijn het makkelijke deel. Lastiger zijn combinaties van gegevens: ‘de enige vrouwelijke wethouder in een kleine Zeeuwse gemeente’ is ook zonder naam herleidbaar.
- Vervang namen door codes of pseudoniemen en bewaar de sleutel (wie is R3?) in een apart, beveiligd bestand.
- Generaliseer plaatsen, werkgevers en functies: [gemeente in Zeeland], [zorgorganisatie], [teamleider].
- Zet vervangingen tussen rechte haken, zodat zichtbaar blijft dat je iets hebt aangepast.
- Let op details die pas in combinatie opvallen, zoals leeftijd, opleiding of een bijzondere gebeurtenis.
- Deel alleen geanonimiseerde versies. De originele opname bewaar en vernietig je zoals afgesproken in je datamanagementplan.
Zoeken en vervangen in Word helpt bij namen die vaak terugkomen, maar loop de tekst daarna nog een keer door. Spraakherkenning schrijft dezelfde naam soms op twee of drie manieren, en dan vang je met één zoekopdracht alleen de eerste.
Terugluisteren: de stap die je nooit overslaat
Een automatische uitwerking is een eerste versie. De spraakherkenning in mydubly is gebaseerd op Whisper, een opensource spraakherkenningsmodel. Hoe goed de tekst wordt, hangt sterk af van de geluidskwaliteit, het spreektempo, accenten en mensen die door elkaar praten. Controleer daarom altijd door de opname naast de tekst af te spelen.
- Open de versie met tijdcodes naast je mediaspeler en speel de opname af op iets lagere snelheid.
- Let vooral op eigennamen, getallen, afkortingen en vakjargon: ‘Wmo’ en ‘Wlz’, namen van instellingen, medicijnen of wetsartikelen.
- Markeer onverstaanbare stukken als [onverstaanbaar 00:14:32] in plaats van te gokken.
- Wees extra alert bij stiltes en achtergrondgeluid. Herkenningsmodellen voegen daar soms zinnen toe die niemand heeft uitgesproken; meer daarover in het stuk over Whisper-hallucinaties (Engels).
- Lees extra scherp bij dialect of tussentaal. Een Limburgse of West-Vlaamse respondent wordt soms naar standaardtaal ‘rechtgetrokken’ of juist verkeerd verstaan. Besluit bewust of je dialectwoorden letterlijk weergeeft.
Sommige opleidingen vragen ook om member checking: je legt het transcript of je interpretatie voor aan de deelnemer. Of dat bij jouw onderzoek past, lees je in het stuk over member checking (Engels).
Van uitwerking naar analyse en citaten
Met een gecontroleerd, geanonimiseerd transcript begint het eigenlijke werk. Een paar praktische gewoontes maken de analyse en het schrijven later een stuk makkelijker.
- Zet regelnummering aan in Word, zodat je in je analyse kunt verwijzen naar ‘R3, r. 112–118’.
- Codeer in een programma voor kwalitatieve analyse of gewoon met opmerkingen en markeerkleuren in Word. Het stuk over thematische analyse (Engels) beschrijft de stappen.
- In citaten in je scriptie mag je doorgaans licht opschonen voor de leesbaarheid, zolang je dat in je methode vermeldt en de betekenis niet verandert.
- Sprak je iemand in het Engels of Duits? Citeer in de originele taal en gebruik een automatische vertaling hooguit als hulpmiddel om sneller te begrijpen wat er staat.
- Heb je het interview op video en wil je een fragment laten zien bij je presentatie of verdediging? Van dezelfde opname kun je ook ondertitels maken.
Een overzicht van alles wat mydubly voor Nederlandstalige gebruikers kan, staat op de Nederlandse startpagina.
Veelgemaakte fouten bij het uitwerken
- Te lang wachten. Werk een interview bij voorkeur binnen een paar dagen uit, zolang je nog weet wat er gebeurde op momenten die slecht verstaanbaar zijn.
- Per interview een andere notatie gebruiken, waardoor je bij het coderen steeds moet schakelen.
- Gokken bij onverstaanbare passages in plaats van ze te markeren.
- Echte namen in bestandsnamen zetten, zoals ‘interview_jan_de_vries.m4a’, terwijl het transcript zelf keurig gepseudonimiseerd is.
- Een ruwe automatische uitwerking zonder controle als bijlage inleveren. Fouten in namen of getallen vallen een tweede lezer direct op en ondermijnen je betrouwbaarheid.
Veelgestelde vragen
Hoe lang duurt het om een interview uit te werken?
Volledig met de hand uittypen kost al snel een veelvoud van de opnameduur, zeker bij letterlijk uitwerken. Met automatische spraakherkenning heb je binnen korte tijd een eerste versie, maar reken daarna nog op een flinke controleronde. Hoe meer mensen door elkaar praten en hoe slechter de opname, hoe langer die controle duurt.
Mag ik AI gebruiken om interviews voor mijn scriptie uit te werken?
Dat bepaalt je opleiding, niet de software. Veel instellingen hebben inmiddels richtlijnen over AI-hulpmiddelen en over het verwerken van persoonsgegevens in onlinediensten. Vraag het na bij je begeleider of privacyfunctionaris en vermeld in je methodehoofdstuk hoe je de transcripten hebt gemaakt en gecontroleerd.
Moet ik ‘eh’ en ‘uhm’ ook uittypen?
Alleen als je letterlijk uitwerkt, bijvoorbeeld voor gespreksanalyse of taalkundig onderzoek. Voor de meeste scripties met een thematische analyse is een licht opgeschoonde uitwerking zonder stopwoorden gebruikelijk. Leg je keuze vast in je methode, zodat duidelijk is wat je hebt weggelaten.
Herkent mydubly wie er aan het woord is?
Nee. mydubly levert doorlopende tekst zonder sprekeraanduiding. Je voegt I: en R1: zelf toe in een teksteditor, met behulp van de versie met tijdcodes als je moet terugluisteren.
Kan ik een WhatsApp-spraakbericht of telefoongesprek uitwerken?
Ja, maar niet rechtstreeks. WhatsApp-spraakberichten (.opus) en .amr-opnames worden niet geaccepteerd; zet ze eerst om naar MP3 of M4A. Vraag ook hier vooraf toestemming aan degene die je opneemt.
Werkt het ook met Vlaams of een dialect?
De taal wordt automatisch herkend, ook bij Vlaamse uitspraak. Sterk dialect, tussentaal en snelle spraak worden vaker verkeerd verstaan dan standaardtaal. Plan bij zulke interviews extra tijd voor terugluisteren in.
Wat kost het uitwerken van mijn interviews?
Transcriberen kost 1 credit per minuut, met een minimum van 5 credits per bestand; een uur opname is 60 credits (US$ 0,06). Met de 100 gratis credits bij aanmelding kun je maximaal 100 minuten aan interviews uitwerken voordat je hoeft op te waarderen.
