Speaker Diarization in elke transcriptie – niet alleen in het duurste abonnement
Automatisch antwoord op de vraag 'Wie zei wat?' – voor vergaderingen, interviews, podcasts en focusgroepen.
3 gratis transcripties · geen creditcard · gegevens in Duitsland
Sprecher-Timeline
Fijn dat de afspraak is gelukt.
Heel graag. Zullen we meteen beginnen?
Ja – ik neem het gesprek op, is dat oké?
Speaker Diarization is het automatisch herkennen van wie op welk moment spreekt. Bij DeepScript zit het in beide abonnementen – Standard én Premium. Veel concurrenten bieden het pas in een Enterprise-abonnement aan of rekenen het apart. Wij vinden dat verkeerd: een transcriptie zonder sprekertoewijzing is voor vergaderingen en interviews vrijwel waardeloos. Premium biedt een fijnere granulariteit – vooral bij stemmen die op elkaar lijken of wanneer mensen door elkaar praten. Standard verwerkt betrouwbaar 2–6 sprekers, Premium schaalt moeiteloos naar 10+.
Bewijs
Waarop we dit baseren
Inbegrepen in Standard en Premium
Geen meerprijsval, geen 'alleen in het Enterprise-abonnement'. Diarization draait bij elke transcriptie.
Granulariteit op woordniveau
Elk afzonderlijk woord draagt een sprekerlabel – niet alleen hele zinnen. Sprekerwisselingen midden in een zin worden herkend.
Doorgaans 2 tot 10+ sprekers
Zelfs grote groepen – bestuursvergaderingen, panels, focusgroepen – worden betrouwbaar gescheiden.
Hernoembaar in de editor
'Spreker 1' → 'Dr. Meier' met één klik. De hernoeming wordt op elk voorkomen toegepast.
In de praktijk
Wat dat concreet betekent
Automatisch antwoord op de vraag 'Wie zei wat?' – voor vergaderingen, interviews, podcasts en focusgroepen.
- Tijdstempels op woordniveau inclusief sprekerlabel in de JSON-export – direct bruikbaar in NVivo, MAXQDA en andere kwalitatieve analysetools.
- SRT/VTT-ondertitels met sprekervoorvoegsel: elke ondertitel begint met de sprekernaam, bijv. 'Dr. Meier: …'
- In de editor gesynchroniseerd met de audiospeler – klik op een woord om naar de audiopositie te springen en de originele stem te horen.
- Anonieme sprekers blijven anoniem: je hoeft geen enkele naam toe te kennen, 'Spreker 1/2/3' is een geldige eindtoestand.
- Het Premium-model is beter bij overlappend spreken (cross-talk) en stemmen die op elkaar lijken (bijv. twee jonge vrouwen).
Sprecher-Timeline
Fijn dat de afspraak is gelukt.
Heel graag. Zullen we meteen beginnen?
Ja – ik neem het gesprek op, is dat oké?
Zo gebruik je het
In een paar stappen klaar voor gebruik
- 1
1. Audio met meerdere sprekers uploaden
Vergaderopname, interview, podcast – elk formaat met meerdere sprekers. Mono of stereo, het model herkent zelf wanneer iemand wisselt.
- 2
2. Transcriptie met sprekerlabels ontvangen
Het resultaat in de editor toont elke uiting met een sprekervoorvoegsel: 'Spreker 1: Goedemorgen. Spreker 2: Hallo allemaal.' Het aantal sprekers staat in de header.
- 3
3. Sprekers hernoemen
Klik op 'Spreker 1' → echte naam. Wordt automatisch op alle plekken in de transcriptie toegepast. Geen aparte stemmodellen nodig.
- 4
4. Exporteren met sprekerlabels
SRT/VTT voor ondertitels, JSON voor downstream-pipelines, TXT voor een schone leesversie. De sprekerinformatie blijft in elk formaat behouden.
FAQ
Veelgestelde vragen
Hoeveel sprekers kan het model onderscheiden?+
Doorgaans 2 tot 10+. Bij meer dan 10 zeer gelijkende stemmen (bijv. een schoolklas) kan verwarring optreden. Voor bestuursvergaderingen, panels en focusgroepen is die grens in de praktijk geen probleem.
Wat gebeurt er bij overlappend spreken?+
Bij cross-talk wijst het model de dominante stem toe en markeert het fragment met een lage confidence-score. Premium is hier merkbaar beter dan Standard. In de editor herken je betrokken passages aan de confidence-kleuring.
Moet ik de sprekers vooraf trainen?+
Nee. Diarization werkt zonder voice-enrollment – het model scheidt sprekers puur op basis van audiokenmerken, niet op vooraf opgeslagen stemprofielen. Privacyvoordeel: er worden geen biometrische stemmodellen opgeslagen.
Verschijnen de sprekerlabels ook in ondertitelbestanden?+
Ja. SRT- en VTT-exports zetten vóór elke ondertitel de sprekernaam: 'Dr. Meier: Laten we beginnen.' Als je de sprekers hebt hernoemd, verschijnen de echte namen; anders 'Spreker 1/2/3'.
Is dit geschikt voor kwalitatief onderzoek met NVivo of MAXQDA?+
Ja. De JSON-export bevat per woord `start`, `end`, `confidence` en `speaker`. Importeer in NVivo/MAXQDA via hun JSON- of platte-tekst-met-sprekermarkeringen-workflow. Heb je een specifiek exportformaat nodig, laat het ons weten.
Overtuig jezelf
Upload een bestand en zie het resultaat binnen enkele minuten. Drie gratis transcripties, geen creditcard.