Vragen en antwoorden
Heldere antwoorden op veelgestelde vragen over transcriptie
Echte vragen die mensen stellen over automatische transcriptie – van AVG en geheimhoudingsplicht tot API-patronen en Zwitserduits. Inhoudelijke antwoorden, geen marketingpraatjes.
Basiskennis
Wat is automatische transcriptie?
Automatische transcriptie is de AI-gestuurde omzetting van gesproken taal naar geschreven tekst – in seconden, zonder dat een mens hoeft te typen.
Wat is het verschil tussen transcriptie, bijschriften en ondertitels?
Transcriptie is de kale tekst; bijschriften tonen die synchroon met de video; ondertitels vertalen die bovendien naar een andere taal.
Hoe lang duurt het om een uur audio te transcriberen?
Een AI doet doorgaans 1-3 minuten over een uur audio; een ervaren menselijke transcribent heeft 4-6 uur plus controle nodig.
Nauwkeurigheid en kwaliteit
Hoe nauwkeurig is AI-transcriptie?
Op schone studio-audio haalt AI tegenwoordig 95-98% nauwkeurigheid (woordfoutpercentage 2-5%); bij ruis, dialect of meerdere sprekers kan dat zakken tot 70-85%.
Hoe kan ik de nauwkeurigheid van mijn transcriptie verbeteren?
Betere microfoons, minder galm, een Custom Vocabulary voor jargon, een premium-model en een gedisciplineerde sprekeropstelling verhogen de nauwkeurigheid meestal met 5-15 procentpunten.
Compliance en recht
Is AI-transcriptie AVG-conform?
Ja, maar alleen met een verwerkersovereenkomst (DPA) op grond van Art. 28 AVG, dataopslag in de EU, een duidelijk verbod op gebruik voor training en vastgelegde verwijdertermijnen – anders niet.
Is het legaal om een vergadering te transcriberen?
In Duitsland alleen met toestemming van alle deelnemers – § 201 StGB stelt het heimelijk opnemen van niet-openbaar gesproken woord strafbaar.
Waar worden mijn audiobestanden opgeslagen tijdens het transcriberen?
Dat hangt van de aanbieder af – en het is de belangrijkste vraag. Serieuze EU-aanbieders slaan op in Duitse of EU-datacenters; Amerikaanse cloud-API's in de VS.
Worden mijn audiobestanden gebruikt om AI-modellen te trainen?
Bij sommige Amerikaanse aanbieders wel, tenzij je actief bezwaar maakt. Serieuze aanbieders sluiten het contractueel uit – vraag ernaar en lees de voorwaarden.
Mag ik patiëntgesprekken of medische opnames laten transcriberen?
Ja, maar onder strikte voorwaarden: Art. 9 AVG (gezondheidsgegevens), § 203 StGB (medisch beroepsgeheim), een DPA met geheimhoudingsclausule – en gegevensopslag in de EU.
Handleidingen
Hoe transcribeer ik een interview op de juiste manier?
Een schone opname + een eerste AI-ronde + 30-60 minuten nabewerking per interviewuur levert publicatieklare transcripties op in een fractie van de tijd.
Hoe voeg ik tijdstempels toe aan een transcript?
Moderne AI-transcriptie levert automatisch tijdstempels per woord; voor de leesbaarheid volstaan markeringen om de 30-60 seconden of bij sprekerwisselingen.
Welk exportformaat moet ik kiezen voor mijn transcriptie?
TXT om te lezen, SRT voor YouTube en LinkedIn, VTT voor HTML5-webvideo, JSON voor code en verdere verwerking – stem het formaat af op de use case.
Wat is Custom Vocabulary en wanneer heb ik het nodig?
Een woordenlijst die je het model vóór de transcriptie meegeeft met jargon en eigennamen – die tilt de herkenning van die termen vaak van 30% naar 95%.
Ontwikkelaars
Welke transcriptie-API is het beste voor ontwikkelaars?
Hangt af van de use case: AssemblyAI voor Amerikaanse workflows, Deepgram voor lage latentie, OpenAI Whisper voor meertaligheid, DeepScript voor AVG en gegevensopslag in de EU.
Moet ik webhooks of polling gebruiken voor een transcriptie-API?
Webhooks voor de primaire levering, polling als back-up – de meest robuuste productie-opzet. Polling alleen verspilt requests; webhooks alleen riskeren verloren events.
Moet ik Whisper zelf hosten of een API gebruiken?
Onder ~500 audio-uur/maand wint een managed API bijna altijd; daarboven kan zelf hosten goedkoper zijn, maar alleen met GPU-ervaring en DevOps-budget.
Hoe werkt live transcriptie technisch?
Audio wordt in kleine chunks via WebSocket gestreamd; het model levert tussenresultaten binnen 300-800 ms en finaliseert ze na elke spreekpauze.
Talen en dialecten
Kan AI Zwitserduits transcriberen?
Deels: dialect-getunede modellen halen 75-85% nauwkeurigheid, algemene modellen vaak onder de 50%. De output wordt meestal genormaliseerd naar Standaardduits, niet in dialectspelling geschreven.
Hoeveel talen ondersteunt AI-transcriptie?
De beste modellen (Whisper, AssemblyAI, DeepScript) dekken 99 talen – maar de kwaliteit loopt uiteen van uitstekend voor de top 10 tot nauwelijks bruikbaar voor zeldzame talen.