De nauwkeurigste transcriptie voor Duitstalige dialecten
Wij zijn gespecialiseerd in één ding: audio uit de DACH-regio. Zwitserduits, Beiers, Weens, Nederduits – waar generieke modellen gokken, luisteren wij goed.
3 gratis transcripties · geen creditcard · gegevens in Duitsland
Fijn dat de afspraak is gelukt.
Heel graag. Zullen we meteen beginnen?
Ja – ik neem het gesprek op, is dat oké?
De meeste transcriptiediensten gebruiken een generiek meertalig model dat alle 99 talen ongeveer gelijk behandelt. Voor helder Standaardduits volstaat dat. Maar zodra een Berner klant mompelt, een Weense vrouw razendsnel praat of een Beierse vergadering in dialect overgaat, stort de nauwkeurigheid in. DeepScript koos de andere weg: ons Premium-model is fijngetraind op meer dan 50.000 uur DACH-audio – echte zakelijke vergaderingen, interviews en podcasts. Die dataset komt voort uit de erfenis van Aliru GmbH, dat vóór DeepScript Sally (sally.io) runde, een AI-vergaderassistent. Het resultaat: een Word Error Rate van ~3–5% op helder Duits, tegenover 7–9% voor generiek Whisper-large.
Bewijs
Waarop we dit baseren
Meer dan 50.000 uur DACH-audio in de training
Echte vergaderingen, interviews en telefoongesprekken uit Duitsland, Oostenrijk en Zwitserland – geen synthetische audio.
~3–5% WER op helder Duits (Premium)
Gemeten tegen een samengestelde testset Standaardduits. Generiek Whisper-large scoort 7–9% op dezelfde set.
Erfenis: Sally (sally.io)
Aliru GmbH bouwt al jaren vergader-AI voor DACH-bedrijven. Die ervaring zit rechtstreeks in het DeepScript-model.
ISO 27001 / 9001 / 14001 gecertificeerd
Informatiebeveiliging, kwaliteitsmanagement en milieumanagement – drie certificeringen, één bedrijf.
Servers in Neurenberg en Falkenstein
Onze eigen Hetzner-hardware in Duitse datacenters. Geen Amerikaanse cloud-subverwerker in het transcriptiepad.
In de praktijk
Wat dat concreet betekent
Wij zijn gespecialiseerd in één ding: audio uit de DACH-regio. Zwitserduits, Beiers, Weens, Nederduits – waar generieke modellen gokken, luisteren wij goed.
- Dialectherkenning voor Zwitserduits, Beiers, Weens, Nederduits en Saksisch – waar generieke modellen naar het Engels afdwalen, blijven wij in de context.
- Speaker Diarization inbegrepen in beide abonnementen. Standard verwerkt betrouwbaar 2–6 sprekers, Premium scheidt ook stemmen die op elkaar lijken.
- Custom Vocabulary voor eigennamen, jargon en bedrijfsspecifieke afkortingen – verbetert meetbaar de herkenning van termen als 'Schwarz-Schilling' of 'T1-gewogen MRI'.
- 99 talen beschikbaar (automatische detectie of handmatige keuze), DACH-talen krijgen voorrang qua nauwkeurigheid en latentie.
- Tijdstempels op woordniveau met een confidence-score per woord – zichtbaar in de editor en exporteerbaar als JSON voor downstream-pipelines.
Zo gebruik je het
In een paar stappen klaar voor gebruik
- 1
1. Kies een model
Standard (€ 0,18/uur) voor heldere opnames en alledaagse gesprekken. Premium (€ 0,27/uur) voor dialect, ruis, meerdere sprekers of wanneer de transcriptie citeerbaar moet zijn.
- 2
2. Custom Vocabulary aanmaken (optioneel)
Zet eigennamen, productnamen en vakjargon in een lijst. Hetzelfde Custom Vocabulary wordt vervolgens op elke transcriptie in het project toegepast.
- 3
3. Uploaden of live opnemen
Sleep een audio- of videobestand erin, of gebruik live transcriptie via de microfoon. Premium loopt via de prioriteitswachtrij.
- 4
4. Controleren en exporteren
In de editor: hernoem sprekers, klik op een woord voor de audiopositie, gebruik confidence-kleuring. Exporteer als TXT, SRT, VTT of JSON.
FAQ
Veelgestelde vragen
Hoe is DeepScript beter dan generiek Whisper?+
Generiek Whisper-large is getraind op een brede mix van 99 talen – gemiddeld goed, in geen enkele taal uitmuntend. Wij nemen dezelfde architectuur en trainen door op meer dan 50.000 uur DACH-specifieke audio. Op helder Duits levert dat ~3–5% WER op, terwijl generiek Whisper-large 7–9% scoort op dezelfde set. Bij dialecten wordt het verschil nog veel groter.
Waarom de focus op DACH?+
Vóór DeepScript runde Aliru GmbH jarenlang Sally (sally.io), een AI-vergaderassistent met een overwegend Duitstalig klantenbestand. Dat leverde een trainingscorpus en operationele ervaring op die generieke aanbieders simpelweg niet hebben. We bouwen het product dat we zelf nodig hadden.
Krijg ik dezelfde kwaliteit voor Engels?+
Engels wordt uitstekend ondersteund via de Whisper-basis – de WER ligt bij heldere opnames doorgaans rond de 4–6%. Onze fijntraining verbetert dat niet meetbaar (Engels domineerde al in de oorspronkelijke Whisper-training). We presteren beter op DACH; voor Engels zitten we ongeveer op gelijke hoogte met de grote aanbieders.
Wat betekent Speaker Diarization in de praktijk?+
Elk woord krijgt naast de transcriptie een sprekerlabel ('Spreker 1', 'Spreker 2' …). In de editor kun je de labels hernoemen naar echte namen. In SRT/VTT-exports verschijnen ze als voorvoegsel vóór elke ondertitel; in JSON als veld bij elk woord. Je kunt elk label altijd zelf corrigeren.
Hoe verschilt Premium van Standard?+
Drie dingen: (1) de DACH-fijntraining is alleen actief in het Premium-model – Standard gebruikt een lichtere variant; (2) Premium loopt via een prioriteitswachtrij met kortere wachttijden; (3) de Speaker Diarization is fijner afgesteld voor stemmen die op elkaar lijken. Standard kost € 0,18/uur, Premium € 0,27/uur.
Overtuig jezelf
Upload een bestand en zie het resultaat binnen enkele minuten. Drie gratis transcripties, geen creditcard.