DeepScript
Produit

La transcription la plus précise pour les dialectes germanophones

Nous nous spécialisons dans une seule chose : l'audio de la région DACH. Suisse allemand, bavarois, viennois, bas-allemand – là où les modèles génériques devinent, nous écoutons attentivement.

3 transcriptions gratuites · sans carte bancaire · données en Allemagne

app.deepscript.com
reunion-de-lancement.mp3
Premium
Locuteur 100:04

Ravi que le rendez-vous ait pu se faire.

Locuteur 200:09

Avec plaisir. On commence tout de suite?

Locuteur 100:13

Oui j'enregistre la conversation, ça vous va?

12:48

La plupart des services de transcription utilisent un modèle multilingue générique qui traite à peu près de la même manière les 99 langues. Pour de l'allemand standard clair, cela suffit. Mais dès qu'un client bernois marmonne, qu'une Viennoise parle à toute vitesse ou qu'une réunion bavaroise bascule dans le dialecte, la précision s'effondre. DeepScript a choisi l'autre voie : notre modèle Premium est affiné sur plus de 50 000 heures d'audio DACH – de vraies réunions d'affaires, des interviews et des podcasts. Ce jeu de données provient de l'héritage d'Aliru GmbH, qui a exploité Sally (sally.io), un assistant de réunion IA, avant DeepScript. Résultat : un Word Error Rate de ~3–5 % sur de l'allemand clair, contre 7–9 % pour Whisper-large générique.

Preuves

Sur quoi nous nous appuyons

Plus de 50 000 heures d'audio DACH à l'entraînement

De vraies réunions, interviews et appels téléphoniques d'Allemagne, d'Autriche et de Suisse – aucun audio synthétique.

~3–5 % de WER sur de l'allemand clair (Premium)

Mesuré sur un jeu de test d'allemand standard soigneusement sélectionné. Whisper-large générique obtient 7–9 % sur le même jeu.

Héritage : Sally (sally.io)

Aliru GmbH conçoit depuis des années des IA de réunion pour les entreprises DACH. Cette expérience est passée directement dans le modèle DeepScript.

Certifié ISO 27001 / 9001 / 14001

Sécurité de l'information, management de la qualité et management environnemental – trois certifications, une seule entreprise.

Serveurs à Nuremberg et Falkenstein

Notre propre matériel Hetzner dans des centres de données allemands. Aucun sous-traitant cloud américain dans le chemin de transcription.

En pratique

Ce que cela signifie concrètement

Nous nous spécialisons dans une seule chose : l'audio de la région DACH. Suisse allemand, bavarois, viennois, bas-allemand – là où les modèles génériques devinent, nous écoutons attentivement.

  • Reconnaissance des dialectes suisse allemand, bavarois, viennois, bas-allemand et saxon – là où les modèles génériques dérivent vers l'anglais, nous restons dans le contexte.
  • Speaker Diarization incluse dans les deux offres. Standard gère de manière fiable 2 à 6 locuteurs, Premium sépare aussi les voix qui se ressemblent.
  • Custom Vocabulary pour les noms propres, le jargon et les acronymes propres à l'entreprise – améliore de façon mesurable la reconnaissance de termes comme « Schwarz-Schilling » ou « IRM pondérée T1 ».
  • 99 langues disponibles (détection automatique ou sélection manuelle), les langues DACH étant prioritaires en précision et en latence.
  • Horodatages au niveau du mot avec un score de confiance par mot – visibles dans l'éditeur, exportables en JSON pour vos pipelines en aval.
app.deepscript.com
Résumez les entretiens clients de la semaine dernière.
J'ai récupéré 7 transcriptions via MCP. Les trois thèmes principaux : retours sur les prix, demande de fonctionnalité pour l'API d'export et deux renouvellements.via deepscript-mcp · 7 sources

Comment l'utiliser

Opérationnel en quelques étapes

  1. 1

    1. Choisir un modèle

    Standard (0,18 €/h) pour les enregistrements clairs et les conversations courantes. Premium (0,27 €/h) pour le dialecte, le bruit, les nombreux locuteurs ou lorsque la transcription doit pouvoir être citée.

  2. 2

    2. Créer un Custom Vocabulary (facultatif)

    Ajoutez noms propres, noms de produits et termes techniques dans une liste. Le même Custom Vocabulary s'applique ensuite à toutes les transcriptions du projet.

  3. 3

    3. Importer ou enregistrer en direct

    Glissez-déposez un fichier audio ou vidéo, ou utilisez la transcription en direct via le micro. Premium passe dans la file prioritaire.

  4. 4

    4. Vérifier et exporter

    Dans l'éditeur : renommez les locuteurs, cliquez sur un mot pour atteindre sa position audio, utilisez la coloration par confiance. Export en TXT, SRT, VTT ou JSON.

FAQ

Questions fréquentes

En quoi DeepScript est-il meilleur que Whisper générique ?+

Whisper-large générique est entraîné sur un large mélange de 99 langues – correct en moyenne, excellent dans aucune. Nous reprenons la même architecture et poursuivons l'entraînement sur plus de 50 000 heures d'audio spécifique au DACH. Sur de l'allemand clair, cela nous donne ~3–5 % de WER, là où Whisper-large générique mesure 7–9 % sur le même jeu. L'écart se creuse nettement sur les dialectes.

Pourquoi se concentrer sur le DACH ?+

Avant DeepScript, Aliru GmbH a exploité pendant des années Sally (sally.io), un assistant de réunion IA avec une clientèle majoritairement germanophone. Cela a produit un corpus d'entraînement et une expérience opérationnelle que les fournisseurs génériques n'ont tout simplement pas. Nous construisons le produit dont nous avions nous-mêmes besoin.

Ai-je la même qualité pour l'anglais ?+

L'anglais est excellemment pris en charge via la base Whisper – le WER se situe généralement entre 4 et 6 % sur des enregistrements clairs. Notre affinage ne l'améliore pas de manière mesurable (l'anglais dominait déjà l'entraînement Whisper d'origine). Nous sommes meilleurs sur le DACH ; en anglais, nous sommes à peu près au niveau des grands fournisseurs.

Que signifie concrètement la Speaker Diarization ?+

Chaque mot reçoit, en plus de sa transcription, une étiquette de locuteur (« Locuteur 1 », « Locuteur 2 » …). Dans l'éditeur, vous pouvez renommer les étiquettes en vrais noms. Dans les exports SRT/VTT, elles apparaissent en préfixe avant chaque sous-titre ; en JSON, comme un champ sur chaque mot. Vous pouvez corriger n'importe quelle étiquette à tout moment.

En quoi Premium diffère-t-il de Standard ?+

Trois choses : (1) l'affinage DACH n'est actif que dans le modèle Premium – Standard utilise une variante plus légère ; (2) Premium passe dans une file prioritaire avec des temps d'attente plus courts ; (3) la Speaker Diarization est réglée plus finement pour les voix qui se ressemblent. Standard coûte 0,18 €/h, Premium 0,27 €/h.

Jugez-en par vous-même

Importez un fichier et voyez le résultat en quelques minutes. Trois transcriptions gratuites, sans carte bancaire.

Meilleure transcription pour les dialectes DACH – DeepScript | DeepScript