Transcription en 99 langues – avec un véritable focus DACH
Détection automatique, code-switching en milieu de phrase et reconnaissance des dialectes – le tout sur un seul moteur.
3 transcriptions gratuites · sans carte bancaire · données en Allemagne
99+ Sprachen · Auto-Detect
DeepScript utilise un moteur compatible Whisper et prend en charge 99 langues – de l'allemand et l'anglais au français, italien, néerlandais, espagnol, polonais, portugais, russe, mandarin, japonais, coréen, arabe, hébreu et hindi, jusqu'au swahili, norvégien, suédois, finnois, grec, turc et tchèque. La détection automatique identifie généralement la langue dans les 5 à 10 premières secondes d'audio. Si vous menez des réunions multilingues – par exemple une réunion d'affaires germano-anglaise – le code-switching en milieu de phrase est transcrit correctement. Les langues DACH bénéficient en plus de notre affinage spécialisé ; les langues plus rares se rapprochent du niveau Whisper générique.
Preuves
Sur quoi nous nous appuyons
99 langues via la base Whisper
Couverture linguistique complète de Whisper. La précision par langue dépend de la part dans l'entraînement – les grandes langues sont excellentes, les plus exotiques restent bonnes.
Détection automatique en 5 à 10 secondes
Vous n'avez pas à indiquer la langue. Le modèle écoute brièvement et décide – sur les enregistrements multilingues, il redécide en cours de route.
Code-switching natif
« Lass uns das im Q3-Review aligned bekommen, ja ? » – les phrases mixtes allemand-anglais sont transcrites correctement, sans accroc au changement de langue.
Dialectes DACH affinés
Suisse allemand, bavarois, viennois, bas-allemand – là où Whisper générique trébuche, notre modèle Premium poursuit.
En pratique
Ce que cela signifie concrètement
Détection automatique, code-switching en milieu de phrase et reconnaissance des dialectes – le tout sur un seul moteur.
- Qualité de premier ordre (≤ 5 % de WER sur des enregistrements clairs) pour l'allemand, l'anglais, l'espagnol, le français et l'italien.
- Bonne qualité pour le néerlandais, le portugais, le polonais, le russe, le mandarin, le japonais et l'arabe.
- Les langues plus rares (hindi, swahili, tamoul, gallois …) sont disponibles ; le WER peut être nettement plus élevé selon la qualité audio.
- La langue détectée est enregistrée sur la transcription (`detectedLanguage`) ; vous pouvez la remplacer après coup.
- La traduction n'est plus intégrée directement – si vous avez besoin de la transcription dans une autre langue, utilisez MCP avec un client IA (Claude, ChatGPT).
99+ Sprachen · Auto-Detect
Comment l'utiliser
Opérationnel en quelques étapes
- 1
1. Choisir une langue ou la détection automatique
Dans le formulaire d'import : un menu déroulant avec 99 langues plus « Détection automatique » par défaut. Si vous connaissez la langue, la définir explicitement est légèrement plus précis.
- 2
2. Importer – la détection automatique démarre au début
Le moteur écoute les premières secondes et détermine quel décodeur utiliser. Sur les enregistrements multilingues, il bascule sans transition.
- 3
3. Vérifier la langue détectée
La langue détectée s'affiche dans l'en-tête du résultat. Si elle est erronée – par ex. vous parlez un dialecte suisse et le modèle opte pour l'allemand standard – vous pouvez relancer la transcription en choisissant explicitement la langue.
- 4
4. Exporter ou traiter davantage
Langue d'origine → TXT/SRT/VTT/JSON. Pour la traduction dans d'autres langues : transmettez la transcription à votre client IA (Claude, ChatGPT) – via MCP ou copier-coller.
FAQ
Questions fréquentes
Quelles langues sont exactement prises en charge ?+
La liste complète des 99 langues est disponible via `GET /v1/languages` dans l'API. Les principales : allemand, anglais, français, italien, néerlandais, espagnol, polonais, portugais, russe, mandarin, japonais, coréen, arabe, turc, hindi, suédois, norvégien, finnois, grec, tchèque et bien d'autres.
Quelle est la précision du hindi ou de l'arabe par rapport à l'allemand ?+
Sur des enregistrements clairs, le hindi et l'arabe se situent généralement entre 8 et 12 % de WER, l'allemand entre 3 et 5 % (Premium) ou 5 et 8 % (Standard). L'écart vient du fait que l'entraînement de base de Whisper comptait davantage d'heures de langues européennes. Reste exploitable pour les notes, la préparation et le traitement machine en aval.
Détection automatique – à quelle vitesse ?+
L'identification de la langue s'effectue dans les 5 à 10 premières secondes d'audio. Vous ne remarquerez aucun délai perceptible – le processus global (import → transcription) démarre immédiatement après l'import.
Code-switching – est-ce que ça fonctionne vraiment ?+
Oui, surtout pour les paires les plus courantes (allemand ↔ anglais, espagnol ↔ anglais). Sur « Lass uns das ASAP bouncen », le modèle reconnaît les deux langues et les transcrit nativement. Les mélanges exotiques (mandarin ↔ français) fonctionnent, mais sont moins fiables.
Puis-je faire traduire automatiquement la transcription ?+
Pas directement chez nous – nous avons supprimé les points de terminaison IA côté serveur (résumé, traduction) en mai 2026. À la place, transmettez la transcription à votre client IA (Claude, ChatGPT, …) – le plus élégamment via MCP, afin que le client lise directement vos transcriptions.
Jugez-en par vous-même
Importez un fichier et voyez le résultat en quelques minutes. Trois transcriptions gratuites, sans carte bancaire.