Transcripción en 99 idiomas – con un enfoque DACH real
Detección automática, code-switching a mitad de frase y reconocimiento de dialectos – todo en un solo motor.
3 transcripciones gratis · sin tarjeta de crédito · datos en Alemania
99+ Sprachen · Auto-Detect
DeepScript utiliza un motor compatible con Whisper y admite 99 idiomas – desde el alemán y el inglés pasando por francés, italiano, neerlandés, español, polaco, portugués, ruso, mandarín, japonés, coreano, árabe, hebreo e hindi hasta suajili, noruego, sueco, finés, griego, turco y checo. La detección automática suele identificar el idioma en los primeros 5–10 segundos de audio. Si mantienes reuniones multilingües – por ejemplo una reunión de negocios alemán-inglés – el code-switching a mitad de frase se transcribe correctamente. Los idiomas DACH se benefician además de nuestro ajuste especializado; los idiomas menores se acercan más al nivel genérico de Whisper.
Pruebas
En qué nos basamos
99 idiomas mediante la base de Whisper
Cobertura lingüística completa de Whisper. La precisión por idioma depende de su proporción en el entrenamiento – los idiomas grandes son excelentes, los exóticos buenos.
Detección automática en 5–10 segundos
No tienes que indicar el idioma. El modelo escucha brevemente y decide – en grabaciones multilingües vuelve a decidir sobre la marcha.
Code-switching nativo
«Lass uns das im Q3-Review aligned bekommen, ja?» – las frases mixtas alemán-inglés se transcriben correctamente, sin fallos de cambio de idioma.
Dialectos DACH ajustados
Alemán suizo, bávaro, vienés, bajo alemán – donde Whisper genérico tropieza, nuestro modelo Premium sigue adelante.
En la práctica
Qué significa esto en concreto
Detección automática, code-switching a mitad de frase y reconocimiento de dialectos – todo en un solo motor.
- Calidad de primer nivel (≤ 5% de WER en grabaciones limpias) para alemán, inglés, español, francés e italiano.
- Calidad sólida para neerlandés, portugués, polaco, ruso, mandarín, japonés y árabe.
- Los idiomas menores (hindi, suajili, tamil, galés …) están disponibles; el WER puede ser notablemente mayor según la calidad del audio.
- El idioma detectado se guarda en la transcripción (`detectedLanguage`); puedes sobrescribirlo posteriormente.
- La traducción ya no está integrada directamente – si necesitas la transcripción en otro idioma, usa MCP con un cliente de IA (Claude, ChatGPT).
99+ Sprachen · Auto-Detect
Cómo usarlo
Listo en unos pocos pasos
- 1
1. Elige un idioma o la detección automática
En el formulario de subida: un menú desplegable con 99 idiomas más «Detección automática» por defecto. Si lo conoces, indicarlo de forma explícita es ligeramente más preciso.
- 2
2. Sube – la detección automática se ejecuta al inicio
El motor escucha los primeros segundos y determina qué decodificador usar. En grabaciones multilingües cambia sin interrupciones.
- 3
3. Verifica el idioma detectado
El idioma detectado aparece en el encabezado del resultado. Si es incorrecto – p. ej. hablas un dialecto suizo y el modelo elige alemán estándar – puedes volver a transcribir eligiendo el idioma de forma explícita.
- 4
4. Exporta o sigue procesando
Idioma original → TXT/SRT/VTT/JSON. Para traducir a otros idiomas: pasa la transcripción a tu cliente de IA (Claude, ChatGPT) – mediante MCP o copiar y pegar.
FAQ
Preguntas frecuentes
¿Qué idiomas se admiten exactamente?+
La lista completa de los 99 idiomas está disponible en `GET /v1/languages` de la API. Los principales: alemán, inglés, francés, italiano, neerlandés, español, polaco, portugués, ruso, mandarín, japonés, coreano, árabe, turco, hindi, sueco, noruego, finés, griego, checo y muchos más.
¿Qué precisión tiene el hindi o el árabe en comparación con el alemán?+
En grabaciones limpias, el hindi y el árabe se sitúan normalmente en un 8–12% de WER, el alemán en un 3–5% (Premium) o 5–8% (Standard). La diferencia se debe a que el entrenamiento base de Whisper incluía más horas de idiomas europeos. Aun así es útil para notas, preparación y procesamiento automático posterior.
Detección automática – ¿qué tan rápida es?+
La identificación del idioma se realiza en los primeros 5–10 segundos de audio. No notarás un retraso perceptible – todo el proceso (subida → transcripción) comienza inmediatamente tras la subida.
Code-switching – ¿realmente funciona?+
Sí, sobre todo para los pares más comunes (alemán ↔ inglés, español ↔ inglés). Con «Lass uns das ASAP bouncen» el modelo reconoce ambos idiomas y los transcribe de forma nativa. Las mezclas exóticas (mandarín ↔ francés) funcionan, pero son menos fiables.
¿Puedo traducir automáticamente la transcripción?+
No directamente desde nosotros – eliminamos los endpoints de IA del lado del servidor (resumen, traducción) en mayo de 2026. En su lugar, pasa la transcripción a tu cliente de IA (Claude, ChatGPT, …) – de la forma más elegante mediante MCP, para que el cliente lea tus transcripciones directamente.
Compruébalo tú mismo
Sube un archivo y ve el resultado en minutos. Tres transcripciones gratis, sin tarjeta de crédito.