Czy SI potrafi transkrybować szwajcarski niemiecki?
Krótka odpowiedź
Częściowo: modele wyspecjalizowane w dialekcie osiągają 75-85% dokładności, modele ogólne często poniżej 50%. Wynik jest zwykle normalizowany do standardowego niemieckiego, a nie zapisywany w dialekcie.
Szwajcarski niemiecki to trudny orzech rozpoznawania mowy niemieckiej. Trzy powody czynią go trudnym:
1. Brak znormalizowanej formy pisanej. Szwajcarski niemiecki jest czysto mówiony – nie ma oficjalnej ortografii. „Chuchichäschtli\", „Zmorge\", „Iisdäcki\" – pisownia różni się u każdej osoby. Modele językowe potrzebują spójnego tekstu do treningu, a tu on nie istnieje.
2. Wiele dialektów. Berneński, zuryski, walezyjski, bazylejski, argowski, środkowoszwajcarski – wszystkie wyraźnie różne pod względem wymowy, słownictwa i gramatyki. Model wytrenowany na zuryskim zawodzi przy walezyjskim.
3. Mało materiału treningowego. Standardowy niemiecki ma setki tysięcy godzin publicznie dostępnych korpusów audio. Szwajcarski niemiecki ma kilka tysięcy godzin – wiele z nich nie jest objętych wolną licencją.
Jak radzą sobie dobre modele Zwykła sztuczka: zamiast próbować generować tekst w dialekcie, modele tłumaczą bezpośrednio na standardowy niemiecki. „Mir gönd hei\" staje się „Wir gehen heim\" („Idziemy do domu\"). Niedosłownie, ale w większości zastosowań (wywiady, spotkania, napisy) dokładnie tym, czego potrzebujesz.
Dostawcy wyspecjalizowani w szwajcarskim niemieckim: - Recapp i Töggl to dwaj najbardziej znani lokalni dostawcy. Robią fine-tuning modeli na szwajcarskim niemieckim. - DeepScript Premium jest dostrojony do obszaru DACH (CH/AT/DE) – kalibrujemy nasz model specjalnie pod szwajcarską i austriacką wymowę. W naszych testach osiągamy ~85% dokładności na zuryskim i berneńskim po normalizacji do standardowego niemieckiego.
Co działa - Umiarkowane dialekty (Argowia, Zurych, Berno) z wyraźną wymową. - Wynik w standardowym niemieckim (nie w pisowni dialektalnej). - Pojedynczy mówca, dobre audio. - Model Premium z tuningiem DACH zamiast modelu ogólnego.
Co nie działa - Pisownia dialektalna na wyjściu – żaden model nie radzi sobie z tym niezawodnie. - Dialekty walezyjski, gryzoński, środkowoszwajcarski – nawet inni Szwajcarzy mają z nimi trudność. - Kilku mówców szybko się zmieniających. - Mieszanie standardowego niemieckiego i dialektu w jednym zdaniu („code mixing\").
Wskazówka praktyczna Przy szwajcarskich wywiadach lub spotkaniach poproś mówców, by na początku powiedzieli jedno zdanie w standardowym niemieckim („Nazywam się …, dziś rozmawiamy o …\"). Stabilizuje to model na pierwsze kilka sekund. Przy nagraniach silnie dialektalnych redakcja przez człowieka jest niemal zawsze konieczna – zaplanuj 1-2 godziny redakcji na godzinę audio.
Powiązane pytania
Masz jeszcze pytanie?
Trzy transkrypcje za darmo na próbę. Albo napisz do nas e-mail – odpowiadamy w ciągu 24 godzin, również na pytania dotyczące zgodności.