Nur fuer Schweizer Standarddeutsch (de-CH) — nicht fuer bundesdeutsches
oder oesterreichisches Deutsch: das Modell schreibt konsequent ss statt ß und
erhaelt Helvetismen (innert, Offerte, parkieren, Velo …), statt sie zu
"korrigieren". Fuer de-DE/de-AT wuerde es Texte systematisch verschweizern.
Es korrigiert Schweizer Standarddeutsch, keinen Dialekt (Schweizerdeutsch) —
Dialekt-Input war nicht im Training.
Korrektur von deutschem Diktat-Rohtext (STT-Output):
Interpunktion und Grossschreibung setzen, Fuellwoerter entfernen, immer ss statt ß,
Umlaute restaurieren (ue/ae/oe → ü/ä/ö), Helvetismen und Inhalt exakt erhalten.
LoRA-Finetune (rank 8, 300 Iterationen, mlx_lm 0.31.3) von
Qwen/Qwen3.5-4B
@ 851bf6e806efd8d0a36b00ddf55e13ccb7b8cd0a, Adapter gefused, konvertiert mit
llama.cpp (b10360+). Diese Variante: q8_0.
ChatML mit leerem Think-Block (Qwen3.5, enable_thinking=False):
<|im_start|>system
Du korrigierst deutschen Diktat-Rohtext. Regeln:
- Setze Interpunktion und Grossschreibung
- Entferne Füllwörter (äh, ähm, also, halt)
- Schreibe immer ss, nie ß
- Behalte Helvetismen und Inhalt exakt
- Gib nur den korrigierten Text zurück<|im_end|>
<|im_start|>user
ähm also das neue buero in zuerich ist groesser als das alte<|im_end|>
<|im_start|>assistant
<think>
</think>
Caveat: Trainings- und Testdaten sind synthetisch (Template-Korpus,
degradiert); Test-Metriken sind dadurch optimistisch. Details, Grenzen und
Reproduktion: Trainings-Repo (Skripte, Eval-Reports).
Verwendung (llama.cpp)
Thinking muss deaktiviert sein — das Finetune wurde mit leerem Think-Block
trainiert:
bash
1llama-cli -m qwen3.5-4b-diktat-de-ch-q8_0.gguf --temp 0\2 --chat-template-kwargs '{"enable_thinking":false}'\3 -sys "Du korrigierst deutschen Diktat-Rohtext. Gib nur den korrigierten Text zurück"