AnadilKurmanjiTTS — Kurmancî (Kurdish Kurmanji) Text-to-Speech Modeli
AnadilKurmanjiTTS, openbmb/VoxCPM2 temel modeli üzerine LoRA (Low-Rank Adaptation) ile ince ayar yapılmış, Kurmancî (Kurdish Kurmanji, ISO 639-3: kmr) için açık kaynak bir konuşma sentezi (text-to-speech) modelidir. 65.102 segmentlik tek konuşmacılı bir veri setiyle eğitilmiştir — bu, "Anadil" ailesindeki (Lazca, Zazaca, Adığece, Kurmancî) en büyük ve en olgun modeldir.
AnadilKurmanjiTTS is an open-source text-to-speech LoRA adapter for Kurmanji Kurdish (kmr), fine-tuned on top of VoxCPM2 on 65,102 single-speaker utterances — the largest and most-trained model in the "Anadil" family of endangered-language TTS adapters (alongside sibling models for Laz, Zaza, and Adyghe). UNESCO classifies Kurdish Kurmanji as a language with significant diaspora communities in Turkey where intergenerational transmission is declining — among younger speakers in the Turkish diaspora, fluency has dropped substantially. This model is part of an effort to keep the language's sound alive in digital tools.
65.102 segment — Anadil ailesinin en büyük veri seti
Eğitim adımı
10.000
Adapter boyutu
~70 MB (384 tensor, ~18,1M parametre, F32)
Sample rate
16 kHz giriş / 48 kHz çıkış
Lisans
MIT
🔊 Örnek Sesler — Orijinal ve Sentez Karşılaştırması
Aşağıda orijinal referans ses (gerçek konuşmacı) ile modelin ürettiği sentez (TTS) arasındaki farkları duyabilirsiniz:
1. lê min bavê wî Xalê Cemo di nava gund de dîtiye.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
2. Ez dikarim bi hevokekê alîkariya we bikim.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
3. Ne poşman im ji qerarên xwe.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
4. Ev birayê min e.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
5. Heta ez bijîm, ez ê vê civînê bi kêfxweşî bibîr bînim.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
6. Civîna Putin û Erdogan bi dawî bû.
Orijinal (Gerçek Konuşmacı)
Sentez (Model Çıktısı)
⚡ Hızlı Başlangıç
bash
1pip install torch torchaudio soundfile safetensors numpy voxcpm
2git clone https://huggingface.co/Anadilorg/Anadil_Kurmanji_TTS
3cd Anadil_Kurmanji_TTS
4python inference.py --text "[speaker:spk_tmp_001 language:kmr] Ez dikarim bi hevokekê alîkariya we bikim."
Python API
python
1from voxcpm import VoxCPM
2from voxcpm.model.voxcpm import LoRAConfig
3import json, soundfile as sf
45lora_cfg_dict = json.load(open("lora_config.json"))["lora_config"]6lora_cfg = LoRAConfig(**{k: v for k, v in lora_cfg_dict.items()if k in LoRAConfig.model_fields})78model = VoxCPM.from_pretrained(9"openbmb/VoxCPM2",10 load_denoiser=False,11 lora_config=lora_cfg,12 lora_weights_path="lora_weights.safetensors",13 device="cuda",# veya "mps" / "cpu"14)15model.load_lora("lora_weights.safetensors")1617text ="[speaker:spk_tmp_001 language:kmr] Ez dikarim bi hevokekê alîkariya we bikim."18audio = model.generate(text=text, inference_timesteps=10, cfg_value=2.0)19sf.write("output.wav", audio,48000)
Gradio arayüzü (yerel)
bash
1pip install gradio
2python demo.py
Bu proje için barındırılan bir Hugging Face Space bilinçli olarak oluşturulmadı; demo.py yalnızca kendi bilgisayarınızda/sunucunuzda çalıştırmak içindir.
Hızlı doğrulama (smoke test)
bash
1python test_smoke.py --weights-only # sadece ağırlık bütünlüğü, saniyeler sürer2python test_smoke.py # tam test (model indirme + gerçek ses üretimi)
🧩 Metin Formatı
Girdi metni şu formatta olmalı: [speaker:spk_tmp_001 language:kmr] <metin> — inference.py/demo.py bu etiketi otomatik olarak modelin beklediği forma çevirir.
🖥️ Donanım Gereksinimleri
Disk: ~4,7 GB (VoxCPM2 temel model + LoRA ağırlıkları)
RAM/VRAM: float32 çıkarım için ~9 GB; CUDA GPU'da bfloat16 ile daha az
CUDA GPU önerilir; Apple Silicon (≥24 GB birleşik bellek) desteklenir ama daha yavaştır
🌍 Neden Önemli
Kurmancî, Türkiye, Suriye, Irak ve İran'da milyonlarca konuşucusi olan bir dildir. Türkiye'deki büyük diaspora topluluğuyla birlikte, kuşaklar arası dil aktarımı ciddi biçimde zayıflamaktadır — özellikle genç nesiller arasında anadil akıcılığı kaybolmaktadır. Bu model, Kurmancînin dijital araçlarda (sesli asistanlar, eğitim materyalleri, erişilebilirlik uygulamaları) var olabilmesi için açık kaynak bir temel sunmayı amaçlıyor.
Sorun, geri bildirim veya katkı için lütfen bu deponun Community/Discussions sekmesini kullanın. Anadil.Org adresinden bizimle iletişime geçebilirsiniz.
Citation
bibtex
1@misc{anadilKurmanjiTTS2026,
2 title = {AnadilKurmanjiTTS: An Open-Source Text-to-Speech LoRA Adapter for Kurmanji Kurdish},
3 author = {Anadilorg},
4 year = {2026},
5 howpublished = {\url{https://huggingface.co/Anadilorg/Anadil_Kurmanji_TTS}}
6}