مجموعة موديلات AI لدبلجة الفيديوهات تلقائياً بـ 13 لغة.
1from huggingface_hub import snapshot_download
2import whisper
3from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
4import torch
5
6# تحميل الموديلات
7repo_id = "meem2525/video-dubbing-models"
8local_dir = snapshot_download(repo_id, cache_dir="./models")
9
10# Whisper
11whisper_model = whisper.load_model("medium", download_root=f"{local_dir}/whisper")
12
13# NLLB
14device = "cuda" if torch.cuda.is_available() else "cpu"
15tokenizer = AutoTokenizer.from_pretrained(f"{local_dir}/nllb")
16translator = AutoModelForSeq2SeqLM.from_pretrained(f"{local_dir}/nllb").to(device)
17
18print("✅ جاهز للاستخدام!")
1# 1. تفريغ الصوت
2result = whisper_model.transcribe("audio.mp3", language="en")
3text = result["text"]
4
5# 2. ترجمة
6tokenizer.src_lang = "eng_Latn"
7inputs = tokenizer(text, return_tensors="pt").to(device)
8outputs = translator.generate(
9 **inputs,
10 forced_bos_token_id=tokenizer.lang_code_to_id["ara_Arab"]
11)
12translated = tokenizer.decode(outputs[0], skip_special_tokens=True)
13
14print(f"Original: {text}")
15print(f"Translated: {translated}")
العربية 🇸🇦 • الإنجليزية 🇬🇧 • الإسبانية 🇪🇸 • الفرنسية 🇫🇷 • الألمانية 🇩🇪 •
الإيطالية 🇮🇹 • التركية 🇹🇷 • الروسية 🇷🇺 • الصينية 🇨🇳 • اليابانية 🇯🇵 •
الكورية 🇰🇷 • البرتغالية 🇧🇷 • الهندية 🇮🇳
للإبلاغ عن مشاكل أو اقتراحات:
GitHub Issues