Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3model_name = "dheeyantra/dhee-nxtgen-qwen3-hindi-v2"
4
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6model = AutoModelForCausalLM.from_pretrained(model_name, trust_remote_code=True)
7
8# Example prompt
9prompt = """<|im_start|>system
10You are a helpful assistant.<|im_end|>
11<|im_start|>user
12क्या आप मेरे लिए एक अपॉइंटमेंट शेड्यूल कर सकते हैं?nd|<|im_end|>
13<|im_start|>assistant
14"""
15
16
17inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
18outputs = model.generate(**inputs, max_new_tokens=150)
19print(tokenizer.decode(outputs[0], skip_special_tokens=True))pip install torch transformers vllm sentencepiecevllm serve --model dheeyantra/dhee-nxtgen-qwen3-hindi-v2 --host 0.0.0.0 --port 8000