Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "openpql/nishka-sft",
5 device_map="auto",
6 torch_dtype="auto",
7 trust_remote_code=True
8)
9tokenizer = AutoTokenizer.from_pretrained("openpql/nishka-sft")
10
11# Generate
12inputs = tokenizer("Your prompt here", return_tensors="pt")
13outputs = model.generate(**inputs, max_length=512)
14print(tokenizer.decode(outputs[0]))1# vLLM example
2vllm serve openpql/nishka-sft --dtype float16