Views
No views yet
| Dataset | Licenza |
|---|---|
| open-ita-llms/OpenSFT-ita | Apache-2.0 |
| anakin87/fine-instructions-ita-70k | Apache-2.0 |
| DeepMount00/o1-ITA-REASONING | CC BY 4.0 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3tokenizer = AutoTokenizer.from_pretrained("REPO_ID_QUI")
4model = AutoModelForCausalLM.from_pretrained("REPO_ID_QUI", torch_dtype="bfloat16", device_map="auto")
5
6messages = [{"role": "user", "content": "Chi sei?"}]
7text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
8inputs = tokenizer(text, return_tensors="pt").to(model.device)
9output = model.generate(**inputs, max_new_tokens=200, do_sample=False)
10print(tokenizer.decode(output[0][inputs["input_ids"].shape[1]:], skip_special_tokens=True))vllm serve REPO_ID_QUI