Views
No views yet
pip install "llamafactory[torch]" transformers peft1from llamafactory import load_model
2from transformers import AutoTokenizer
3
4model_name = "MaxinT23/Qwen2.5-7B-Breast-CRAG"
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6model = load_model(model_name, adapter_name="lora", device="auto")
7
8prompt = "请以乳腺癌专科医生身份,回答以下问题:乳腺癌术后多久可以恢复正常生活?"
9inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
10outputs = model.generate(**inputs, max_new_tokens=512, temperature=0.95, top_p=0.7)
11print(tokenizer.decode(outputs[0], skip_special_tokens=True))Chen, Z., Wang, Q., Liu, J., Sun, Y., Zheng, H., Li, H., Duan, H., Lu, X. (2025). Breast-CRAG: A Breast Cancer Large Language Model Leveraging Retrieval-Augmented Generation. In: Artificial Intelligence in Medicine. AIME 2025. Lecture Notes in Computer Science, vol 15735. Springer, Cham. https://doi.org/10.1007/978-3-031-95841-0_19