Views
No views yet
🐉 “白泽”取自中国古代通晓万物的神兽,寓意“通晓中医,智启未来”。本模型致力于推动中医药知识的智能化传承。
| 项目 | 说明 |
|---|---|
| 基础模型 | Qwen3-0.6B |
| 微调数据 | Baize-TCM-Corpus-for-Large-Language-Models-V3 |
| 参数量 | ~0.6B |
| 量化方式 | 16bit |
| 量化工具 | transformers |
| 上下文长度 | 4096 tokens |
| 训练方式 | LoRA |
| 训练软件 | LLaMA-Factory |
transformers 加载(推荐)1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4# 模型名称
5model_name = "Baize-Traditional-Chinese-Medicine-Large-Language-Model"
6
7# 加载 tokenizer
8tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
9
10# 加载模型,使用 float16(16-bit)半精度,不进行量化
11model = AutoModelForCausalLM.from_pretrained(
12 model_name,
13 torch_dtype=torch.float16, # 使用 float16
14 device_map="auto", # 自动分配 GPU 显存
15 trust_remote_code=True # 支持自定义模型代码
16)
17
18# 推理
19prompt = "问题:气虚的主要症状有哪些?\n答案:"
20inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
21
22outputs = model.generate(
23 **inputs,
24 max_new_tokens=200,
25 temperature=0.7,
26 do_sample=True
27)
28
29print(tokenizer.decode(outputs[0], skip_special_tokens=True))