Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer
2
3tokenizer = AutoTokenizer.from_pretrained("hiyouga/baichuan-7b-sft", trust_remote_code=True)
4model = AutoModelForCausalLM.from_pretrained("hiyouga/baichuan-7b-sft", trust_remote_code=True).cuda()
5streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=True)
6
7query = "晚上睡不着怎么办"
8template = (
9 "A chat between a curious user and an artificial intelligence assistant. "
10 "The assistant gives helpful, detailed, and polite answers to the user's questions.\n"
11 "Human: {}\nAssistant: "
12)
13
14inputs = tokenizer([template.format(query)], return_tensors="pt")
15inputs = inputs.to("cuda")
16generate_ids = model.generate(**inputs, max_new_tokens=256, streamer=streamer)python src/cli_demo.py --template default --model_name_or_path hiyouga/baichuan-7b-sft1CUDA_VISIBLE_DEVICES=0 python src/train_bash.py \
2 --stage sft \
3 --model_name_or_path baichuan-inc/baichuan-7B \
4 --do_train \
5 --dataset alpaca_gpt4_en,alpaca_gpt4_zh,codealpaca \
6 --template default \
7 --finetuning_type lora \
8 --lora_rank 16 \
9 --lora_target all \
10 --output_dir baichuan_lora \
11 --overwrite_cache \
12 --per_device_train_batch_size 8 \
13 --per_device_eval_batch_size 8 \
14 --gradient_accumulation_steps 8 \
15 --preprocessing_num_workers 16 \
16 --lr_scheduler_type cosine \
17 --logging_steps 10 \
18 --save_steps 100 \
19 --eval_steps 100 \
20 --learning_rate 5e-5 \
21 --max_grad_norm 0.5 \
22 --num_train_epochs 2.0 \
23 --val_size 0.01 \
24 --evaluation_strategy steps \
25 --load_best_model_at_end \
26 --plot_loss \
27 --fp16