Views
No views yet
<|im_start|>system
You are a helpful AI assistant<|im_end|>
<|im_start|>user
What is the capital of France?<|im_end|>
<|im_start|>assistant1python -m vllm.entrypoints.openai.api_server \
2 --model macadeliccc/Samantha-Qwen2-1.5B \
3 --chat-template ./examples/template_chatml.jinja \1from openai import OpenAI
2# Set OpenAI's API key and API base to use vLLM's API server.
3openai_api_key = "EMPTY"
4openai_api_base = "http://localhost:8000/v1"
5
6client = OpenAI(
7 api_key=openai_api_key,
8 base_url=openai_api_base,
9)
10
11chat_response = client.chat.completions.create(
12 model="macadeliccc/Samantha-Qwen2-1.5B",
13 messages=[
14 {"role": "system", "content": "You are a helpful assistant."},
15 {"role": "user", "content": "Tell me a joke."},
16 ]
17)
18print("Chat response:", chat_response)0.4.01base_model: Qwen/Qwen2-1.5B
2trust_remote_code: true
3
4load_in_8bit: false
5load_in_4bit: true
6strict: false
7
8datasets:
9 - path: macadeliccc/opus_samantha
10 type: sharegpt
11 field: conversations
12 conversation: chatml
13 - path: json
14 data_files: uncensored_ultrachat_20k_sharegpt.json
15 type: sharegpt
16 field: conversations
17 conversation: chatml
18 - path: json
19 data_files: flattened_openhermes_200k.json
20 type: sharegpt
21 field: conversations
22 conversation: chatml
23 - path: json
24 data_files: opus_instruct.json
25 type: sharegpt
26 field: conversations
27 conversation: chatml
28 - path: json
29 data_files: airoboros_uncensored.json
30 type: sharegpt
31 field: conversations
32 conversation: chatml
33 - path: json
34 data_files: orca_math_word_problems_sharegpt.json
35 type: sharegpt
36 field: conversations
37 conversation: chatml
38 - path: json
39 data_files: sharegpt_starcoder.json
40 type: sharegpt
41 field: conversations
42 conversation: chatml
43 - path: json
44 data_files: samantha_1.1_uncensored.json
45 type: sharegpt
46 field: conversations
47 conversation: chatml
48 - path: json
49 data_files: samantha_1.5.json
50 type: sharegpt
51 field: conversations
52 conversation: chatml
53 - path: json
54 data_files: sharegpt_hitchhikers_v1.json
55 type: sharegpt
56 field: conversations
57 conversation: chatml
58
59
60chat_template: chatml
61
62
63dataset_prepared_path:
64val_set_size: 0.05
65output_dir: ./outputs/out
66
67sequence_len: 4096
68sample_packing: true
69eval_sample_packing: true
70pad_to_sequence_len: true
71
72adapter: qlora
73lora_model_dir:
74lora_r: 32
75lora_alpha: 64
76lora_dropout: 0.05
77lora_target_linear: true
78lora_fan_in_fan_out:
79
80wandb_project:
81wandb_entity:
82wandb_watch:
83wandb_name:
84wandb_log_model:
85
86gradient_accumulation_steps: 4
87micro_batch_size: 1
88num_epochs: 3
89optimizer: adamw_torch
90lr_scheduler: cosine
91learning_rate: 0.0002
92
93train_on_inputs: false
94group_by_length: false
95bf16: auto
96fp16:
97tf32: true
98
99gradient_checkpointing: true
100gradient_checkpointing_kwargs:
101 use_reentrant: false
102early_stopping_patience:
103resume_from_checkpoint:
104local_rank:
105logging_steps: 1
106xformers_attention:
107flash_attention: true
108
109warmup_steps: 10
110evals_per_epoch: 4
111saves_per_epoch: 1
112debug:
113deepspeed:
114weight_decay: 0.0
115fsdp:
116 - full_shard
117 - auto_wrap
118fsdp_config:
119 fsdp_limit_all_gathers: true
120 fsdp_sync_module_states: true
121 fsdp_offload_params: true
122 fsdp_use_orig_params: false
123 fsdp_cpu_ram_efficient_loading: true
124 fsdp_auto_wrap_policy: TRANSFORMER_BASED_WRAP
125 fsdp_transformer_layer_cls_to_wrap: Qwen2DecoderLayer
126 fsdp_state_dict_type: FULL_STATE_DICT
127special_tokens: