Views
No views yet
<scale>_<version>:| Scale | Base model | Subfolders |
|---|---|---|
| 0.5B | Qwen2.5-0.5B-Instruct | 0.5B_v3, 0.5B_v4 |
| 1.5B | Qwen2.5-1.5B-Instruct | 1.5B_v1 … 1.5B_v5 |
| 3B | Qwen2.5-3B-Instruct | 3B_v1 … 3B_v5 |
| 7B | Qwen2.5-7B-Instruct | 7B_v1 … 7B_v5 |
config.json,
model*.safetensors, tokenizer files, generation_config.json,
chat_template.jinja). The vN suffix denotes independent SFT runs
(e.g. data/seed/hyperparameter variants).1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3repo = "Ameame1002/CRAFT"
4subfolder = "7B_v1" # pick any checkpoint from the table above
5
6tok = AutoTokenizer.from_pretrained(repo, subfolder=subfolder)
7model = AutoModelForCausalLM.from_pretrained(repo, subfolder=subfolder, device_map="auto")1from huggingface_hub import snapshot_download
2snapshot_download("Ameame1002/CRAFT", allow_patterns="7B_v1/*", local_dir="./7B_v1")Qwen2ForCausalLM architecture (32K context):| Scale | hidden | layers | heads | vocab |
|---|---|---|---|---|
| 0.5B | 896 | 24 | 14 | 151936 |
| 1.5B | 1536 | 28 | 12 | 151936 |
| 3B | 2048 | 36 | 16 | 151936 |
| 7B | 3584 | 28 | 28 | 152064 |