Views
No views yet
Diamegs/PIT-4B-FT-202212 and a PEFT LoRA adapter.
It is intended to be loadable with the same Transformers API used for the base Diamegs PIT model:1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3tokenizer = AutoTokenizer.from_pretrained("Dapinsky/PIT-4B-FT-202212-math-finance-reasoning-sft", trust_remote_code=True)
4model = AutoModelForCausalLM.from_pretrained("Dapinsky/PIT-4B-FT-202212-math-finance-reasoning-sft", trust_remote_code=True)Diamegs/PIT-4B-FT-202212base model1{
2 "peft_type": "LORA",
3 "task_type": "CAUSAL_LM",
4 "r": 16,
5 "lora_alpha": 32,
6 "lora_dropout": 0.05,
7 "target_modules": [
8 "c_v",
9 "c_k",
10 "c_fc",
11 "c_proj",
12 "c_q"
13 ],
14 "base_model_name_or_path": "Diamegs/PIT-4B-FT-202212"
15}