Views
No views yet
1import transformers
2import torch
3import os
4from huggingface_hub import create_repo, upload_folder
5import accelerate
6
7source_model_id = 'Qwen/Qwen2-72B-Instruct'
8save_path = '/tmp/yujiepan/qwen2-tiny-random'
9repo_id = 'yujiepan/qwen2-tiny-random'
10
11os.system(f'rm -rf {save_path}')
12
13config = transformers.AutoConfig.from_pretrained(
14 source_model_id,
15 trust_remote_code=True,
16)
17config._name_or_path = source_model_id
18config.hidden_size = 8
19config.intermediate_size = 16
20config.num_key_value_heads = 2
21config.num_attention_heads = 4
22config.num_hidden_layers = 2
23config.max_window_layers = 1
24
25model = transformers.AutoModelForCausalLM.from_config(
26 config,
27 trust_remote_code=True,
28)
29model.generation_config = transformers.GenerationConfig.from_pretrained(source_model_id)
30model = model.to(torch.bfloat16)
31
32with torch.no_grad():
33 for p in model.parameters():
34 torch.nn.init.normal_(p)
35
36model.save_pretrained(save_path)
37
38tokenizer = transformers.AutoTokenizer.from_pretrained(
39 source_model_id,
40 trust_remote_code=True,
41)
42tokenizer.save_pretrained(save_path)
43
44output = model.float().generate(torch.tensor([[1, 2, 3]]).long(), max_length=16, do_sample=True)
45
46os.system(f'ls -alh {save_path}')
47# os.system(f'rm -rf {save_path}/model.safetensors')
48create_repo(repo_id, exist_ok=True)
49upload_folder(repo_id=repo_id, folder_path=save_path)
50