Views
No views yet
1import os
2
3import torch
4import transformers
5from transformers import (AutoConfig, AutoModelForCausalLM, AutoTokenizer,
6 GenerationConfig, pipeline, set_seed)
7
8model_id = 'ai21labs/AI21-Jamba-1.5-Large'
9save_path = '/tmp/yujiepan/jamba-1.5-tiny-random'
10repo_id = 'yujiepan/jamba-1.5-tiny-random'
11
12config = transformers.AutoConfig.from_pretrained(
13 model_id, trust_remote_code=True)
14config.hidden_size = 8
15config.intermediate_size = 16
16config.num_attention_heads = 4
17config.num_hidden_layers = 16
18config.num_key_value_heads = 2
19# config.use_mamba_kernels = False
20
21model = AutoModelForCausalLM.from_config(
22 config, torch_dtype=torch.bfloat16, attn_implementation="sdpa", trust_remote_code=True
23)
24
25set_seed(42)
26with torch.no_grad():
27 for _, p in sorted(model.named_parameters()):
28 torch.nn.init.uniform_(p, -0.2, 0.2)
29
30model.generation_config = GenerationConfig.from_pretrained(
31 model_id, trust_remote_code=True)
32model.save_pretrained(save_path)
33
34tokenizer = transformers.AutoTokenizer.from_pretrained(
35 model_id, trust_remote_code=True)
36tokenizer.save_pretrained(save_path)
37
38pipe = pipeline("text-generation", model=save_path, device="cuda",
39 trust_remote_code=True, max_new_tokens=20)
40print(pipe("Hello World!"))