Views
No views yet
1from transformers import pipeline
2model_id = "tiny-random/glm-4"
3pipe = pipeline(
4 "text-generation", model=model_id, device="cuda",
5 trust_remote_code=True, max_new_tokens=20,
6)
7print(pipe("Hello World!"))1import torch
2
3from transformers import (
4 AutoConfig,
5 AutoModelForCausalLM,
6 AutoTokenizer,
7 GenerationConfig,
8 pipeline,
9 set_seed,
10)
11
12source_model_id = "THUDM/GLM-4-32B-0414"
13save_folder = "/tmp/tiny-random/glm-4"
14
15tokenizer = AutoTokenizer.from_pretrained(
16 source_model_id, trust_remote_code=True,
17)
18tokenizer.save_pretrained(save_folder)
19
20config = AutoConfig.from_pretrained(
21 source_model_id, trust_remote_code=True,
22)
23config.hidden_size = 16
24config.head_dim = 16
25config.intermediate_size = 32
26config.num_attention_heads = 1
27config.num_hidden_layers = 2
28config.num_key_value_heads = 1
29config.tie_word_embeddings = False
30model = AutoModelForCausalLM.from_config(
31 config,
32 torch_dtype=torch.bfloat16,
33 trust_remote_code=True,
34)
35model.generation_config = GenerationConfig.from_pretrained(
36 source_model_id, trust_remote_code=True,
37)
38set_seed(42)
39with torch.no_grad():
40 for name, p in sorted(model.named_parameters()):
41 torch.nn.init.normal_(p, 0, 0.5)
42 print(name, p.shape)
43model.save_pretrained(save_folder)