Views
No views yet
1Model(
2 (embed_tokens): Embedding(32000, 4096, padding_idx=0)
3 (layers): ModuleList(
4 (0): LlamaDecoderLayer(
5 (self_attn): LlamaAttention(
6 (q_proj): Linear(in_features=4096, out_features=4096, bias=False)
7 (k_proj): Linear(in_features=4096, out_features=4096, bias=False)
8 (v_proj): Linear(in_features=4096, out_features=4096, bias=False)
9 (o_proj): Linear(in_features=4096, out_features=4096, bias=False)
10 (rotary_emb): LlamaRotaryEmbedding()
11 )
12 (mlp): LlamaMLP(
13 (gate_proj): Linear(in_features=4096, out_features=11008, bias=False)
14 (up_proj): Linear(in_features=4096, out_features=11008, bias=False)
15 (down_proj): Linear(in_features=11008, out_features=4096, bias=False)
16 (act_fn): SiLU()
17 )
18 (post_attention_layernorm): LlamaRMSNorm()
19 )
20 )
21 (fc): Linear(in_features=8192, out_features=4096, bias=True)
22 (act): SiLU()
23)1{
2 "architectures": [
3 "LlamaForCausalLM"
4 ],
5 "bos_token_id": 1,
6 "eos_token_id": 2,
7 "hidden_act": "silu",
8 "hidden_size": 5120,
9 "initializer_range": 0.02,
10 "intermediate_size": 13824,
11 "max_position_embeddings": 2048,
12 "model_type": "llama",
13 "num_attention_heads": 40,
14 "num_hidden_layers": 1,
15 "pad_token_id": 0,
16 "rms_norm_eps": 1e-06,
17 "tie_word_embeddings": false,
18 "torch_dtype": "float16",
19 "transformers_version": "4.28.1",
20 "use_cache": true,
21 "vocab_size": 32000
22}
23
24python -m eagle.ge_data.allocation --outdir ../dataaccelerate launch -m --mixed_precision=bf16 eagle.train.main --tmpdir eagle/data/sharegpt_0_67999_mufp16 --cpdir eagle/checkpoint --configpath eagle/train/vicuna_13B_config.json1from huggingface_hub import HfApi
2
3api = HfApi()
4
5# 只上传修改后的 README.md 文件
6api.upload_file(
7 path_or_fileobj="checkpoints/eagle-vicuna-13B/README.md", # 本地修改后的 README 路径
8 path_in_repo="README.md", # 仓库中的目标路径(根目录)
9 repo_id="Gavin1104/eagle-vicuna-13b-v1.3",
10 repo_type="model"
11)