Views
No views yet
d_model = 76810169612128 (fine‑grained)25650257 (GPT‑2 tokenizer)256 tokenstransformers installed:1pip install transformers torch
2
3
4from transformers import AutoTokenizer, AutoModel
5
6tokenizer = AutoTokenizer.from_pretrained("siddharth797/fenrir-MoE-v1")
7model = AutoModel.from_pretrained(
8 "siddharth797/fenrir-MoE-v1-L",
9 trust_remote_code=True
10).to("cuda")
11
12
13## Text Generation
14### The repository includes a generation.py helper. Use it as follows:
15
16from generation import generate_response, format_alpaca_prompt
17formatted_prompt = format_alpaca_prompt(case["instruction"], case["input"])
18
19response = generate_response(
20 prompt_text=formatted_prompt,
21 model=model,
22 tokenizer=tokenizer,
23 max_new_tokens=96,
24 temperature=0.7
25)
26
27
28
29
30
31@article{deepseekmoe2024,
32 title={DeepSeek-MoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models},
33 author={DeepSeek-AI},
34 year={2024}
35}
36