Views
No views yet
transformers library.d_model = 51268162451250257 (GPT‑2 tokenizer)256 tokenstransformers installed:1pip install transformers torch
2
3
4from transformers import AutoTokenizer, AutoModel
5
6tokenizer = AutoTokenizer.from_pretrained("siddharth797/fenrir-MoE-v1")
7model = AutoModel.from_pretrained(
8 "siddharth797/fenrir-MoE-v1",
9 trust_remote_code=True
10).to("cuda")
11
12
13
14## Text Generation
15### The repository includes a generation.py helper. Use it as follows:
16
17from generation import generate_response, format_alpaca_prompt
18formatted_prompt = format_alpaca_prompt(case["instruction"], case["input"])
19
20response = generate_response(
21 prompt_text=formatted_prompt,
22 model=model,
23 tokenizer=tokenizer,
24 max_new_tokens=96,
25 temperature=0.7
26)
27
28
29
30
31
32@article{deepseekmoe2024,
33 title={DeepSeek-MoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models},
34 author={DeepSeek-AI},
35 year={2024}
36}