Views
No views yet
| Spec | Value |
|---|---|
| Total Params | 16B |
| Active Params | 2.4B (MoE) |
| Context Length | 128K |
| VRAM (NF4) | ~10GB |
1from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
2import torch
3
4bnb_config = BitsAndBytesConfig(
5 load_in_4bit=True,
6 bnb_4bit_quant_type="nf4",
7 bnb_4bit_compute_dtype=torch.bfloat16,
8)
9
10model = AutoModelForCausalLM.from_pretrained(
11 "aphoticshaman/deepseek-coder-v2-lite-nf4",
12 quantization_config=bnb_config,
13 device_map="auto",
14 trust_remote_code=True,
15)
16tokenizer = AutoTokenizer.from_pretrained("aphoticshaman/deepseek-coder-v2-lite-nf4")