Views
No views yet

| File | Format | Size |
|---|---|---|
DeepSeek-R1-Distill-Qwen-1.5B-heretic-F16.gguf | GGUF F16 | 3.32 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q2_K.gguf | GGUF Q2_K | 718 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-IQ3_S.gguf | GGUF IQ3_S | 823 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q3_K_S.gguf | GGUF Q3_K_S | 821 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q3_K_M.gguf | GGUF Q3_K_M | 882 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q3_K_L.gguf | GGUF Q3_K_L | 935 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-IQ4_XS.gguf | GGUF IQ4_XS | 979 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q4_K_S.gguf | GGUF Q4_K_S | 1022 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q4_0.gguf | GGUF Q4_0 | 1017 MB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q4_1.gguf | GGUF Q4_1 | 1.08 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q4_K_M.gguf | GGUF Q4_K_M | 1.04 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q5_K_S.gguf | GGUF Q5_K_S | 1.17 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q5_K_M.gguf | GGUF Q5_K_M | 1.20 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q6_K.gguf | GGUF Q6_K | 1.36 GB |
DeepSeek-R1-Distill-Qwen-1.5B-heretic-Q8_0.gguf | GGUF Q8_0 | 1.76 GB |
llama serve -hf saidutta69/DeepSeek-R1-Distill-Qwen-1.5B-heretic to pull the default quant.1# llama.cpp - defaults to the Q4_K_M quant
2llama serve -hf saidutta69/DeepSeek-R1-Distill-Qwen-1.5B-heretic:Q4_K_M1# transformers
2from transformers import AutoModelForCausalLM, AutoTokenizer
3model_name = "saidutta69/DeepSeek-R1-Distill-Qwen-1.5B-heretic"
4model = AutoModelForCausalLM.from_pretrained(model_name, torch_dtype="auto", device_map="auto")
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6# ... inference codeMade with ❤️ by RACER IS OP — follow for more uncensored models