GGUF quantized versions of AtomicFission-7B-v1 for efficient CPU/GPU inference.
☢️ Model Description
These are GGUF format quantizations of AtomicFission-7B-v1, a Mistral-7B model fine-tuned on publicly available nuclear documentation. The model specializes in nuclear engineering topics including reactor physics, safety systems, and operational procedures.
Available Quantizations
Filename
Size
Quality
Use Case
RAM Required
AtomicFission-7B-v1-Q8_0.gguf
7.7GB
Near lossless
Maximum quality, research
~8.5GB
AtomicFission-7B-v1-Q6_K.gguf
5.9GB
Very High
Quality-focused deployment
~6.5GB
AtomicFission-7B-v1-Q5_K_M.gguf
5.1GB
High - Recommended
Best balance
~5.5GB
AtomicFission-7B-v1-Q5_K_S.gguf
5.0GB
High
Slightly faster than K_M
~5.5GB
AtomicFission-7B-v1-Q4_K_M.gguf
4.3GB
Good - Faster than Q5
Standard deployment
~5GB
AtomicFission-7B-v1-Q4_K_S.gguf
4.1GB
Good
Faster inference
~4.5GB
AtomicFission-7B-v1-Q3_K_M.gguf
3.5GB
Acceptable
Limited resources
~4GB
AtomicFission-7B-v1-Q2_K.gguf
2.7GB
Low
Maximum compression
~3.5GB
Quick Start
Using llama.cpp
bash
1# Download a model2wget https://huggingface.co/dougeeai/AtomicFission-7B-v1-GGUF/resolve/main/AtomicFission-7B-v1-Q5_K_M.gguf
34# Run inference5./main -m AtomicFission-7B-v1-Q5_K_M.gguf \6 -p "Question: What is reactor criticality?\nAnswer:"\7 -n 200 --gpu-layers 35
Using LM Studio
Download LM Studio
Search for "AtomicFission"
Download preferred quantization
Load and chat
Using Ollama
Create a Modelfile:
FROM ./AtomicFission-7B-v1-Q5_K_M.gguf
TEMPLATE """Question: {{ .Prompt }}
Answer: """