Views
No views yet
.litertlm format for on-device inference via Google AI Edge Gallery.| File | Size | Base Model | Params |
|---|---|---|---|
model.litertlm | ~2.4 GB | DuoNeural/Granite-4.1-3B-Abliterated | ~3B |
litert-torch 0.9.0..litertlm file → tap download (⬇)| Device | Backend | Tokens/sec |
|---|---|---|
| Flagship (SD 8 Gen 3+) | GPU/NPU | 15–40 tok/s |
| Mid-range | GPU | 5–15 tok/s |
| Any Android 12+ | CPU | 1–5 tok/s |
litert-torch 0.9.0, dynamic_wi4_afp32 recipe, cache_length=1024, --use_jinja_template False.| Platform | Link |
|---|---|
| HuggingFace | huggingface.co/DuoNeural |
| Website | duoneural.com |
| GitHub | github.com/DuoNeural |
| X / Twitter | @DuoNeural |
| duoneural@proton.me | |
| Newsletter | duoneural.beehiiv.com |
| Support | buymeacoffee.com/duoneural |