Research data from the Tribunus Compute inference engine. Includes benchmark results, backend comparison data, TurboQuant KV cache compression analysis, ComputeImage compile manifests, and evidence receipts.
All benchmarks run on Apple Silicon (M1 Max, 64GB) running macOS 26.5.
Model: Qwen2.5 0.5B Instruct (NF4 quantized)
Temperature: 0.0 (greedy)
Tokens: variable (50-512 per run)
Warm-up: 3 runs before measurement
Report:… See the full description on the dataset page:
https://huggingface.co/datasets/Tribunus-dev/tribunus-benchmarks.