Views
No views yet
Ling-3.0-tiny-bf16enhanced=True)oq_imatrix_report.json records the resulting quantization allocation.python run_oqe_conversion.py Ling-3.0-tiny-bf16 --models-dir /path/to/models --oq-level 6.0 --imatrix-samples 128 --imatrix-seq-length 512 --source-repo https://huggingface.co/inclusionAI/Ling-3.0-tinymodel*.safetensors: quantized MLX weightsmodel.safetensors.index.json: shard indexconfig.json: model configurationoq_imatrix_report.json: imatrix calibration and quantization report