Views
No views yet
1config: dict = dict(
2 quantize_config=dict(model_file_base_name='WizardLM-7B-Uncensored',
3 bits=8, desc_act=False, group_size=128, true_sequential=True),
4 use_safetensors=True
5)quantize.py for the full script.triton branch.quantize_config.json.