Views
No views yet
old-cuda (text-generation-webui default) see TheBloke/WizardLM-7B-uncensored-GPTQ1config: dict = dict(
2 quantize_config=dict(bits=8, desc_act=True, true_sequential=True, model_file_base_name='WizardLM-7B-Uncensored'),
3 use_safetensors=True
4)quantize.py for the full script.triton branch.cuda (triton deselected)quantize_config.json.