Views
No views yet
wget https://github.com/intel/auto-round/archive/refs/tags/v0.4.7.tar.gz
tar -xvzf v0.4.7.tar.gz
cd auto-round-0.4.7
pip install -r requirements-cpu.txt --upgradepip install -vvv --no-build-isolation -e .[cpu] from transformers import AutoModelForCausalLM, AutoTokenizer
model_name = "EleutherAI/pythia-14m"
model = AutoModelForCausalLM.from_pretrained(model_name)
tokenizer = AutoTokenizer.from_pretrained(model_name)
from auto_round import AutoRound
bits, group_size, sym, device = 4, 64, True, 'cpu'
autoround = AutoRound(model, tokenizer, nsamples=128, iters=200, seqlen=512, batch_size=4, bits=bits, group_size=group_size, sym=sym, device=device)
autoround.quantize()
output_dir = "./AutoRound/EleutherAI_pythia-14m-autoawq-int4-gs64-sym"
auto
## License
[Apache 2.0 License](https://choosealicense.com/licenses/apache-2.0/)
## Disclaimer
This quantized model comes with no warrenty. It has been developed only for research purposes.