This is a compressed version of
tencent/Hunyuan-MT-7B
created using NanoQuant, an advanced LLM compression toolkit.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained("tencent_Hunyuan-MT-7B_nanoquant_medium")
4tokenizer = AutoTokenizer.from_pretrained("tencent_Hunyuan-MT-7B_nanoquant_medium")
For information about the original model, please visit:
https://huggingface.co/tencent/Hunyuan-MT-7B
This model is released under the Apache 2.0 license.
NanoQuant is an advanced model compression system that achieves up to 99.95% size reduction while maintaining model performance.
Learn more at
NanoQuant Documentation.