Views
No views yet
1from gptqmodel import GPTQModel
2model = GPTQModel.from_quantized("namgyu-youn/EXAONE-4.0-1.2B-GPTQ-W4A16-EoRA", device="cuda:0")1from vllm import LLM
2llm = LLM(model="namgyu-youn/EXAONE-4.0-1.2B-GPTQ-W4A16-EoRA", dtype="float16")