Views
No views yet
1from vllm import LLM, SamplingParams
2
3# Load the model
4llm = LLM(
5 model="bbarn4/Augmentoolkit-DataSpecialist-v0.1-AWQ",
6 quantization="awq"
7)
8
9# Generate
10prompts = ["Hello, my name is"]
11sampling_params = SamplingParams(temperature=0.8, top_p=0.95)
12outputs = llm.generate(prompts, sampling_params)
13
14for output in outputs:
15 print(f"Prompt: {output.prompt!r}, Generated text: {output.outputs[0].text!r}")