Views
No views yet
1from transformers import pipeline
2
3pipe = pipeline("text-generation", model="rafiqrana/meta-llama-3.1-8B-Instruct-4bit")1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3tokenizer = AutoTokenizer.from_pretrained("rafiqrana/meta-llama-3.1-8B-Instruct-4bit")
4model = AutoModelForCausalLM.from_pretrained("rafiqrana/meta-llama-3.1-8B-Instruct-4bit")1pip install --upgrade transformers bitsandbytes accelerate
21import transformers
2from huggingface_hub import login
3
4ACCESS_TOKENS='YOUR_ACCESS_TOKEN_HERE'
5
6login(ACCESS_TOKENS)
7
8model_id = "rafiqrana/llama-3.1-8B-Instruct-4bit"
9
10pipeline = transformers.pipeline(
11 task="text-generation",
12 model=model_id,
13 device_map="auto"
14)
15
16messages = [
17 {"role": "system", "content": "You are a intelligent assistent."},
18 {"role": "user", "content": "Introduce yourself concisely."},
19]
20
21terminators = [
22 pipeline.tokenizer.eos_token_id,
23 pipeline.tokenizer.convert_tokens_to_ids("<|eot_id|>")
24]
25
26while True:
27 response = pipeline(
28 messages,
29 max_new_tokens=256,
30 eos_token_id=terminators,
31 )
32
33 print(response[0]["generated_text"][-1]["content"])
34 messages.append({"role": "user", "content": input("Ask me anything >> ")})
35