Views
No views yet
[SYSTEM_PROMPT]
####### Instruction:
[INPUT]
%%%%%%% Response:
[RESPONSE]1from torch.cuda.amp import autocast
2from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer, pipeline
3
4model_name = "1TuanPham/T-Llama-v1.1"
5model = AutoModelForCausalLM.from_pretrained(model_name,
6 torch_dtype=torch.bfloat16,
7 use_cache=True,
8 )
9tokenizer = AutoTokenizer.from_pretrained(model_name, use_fast=True)
10streamer = TextStreamer(tokenizer, skip_special_tokens=True)
11pipe = pipeline("text-generation", model=base_model, tokenizer=tokenizer, streamer=streamer)
12
13with autocast():
14 output_default = pipe("Phạm Nhật Vượng là ", pad_token_id=50256, max_new_tokens=128)
15