Views
No views yet
<|system|> / <|user|> / <|assistant|>; Assistant-Turns enden mit dem nativen
<|endoftext|> (= EOS/Stop). Das Template ist im Tokenizer hinterlegt:1from transformers import AutoModelForCausalLM, AutoTokenizer
2tok = AutoTokenizer.from_pretrained(REPO)
3model = AutoModelForCausalLM.from_pretrained(REPO, dtype="bfloat16", device_map="auto")
4msgs = [{"role":"system","content":"... ## Kontextdokumente ... [DOK 1] ..."},
5 {"role":"user","content":"Deine Frage"}]
6ids = tok.apply_chat_template(msgs, add_generation_prompt=True, return_tensors="pt").to(model.device)
7print(tok.decode(model.generate(ids, max_new_tokens=600)[0][ids.shape[1]:], skip_special_tokens=True))