Views
No views yet
ollama pull vallehorn/german-audio-correction-gemma2:q4_k_mollama run vallehorn/german-audio-correction-gemma21from unsloth import FastLanguageModel
2
3model, tokenizer = FastLanguageModel.from_pretrained("ValleHorn/german-audio-correction-gemma2")
4model = FastLanguageModel.for_inference(model)
5
6messages = [{"role": "user", "content": "Noisy German text here"}]
7inputs = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to("cuda")
8outputs = model.generate(input_ids=inputs, max_new_tokens=128, temperature=0.7)
9print(tokenizer.decode(outputs[0][len(inputs[0]):], skip_special_tokens=True))