Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3# Load model and tokenizer
4model = AutoModelForCausalLM.from_pretrained(
5 "justinj92/gpt-oss-nemo-20b",
6 torch_dtype="auto",
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained("justinj92/gpt-oss-nemo-20b")
10
11# Example: Multilingual reasoning
12messages = [
13 {"role": "system", "content": "reasoning language: Arabic"},
14 {"role": "user", "content": "¿Cuál es la capital de Australia?"}
15]
16
17inputs = tokenizer.apply_chat_template(
18 messages,
19 add_generation_prompt=True,
20 return_tensors="pt"
21)
22
23outputs = model.generate(
24 inputs,
25 max_new_tokens=512,
26 temperature=0.6,
27 do_sample=True
28)
29
30response = tokenizer.decode(outputs[0], skip_special_tokens=True)
31print(response)1# Specify reasoning language in system prompt
2reasoning_language = "French" # Can be any supported language
3system_prompt = f"reasoning language: {reasoning_language}"
4
5messages = [
6 {"role": "system", "content": system_prompt},
7 {"role": "user", "content": "Explain quantum computing in simple terms."}
8]1@misc{gpt-oss-nemo-20b,
2 title={GPT-OSS-NEMO-20B: A Multilingual Thinking Model},
3 author={justinj92},
4 year={2025},
5 howpublished={\url{https://huggingface.co/justinj92/gpt-oss-nemo-20b}},
6 note={Fine-tuned from openai/gpt-oss-20b using HuggingFaceH4/Multilingual-Thinking}
7}