Views
No views yet

Qwen3-1.7B1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4model_id = "NoemaResearch/Apollo-1-2B"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 torch_dtype=torch.bfloat16,
10 device_map="auto",
11 trust_remote_code=True
12)
13
14messages = [
15 {"role":"system", "content":"You are Apollo, a reasoning assistant."},
16 {"role":"user", "content":"Explain the difference between supervised and unsupervised learning."}
17]
18
19inputs = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
20outputs = model.generate(**inputs, max_new_tokens=512, temperature=0.7, top_p=0.9)
21print(tokenizer.decode(outputs[0], skip_special_tokens=True))temperature=0.5–0.9top_p=0.85–0.951@misc{noema2025apollo,
2 title={Apollo-1-2B},
3 author={Noema Research},
4 year={2025},
5 howpublished={\url{https://huggingface.co/NoemaResearch/Apollo-1-2B}}
6}