Views
No views yet

Qwen3-4B1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4model_id = "NoemaResearch/Apollo-1-4B"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 torch_dtype=torch.bfloat16,
10 device_map="auto",
11 trust_remote_code=True
12)
13
14messages = [
15 {"role":"system", "content":"You are Apollo, a helpful reasoning assistant."},
16 {"role":"user", "content":"Summarize the main differences between reinforcement learning and supervised learning."}
17]
18
19inputs = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
20outputs = model.generate(**inputs, max_new_tokens=768, temperature=0.6, top_p=0.9)
21print(tokenizer.decode(outputs[0], skip_special_tokens=True))temperature=0.4–0.8top_p=0.9–0.951@misc{noema2025apollo4b,
2 title={Apollo-1-4B},
3 author={Noema Research},
4 year={2025},
5 howpublished={\url{https://huggingface.co/NoemaResearch/Apollo-1-4B}}
6}