Views
No views yet
| Parameter | Value |
|---|---|
| Base Model | Julian-600M-40B (39B tokens pretraining) |
| Parameters | 600M |
| Architecture | LLaMA-style (RoPE, SwiGLU, RMSNorm) |
| SFT Training | 5,000 steps on 185K instruction examples |
| Final Loss | 1.99 (PPL: 7.34) |
| Context Length | 2048 tokens |
| Languages | English (70%), French (30%) |
| Chat Format | ChatML |
1from transformers import AutoModelForCausalLM, LlamaTokenizer
2import torch
3
4model_id = "JulianKrgd/julian-600m-40b-instruct-v0.1"
5
6# IMPORTANT: Use LlamaTokenizer, not AutoTokenizer
7tokenizer = LlamaTokenizer.from_pretrained(model_id)
8model = AutoModelForCausalLM.from_pretrained(
9 model_id,
10 torch_dtype=torch.bfloat16,
11 device_map="auto"
12)
13
14# Chat format (ChatML)
15messages = [
16 {"role": "user", "content": "What is the capital of France?"}
17]
18prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
19inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
20
21outputs = model.generate(
22 **inputs,
23 max_new_tokens=100,
24 temperature=0.7,
25 top_p=0.9,
26 do_sample=True,
27 repetition_penalty=1.1
28)
29print(tokenizer.decode(outputs[0], skip_special_tokens=True))<|im_start|>user
What is the capital of France?<|im_end|>
<|im_start|>assistant
The capital of France is Paris.<|im_end|>checkpoint_300000 (39B tokens pretraining)| Model | HellaSwag | PIQA | LAMBADA |
|---|---|---|---|
| Julian-600M-10B (Base) | 45.8% | 67.6% | 35.0% |
| Julian-600M-40B (Base) | 53.5% | 66.8% | 37.3% |
| Julian-600M-10B-Instruct v0.1 | 42.7% | 66.2% | 34.6% |
| Julian-600M-40B-Instruct v0.1 | TBD | TBD | TBD |