Views
No views yet
prompt → Student (Qwen2.5-Coder-0.5B) → generates code → Fast Python syntax scorer (1ms) → DeepSeek API reasoning judge (~3s) → Score ≥ 5.5 → LoRA rank 16 fine-tune
def is_palindrome(s):
s = s.lower().replace(" ", ""); return s == s[::-1]
def fibonacci(n):
n = int(n); return [1, n]
def reverse_list(arr):
def reverse(arr, size): arr = [1,2,3,4,5]
def binary_search(arr, target):
selfplay-coder-0.5B-Q8_0.gguf
model.safetensors
config.json
tokenizer.json
llama-server -m selfplay-coder-0.5B-Q8_0.gguf -ngl 99 --port 8080
1from transformers import AutoModelForCausalLM, AutoTokenizer 2 3model = AutoModelForCausalLM.from_pretrained("Strangefrost/CloneOllama-selfplay-coder-0.5B") 4tokenizer = AutoTokenizer.from_pretrained("Strangefrost/CloneOllama-selfplay-coder-0.5B") 5 6prompt = "def fibonacci(n):" 7inputs = tokenizer(prompt, return_tensors="pt") 8outputs = model.generate(**inputs, max_new_tokens=50) 9print(tokenizer.decode(outputs[0]))
model-kitchen/
selfplay_train.py
prune.py
train_utils.py
merge.py
upcycle.py