Views
No views yet
| AB any-match | OOD any-match | |
|---|---|---|
| v7 pretrain only (no personas) | 0.518 | — |
| Baseline (plain-SFT, N=1k) | 0.594 ± 0.022 | — |
| Baseline (plain-SFT, N=11k) | 0.523 ± 0.013 | — |
| KL N=11k (this) | 0.728 ± 0.009 | 0.333 |
interpreter/ — PEFT LoRA adapter (rank 256) on Qwen/Qwen3-14Bencoder.pt, ao.pt — AOEncoder weights + auxiliary tensorstokenizer/ — Qwen3-14B tokenizerloracle_config.yaml — full training config1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-14B", torch_dtype=torch.bfloat16, device_map="cuda")
6loracle = PeftModel.from_pretrained(base, "ceselder/loracle-kl-distill-N11k/interpreter")
7tok = AutoTokenizer.from_pretrained("ceselder/loracle-kl-distill-N11k/tokenizer")svd_fixed_k16_mag7_rankfirst direction-token extractor — see the lora-oracles repo for the full inference pipeline.vllm SamplingParams(logprobs=20).KL(teacher_top20_renormed || student_logsoftmax_gathered), masked to assistant-token positions, lr 5e-4, 1 epoch.svd_fixed_k16_mag7_rankfirst, shape [4480, 5120] bf16.ceselder/loracle-pretrain-v7-sweep-A-oneq-final-step3120.self_description type).em_finance_v2) remains undetected — consistent with every loracle we've tested in this recipe family.