| Corpus | ~12.2M tokens (84% OMC / 9% telemetry prose / 7% FineWeb-Edu replay) |
| Objective | CLM (next-token), full fine-tune, bf16 |
| LR / schedule | 1e-4 cosine, warmup 0.03 |
| Epochs / seq | 2 epochs, seq 4096, eff_batch 32 |
| Metric | Value | Note |
|---|---|---|
| domain eval loss | 1.531 | monotone decreasing, no overfit |
| general (FineWeb) loss | 1.494 | improves — replay works |
| telemetry loss | 0.443 | — |
noval-corp/scripts/eval_agentic.py.-instruct-paramdelta / -agentic siblings).noval-corp/scripts/gen_model_cards.py (standardized across the noval-corp model family).