Views
No views yet
Qwen/Qwen3-8B, trained for the circuit-shotting BFCL single-call experiments.data/bfcl_strict_10k_mix/train.jsonlruns/issue49_bfcl_single_call/relp_full.npz160000 MLP channels32641024runs/issue49_bfcl_single_call/lora_bfcl10k_topk160000_r32_balanced_len1024_ckpt| condition | score |
|---|---|
| unmasked merged model | 683/1007 = 67.83% |
| k160 masked merged model | 418/1007 = 41.51% |
adapter_model.safetensors: PEFT LoRA adapter weightsadapter_config.json: PEFT adapter configtokenizer.json, tokenizer_config.json, chat_template.jinja: tokenizer artifactstrain_summary.json: training summaryeval_masked_summary.json: k160 masked eval summaryeval_unmasked_summary.json: unmasked eval summary