Views
No views yet
1uv run --env-file .env evaluate.py \
2 --config config/act_patch/qwen_qwen_act_patch_cf.yaml \
3 --target_model_path Qwen/Qwen3-8B \
4 --task act_patch \
5 --model_path Transluce/act_patch_qwen3_8b_qwen3_8b \
6 --output_dir /PATH/TO/RESULTS/ \
7 --batch_size 641@misc{li2025traininglanguagemodelsexplain,
2 title={Training Language Models to Explain Their Own Computations},
3 author={Belinda Z. Li and Zifan Carl Guo and Vincent Huang and Jacob Steinhardt and Jacob Andreas},
4 year={2025},
5 eprint={2511.08579},
6 archivePrefix={arXiv},
7 primaryClass={cs.CL},
8 url={https://arxiv.org/abs/2511.08579},
9}