Views
No views yet
| Model | Gitlab | CMS | Map | OSS | Avg.SR | |
|---|---|---|---|---|---|---|
| Llama-3.1-8B-Instruct | 0.0 | 3.3 | 2.9 | 3.3 | 11.1 | 4.8 |
| GLM-4-9B-Chat | 5.3 | 10.0 | 6.7 | 3.3 | 6.7 | 6.1 |
| WebRL-Llama-3.1-8B | 63.2 | 46.7 | 54.3 | 36.7 | 31.1 | 42.4 |
@artical{qi2024webrl,
title={WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning},
author={Zehan Qi and Xiao Liu and Iat Long Iong and Hanyu Lai and Xueqiao Sun and Xinyue Yang and Jiadai Sun and Yu Yang and Shuntian Yao and Tianjie Zhang and Wei Xu and Jie Tang and Yuxiao Dong},
journal={arXiv preprint arXiv:2411.02337},
year={2024},
}