Views
No views yet
| Model | Perplexity | Improvement |
|---|---|---|
| GPT2-XL (baseline) | 14.39 | - |
| GPT2-XL-Finetuned | 10.16 | -4.23 |
1@article{cao2025memory,
2 title={Memory decoder: A pretrained, plug-and-play memory for large language models},
3 author={Cao, Jiaqi and Wang, Jiarui and Wei, Rubin and Guo, Qipeng and Chen, Kai and Zhou, Bowen and Lin, Zhouhan},
4 journal={arXiv preprint arXiv:2508.09874},
5 year={2025}
6}