A large-scale dataset for studying LLM routing in multi-turn conversations. Contains 20,000 multi-turn conversations from WildChat with per-turn responses and quality scores for 4 LLMs, enabling research on adaptive cost-quality tradeoff routing.
Judge model
Qwen3-235B-A22B-Instruct-2507… See the full description on the dataset page:
https://huggingface.co/datasets/JiaqiXue/mmr-routing-20k.