RaR-Science is a dataset curated for training and evaluating language models on science domain using structured rubric-based supervision. Each example includes a science related question, a reference answer, and checklist-style rubric annotations generated via OpenAI's o3-mini. This dataset is introduced in Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains.