Nemotron-RL-InverseIFEval-v1
License: cc-by-4.0
Task Categories: reinforcement-learning, text-generation
Tags: instruction-following, adversarial, rlvr, nemo-gym
Configs: default train split at data/train.jsonl
Domain: instruction following, adversarial instruction following
Modality: text
Capability Breakdown: Counter-conventional instruction following [100%]
Source: Hybrid: Manually Collected, Synthetic
Size Bin: <10K
Associated Model Release: Nemotron Ultra
Dataset… See the full description on the dataset page: https://huggingface.co/datasets/nvidia/Nemotron-RL-InverseIFEval-v1.