-
Comprehensive egocentric understanding
Strong spatial comprehension and egocentric cognition across embodied QA, counting, OCR, and fine-grained video understanding.
-
Diverse spatiotemporal localization
Locates objects, target areas, and predicts trajectories across long episodic context, enabling global spatial awareness.
-
Physical-space grounded reasoning (RynnBrain family)
The broader RynnBrain family includes “Thinking” variants that interleave textual reasoning with spatial grounding to anchor reasoning in reality.
-
Physics-aware precise planning (RynnBrain family)
Integrates localized affordances/areas/objects into planning outputs to provide downstream VLA models with precise instructions.
1from transformers import AutoModelForImageTextToText
2model = AutoModelForImageTextToText.from_pretrained("")
3...
Checkout the
cookbooks that showcase RynnBrain's capabilities in cognition, localization, reasoning, and planning.