TRIAGE: Direction-Aware Mismatch Stabilization of Native NVFP4 Reinforcement Learning
Paper • 2610.07043 • Published • 42
None defined yet.
PhysVista: Benchmarking Physical Intelligence in VLMs via a Perception-Reasoning-Assessment Loop
VLA-Precision: Asymmetric Co-Bootstrapping for Efficient Real-World Online RL of Vision-Language-Action Models