Strong Teacher Not Needed? On Distillation in LLM Pretraining Paper • 2605.23857 • Published May 22 • 1
i1: A Simple and Fully Open Recipe for Strong Text-to-Image Models Paper • 2606.11289 • Published Jun 9 • 17
Thinking with Spatial Code for Physical-World Video Reasoning Paper • 2603.05591 • Published Mar 5 • 1
3DSRBench: A Comprehensive 3D Spatial Reasoning Benchmark Paper • 2412.07825 • Published Dec 10, 2024 • 12
ViTamin: Designing Scalable Vision Models in the Vision-Language Era Paper • 2404.02132 • Published Apr 2, 2024 • 2