Get Started
Home
Topics
Search
Library
148 papers · page 11 of 15

Research archive

Every paper covered by r*cap, newest first.
Read It Back: Pretrained MLLMs Are Zero-Shot Reward Models for Text-to-Image Generation
Image Generation · Jul 13
SynthDocBench: Controlled Benchmark for Long-Context Visual Document Understanding
Evaluation · Jul 11
Video Generation Models are General-Purpose Vision Learners
Inference Optimization · Jul 10
UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks
Agents · Jul 9
Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation
Agents · Jul 9
Infinite Worlds with Versatile Interactions
Agents · Jul 8
Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning
Agents · Jul 8
Dual Latent Memory in Vision-Language-Action Models for Robotic Manipulation
Multimodal · Jul 8
Trust Region Policy Distillation
LLM Training · Jul 6
PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space
Diffusion · Jul 6
123456789101112131415