[ACM MM 2026] HPSv3++: Scaling Reward Models Across the Full Spectrum of Diffusion Model Capabilities
reinforcement-learning text-to-image diffusion-models reward-model human-preference hpsv3 preference-dataset
-
Updated
Sep 10, 2026 - Python