WorldReward: Reward Modeling for Camera-Conditioned World Models Paper • 2609.03952 • Published 8 days ago • 26
HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models Paper • 2608.13205 • Published 29 days ago • 3
AdaGRPO: A Capability-Aware Adaptive Enhancement for Flow-based GRPO Paper • 2606.06828 • Published Jun 5
CapRL++: Unified Reinforcement Learning with Verifiable Rewards for Dense Image and Video Captioning Paper • 2606.09393 • Published Jun 8
Light-WAM: Efficient World Action Models with State-Fusion Action Decoding Paper • 2606.08242 • Published Jun 6 • 12
SetCon: Towards Open-Ended Referring Segmentation via Set-Level Concept Prediction Paper • 2605.20110 • Published May 19 • 4
WorldReward Collection WorldReward: Reward Modeling for Camera-Conditioned World Models • 4 items • Updated 4 days ago • 1
WorldReward: Reward Modeling for Camera-Conditioned World Models Paper • 2609.03952 • Published 8 days ago • 26
WorldReward Collection WorldReward: Reward Modeling for Camera-Conditioned World Models • 4 items • Updated 4 days ago • 1
WorldReward: Reward Modeling for Camera-Conditioned World Models Paper • 2609.03952 • Published 8 days ago • 26
WorldReward Collection WorldReward: Reward Modeling for Camera-Conditioned World Models • 4 items • Updated 4 days ago • 1
WorldReward Collection WorldReward: Reward Modeling for Camera-Conditioned World Models • 4 items • Updated 4 days ago • 1