Memadapter: Counterfactual Adaptation Against Memory-induced Sycophancy Paper • 2610.05162 • Published 7 days ago • 60
When to Switch: Reliable Action-Chunk Extension for Vision-Language-Action Models Paper • 2610.05719 • Published 6 days ago • 32
Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL Paper • 2609.37200 • Published 12 days ago • 140
Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models Paper • 2609.34972 • Published 13 days ago • 30
Think Before You Score: Thinking Reward Model for Visual Generation Paper • 2609.37372 • Published 12 days ago • 104
RewardVerse: Rubric-Guided Policy Optimization for Video Reward Modeling Paper • 2609.22947 • Published 22 days ago • 43