OmniTaskonomy: When Does Visual Generation Improve Visual Understanding? Paper • 2609.38079 • Published 12 days ago • 57
MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement Paper • 2610.11959 • Published 3 days ago • 65
From Evidence to Action: How Tool-Using Agents Fail Paper • 2610.07753 • Published 5 days ago • 45 • 3
Kandinsky 6.0 Video: Foundation Models for Synchronized Video and Audio Generation Paper • 2610.05608 • Published 7 days ago • 162
OneStreamer: Unifying Perception, Memory, and Proactive Response in Streaming Video Interaction Paper • 2610.01762 • Published 10 days ago • 236
Make Sparse Rewards Count: Density-Aware Reward Aggregation for Multi-Reward RL Paper • 2610.00574 • Published 11 days ago • 65
StoryEngine: A State-Grounded Agentic Framework for Video Storytelling Paper • 2609.33627 • Published 14 days ago • 18
Omni-Decision: Evidence-Ledger Planning for Omni-Modal Agents Paper • 2607.11433 • Published 17 days ago • 31