MaLiang-Harness: A Programmable Path to Image and Video Generation
Haoyu Zhao, Zihao Zhang, Xudong Wang et al.
In-Context Learning for Robots: Methods and Applications
Haojian Huang, Zexi Li, Junhao Guo et al.
Scaling Properties of Same-Family On-Policy Distillation
Yuntai Bao, Qinfeng Li, Guoqing Jiang et al.
Omni-IO Skills: Harnessing Your Agent Omni-Native
Yanlin Li, Mingyang Hao, Shengqiong Wu et al.
Post-Training Leaves Behavioral Shadows on Unrelated Decisions
Ziyang Zhang, Yubin Jing, Yuanhao Zeng et al.
YuE2: Unifying Symbolic and Audio Music Generation at Frontier Quality
Ruibin Yuan, Jiahao Pan, Junyan Jiang et al.
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation
Hao Li, MeiJia Chen, Weijie Ren et al.
UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement
Fang Wu, Da Xing, Yanjie Huang et al.
VisionHOPE: Visual Backbones as Self-Modifying Learning Systems
Siran Peng, Tianshuo Zhang, Tianyu Fu et al.
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence
Xi Xiao, Tianchen Zhao, Youngeun Kim et al.
False Frontiers: Diagnosing and Mitigating Co-Cheating in Self-Evolving Search Agents
Meijia Chen, Hao Li, Zheng Lu et al.