arxiv:2506.03569
Li Shicheng
lscpku
AI & ML interests
None yet
Recent Activity
upvoted a paper 2 days ago
MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement upvoted a paper 19 days ago
CodeMidas: Scaling Agentic Coding RL Environments from Code Itself upvoted a paper 8 months ago
Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation