Submitted by
Zhuoran Jin
AI & ML interests
None defined yet.
Recent Activity
Papers
The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation
Why Multi-Step Tool-Use Reinforcement Learning Collapses and How Supervisory Signals Fix It
Submitted by
Zhuoran Jin
Submitted by
Zhuoran Jin
Submitted by
Hongbo Wang
Submitted by
Xiaotian Ye
Submitted by
zihan
Submitted by
TanYuQiao
Submitted by
hxz
Submitted by
Yixin Zhang
Submitted by
mz.w
Submitted by
Hongbo Zhao
Submitted by
hongyuyang
Submitted by
Zhuoran Jin
Submitted by
hongyuyang
Submitted by
WenYang