arxiv:2606.18101
🔄 In a Training Loop
Huang Jingyuan
JingyuanHuang
·
AI & ML interests
PhD student working on multimodal agents
Recent Activity
upvoted a paper 26 days ago
Recursive Synthesis for Long-Horizon Terminal Tasks upvoted a paper about 1 month ago
MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-TrainingOrganizations
None yet