arxiv:2605.15726
Chanuk Lee
tally0818
AI & ML interests
LLM post-training
Recent Activity
upvoted a paper 16 minutes ago
SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem upvoted a paper 17 minutes ago
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation upvoted a paper about 7 hours ago
RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement LearningOrganizations
None yet