arxiv:2511.05664
Seo Hyun Kim
shkim0116
AI & ML interests
None yet
Recent Activity
upvoted a paper about 10 hours ago
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation upvoted a paper 6 days ago
Language Models Can Control Their Own Attention upvoted a paper 2 months ago
LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL