arxiv:2609.35433
Yihang Chen
YhangChen
AI & ML interests
None yet
Recent Activity
authored a paper 2 days ago
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models authored a paper 2 days ago
ReSPO: Reshaped Sequence Policy Optimization for Gradient Starvation in Off-Policy Learning