arxiv:2609.35433
Yihang Chen
YhangChen
AI & ML interests
None yet
Recent Activity
authored a paper 1 day ago
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models authored a paper 1 day ago
ReSPO: Reshaped Sequence Policy Optimization for Gradient Starvation in Off-Policy Learning