Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
authored a paper 1 day ago
Two-Stage Regularization-Based Structured Pruning for LLMs authored a paper 1 day ago
PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement LearningOrganizations
None yet