Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
upvoted a paper about 5 hours ago
PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning upvoted a paper 8 days ago
Kimi K3: Open Frontier IntelligenceOrganizations
None yet