张畅
LunarDawn
·
AI & ML interests
None yet
Recent Activity
liked a model 2 days ago
Aleph-Alpha/Kolibri-1 upvoted a paper 19 days ago
RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement LearningOrganizations
None yet