张畅
LunarDawn
·
AI & ML interests
None yet
Recent Activity
liked a model about 12 hours ago
Aleph-Alpha/Kolibri-1 upvoted a paper 17 days ago
RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement LearningOrganizations
None yet