ZHANG
DaisyQue
AI & ML interests
None yet
Recent Activity
upvoted a paper 3 days ago
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning upvoted a paper 8 days ago
Weak-to-Strong On-Policy Distillation updated a model over 1 year ago
DaisyQue/finetuning-sentiment-model-tweet-finalVersion