ZHANG
DaisyQue
AI & ML interests
None yet
Recent Activity
upvoted a paper about 2 months ago
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning upvoted a paper 2 months ago
Weak-to-Strong On-Policy Distillation updated a model almost 2 years ago
DaisyQue/finetuning-sentiment-model-tweet-finalVersion