Junjie Guo
TealOrange
AI & ML interests
None yet
Recent Activity
upvoted a paper 8 days ago
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning upvoted a paper about 1 year ago
Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning liked a model over 1 year ago
zhibinlan/LLaVE-7BOrganizations
None yet