Weiqi Wang
mightyweaver
ยท
AI & ML interests
GUI Agent, Reinforcement Learning
Recent Activity
upvoted a paper about 2 hours ago
Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning upvoted a paper 5 days ago
Demystifying On-Policy Distillation: Roles, Pathologies, and RegulationsOrganizations
None yet