zyx
zyx221
ยท
AI & ML interests
None yet
Recent Activity
upvoted a paper about 24 hours ago
RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning upvoted a paper about 24 hours ago
Reflect, Revise, Reuse: Training-Free Skill Evolution for GUI Agents upvoted a paper 22 days ago
TTPO: Test-Time Policy OptimizationOrganizations
None yet