Ivy
FURUF
AI & ML interests
NLP RL
Recent Activity
upvoted a paper about 2 months ago
StateAct: Program State, before Pixels, for Long-Horizon Computer-Use Agents upvoted a paper 8 months ago
Shaping capabilities with token-level data filtering upvoted a paper 8 months ago
Reinforcement Learning via Self-DistillationOrganizations
None yet