R. S. Sutton
RPC-LLM
AI & ML interests
Sampling-Based LLM Methods
Recent Activity
upvoted a paper about 10 hours ago
Can AI agents conduct open-ended AI research? Early evidence from two case studies upvoted a paper about 10 hours ago
SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution upvoted a paper about 10 hours ago
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy OptimizationOrganizations
None yet