Jorge Roldan PRO
roldanjorge
AI & ML interests
None yet
Recent Activity
liked a dataset 7 minutes ago
redwoodresearch/sandbagging-raw-data liked a dataset 13 days ago
sandbagging-games/evaluation_logs upvoted a collection about 1 month ago
(Some) Emergent Misalignment from Reward Hacking in RL