Ayaka Nishimura
ayakani
ยท
AI & ML interests
anomaly detection
multi-agent RL
reward hacking
Recent Activity
liked a dataset about 11 hours ago
Dahoas/full-hh-rlhf liked a dataset about 11 hours ago
D21W12/Diffusion-Deep-Reinforcement-Learning liked a dataset about 11 hours ago
DBbun/motoman-up6-cq-lambda-reinforcement-learning_v1.0Organizations
None yet