Priya Kaminski
priyakaminski
ยท
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
liked a model 1 day ago
kaiokendev/superhot-13b-8k-no-rlhf-test liked a model 1 day ago
vwxyzjn/reward_modeling__EleutherAI_pythia-14m upvoted a paper 1 day ago
ShieldVLA: Feasibility-Aware Safety Alignment for Vision-Language-Action ModelsOrganizations
None yet