Priya Kaminski
priyakaminski
ยท
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
liked a model about 7 hours ago
kaiokendev/superhot-13b-8k-no-rlhf-test liked a model about 7 hours ago
vwxyzjn/reward_modeling__EleutherAI_pythia-14m upvoted a paper about 7 hours ago
ShieldVLA: Feasibility-Aware Safety Alignment for Vision-Language-Action ModelsOrganizations
None yet