Kishan Panaganti
kishanpb
AI & ML interests
LLM Reasoning via RL and anything RL
Recent Activity
liked a dataset 5 days ago
XiaomiMiMo/MiMo-V2.6-RL-oss upvoted a paper 24 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience submitted a paper 24 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning ExperienceOrganizations
None yet