Kishan Panaganti
kishanpb
AI & ML interests
LLM Reasoning via RL and anything RL
Recent Activity
liked a dataset 12 days ago
XiaomiMiMo/MiMo-V2.6-RL-oss upvoted a paper about 1 month ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience submitted a paper about 1 month ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning ExperienceOrganizations
None yet