Arjun Patel
apatel-1995
ยท
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
liked a dataset about 8 hours ago
andersonbcdefg/red_teaming_reward_modeling_pairwise liked a dataset about 8 hours ago
ProlificAI/social-reasoning-rlhf upvoted a paper about 8 hours ago
Language Models Are "Insecure" ReportersOrganizations
None yet