Oliver Torres
otorres206
AI & ML interests
None yet
Recent Activity
upvoted a paper about 20 hours ago
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization liked a dataset about 24 hours ago
Maximilians/ps2_hf1 upvoted a paper 2 days ago
Progress Reward Modeling for Robotic Learning: A Comprehensive SurveyOrganizations
None yet