FIRM-Reward
Collection
The data and models of the FIRM series. • 10 items • Updated • 1
None defined yet.
Trust Your Critic: Robust Reward Modeling and Reinforcement Learning for Faithful Image Editing and Generation
Co-Training Vision Language Models for Remote Sensing Multi-task Learning