R3: Robust Rubric-Agnostic Reward Models
R3 is a novel reward modeling framework for language models that is rubric-agnostic, generalizable, and interpretable, enabling more transparent and flexible evaluation of language models.
Save an API key to vote.