M-rewardbench: Evaluating reward models in multilingual settings
Unknown
This paper introduces M-RewardBench, a benchmark for evaluating reward models in multilingual settings, revealing that current reward models exhibit limited robustness across languages.