[评审] RM-Bench: 以细腻度和风格对语言模型奖励模型进行基准评测
原题:RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style - 评审均分:8.0 - 决定:Accept (Oral) - 链接:https://openreview.net/forum?id=QEHrmQPBdd
原题:RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style - 评审均分:8.0 - 决定:Accept (Oral) - 链接:https://openreview.net/forum?id=QEHrmQPBdd