跳到正文
稳定报道时间 2026-10-02 12:00

LexReward:一种面向法律语言模型的分类驱动奖励框架

一个新的框架LexReward被引入用于法律语言模型,专注于通过风格和元素维度进行多维质量评估。

01

证据

  • AarXiv cs.CL研究机构2026-10-02 12:00
    > Abstract: Legal language models require reward signals that capture not only answer correctness but also the multidimensional quality of legal responses.
    查看来源
  • AarXiv cs.CL研究机构2026-10-02 12:00
    Abstract: Legal language models require reward signals that capture not only answer correctness but also the multidimensional quality of legal responses. Exist…
    查看来源