内容持续更新中
智源研究院开源了一种名为 JudgeLM 的裁判模型,可以高效准确地评判各类大模型。与 GPT-4 相比,JudgeLM 仅需 1/120 的成本,就能达到 90% 以上的评判结果一致性。JudgeL…