赛博牛马

AI 资源导航与内容门户

资源详情

大型语言模型裁判

用于比较不同代码仓库中代码实现的 LLM 作为评判者的方法。对实现的功能性、安全性、测试质量、过度工程等方面进行评分...

介绍

用于比较不同代码仓库中代码实现的 LLM 作为评判者的方法。对实现的功能性、安全性、测试质量、过度工程等方面进行评分...