GitHub 发布 AI 代码审查开放基准 ReviewBench
热点事件持续更新
GitHub 发布 AI 代码审查开放基准 ReviewBench
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
GitHub 发布面向 AI 代码评审的开放基准 ReviewBench,用于离线评估代码审查模型。该基准基于 1.039 亿个 GitHub PR 的分布分析构建,包含 219 个公开 PR,采用多来源黄金集和统一评价标准,高级工程师独立复核的一致性为 96.6%。 GitHub 称,用它评估 Copilot code review 时,离线预测方向与线上 A/B 实验一致。ReviewBench 研究预览版已通过官方网站开放,提交的分数在维护者审核前保持私密,仅当超过现有成绩或首次提交时才会发布到排行榜。
AI 根据报道生成 · 1 小时前更新
最新进展10月5日 23:59
ReviewBench:面向 AI 代码评审的开放评测基准报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- GitHub Blog · AI & ML精选ReviewBench:面向 AI 代码评审的开放评测基准
GitHub 发布面向 AI 代码评审的开放基准 ReviewBench,基于 1.039 亿个 GitHub PR 的分布分析构建,包含 219 个公开 PR。基准采用多来源黄金集和统一评价标准,高级工程师独立复核的一致性达 96.6%。GitHub 用它评估 Copilot code review 时,离线预测方向与线上 A/B 实验一致。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。