GitHub has released ReviewBench, an open benchmark for comparing AI code review agents
GitHub has released ReviewBench, an open benchmark for comparing AI code review agents on a shared set of pull requests. Its 219 PRs span 19 languages, and the benchmark offers public data, a leaderboard, and a way to submit your own agent. It also reports whether offline scores tracked results in one Copilot production experiment.
Source
👉@sysadminoff
https://4sysops.com/archives/github-has-released-reviewbench-an-open-benchmark-for-comparing-ai-code-review-agents/
Post #20667
20
