ModelRefs / RepoBench Leaderboard — AI Model Scores
RepoBench Leaderboard — AI Model Scores
Repository-level code completion across long context. Current leaders, methodology, and citation sources for RepoBench.
Overview
Repository-level code completion across long context.
How it is measured: Exact-match / edit-similarity across retrieval + completion.
How this benchmark is scored
| Category | coding |
|---|---|
| Maximum score | 100 % EM |
| Direction | Higher is better |
Primary source: https://arxiv.org/abs/2306.03091
Continue your research
Use these connected ModelRefs sections to compare alternatives, inspect implementation paths, and review the evidence and governance boundaries relevant to RepoBench Leaderboard — AI Model Scores.