Skip to content
AI Atlas
BenchmarkActivecategory · coding

Aider polyglot

aider.chat/docs/leaderboards

225 Exercism exercises in 6 languages, edit-format aware

quality57

Updated 3 h ago · first seen 11 Sept 2026

bench_01M293SPEMVE6W55699099NES3

Metric
pass rate (2 attempts) · %
Direction
Higher is better
Results
138 · 10 filtered
Leader
QwQ-32B + Qwen 2.5 Coder Instruct 100%

Leaderboard 10 current results · config contains “224”

Select models with +, then open Compare.

Leaderboard
#ModelScoreConfigEvaluatedSourceActions
1#1o3 (high) + gpt-4.1100%date=2025-06-27 · command=aider --model o3 · dirname=2025-06-27-23-53-57--o3-mini-high-diff-arch · versions=0.85.1.dev27 Jun 2025aider.chatT2 History
2#2GPT-4.5 PreviewOpenAI97.3%date=2025-02-27 · command=aider --model openai/gpt-4.5-preview · dirname=2025-02-27-20-26-15--gpt45-diff3 · versions=0.75.2.dev27 Feb 2025aider.chatT2 History
3#3R1 0528DeepSeek94.6%date=2025-06-06 · command=aider --model deepseek/deepseek-reasoner · dirname=2025-06-06-16-47-07--r1-diff · versions=0.84.1.dev6 Jun 2025aider.chatT2 History
4#4o3 Mini HighOpenAI93.3%date=2025-01-31 · command=aider --model o3-mini --reasoning-effort high · dirname=2025-01-31-20-42-47--o3-mini-diff-high · versions=0.72.4.dev31 Jan 2025aider.chatT2 History
5#5o1-2024-12-17 (high)91.5%date=2024-12-21 · command=aider --model openrouter/openai/o1 · dirname=2024-12-21-19-23-03--polyglot-o1-hard-diff · versions=0.69.2.dev21 Dec 2024aider.chatT2 History
6#6o3 (high) + gpt-4.178.2%date=2025-06-27 · command=aider --model o3 · dirname=2025-06-27-23-53-57--o3-mini-high-diff-arch · versions=0.85.1.dev27 Jun 2025aider.chatT2 History
7#7R1 0528DeepSeek71.4%date=2025-06-06 · command=aider --model deepseek/deepseek-reasoner · dirname=2025-06-06-16-47-07--r1-diff · versions=0.84.1.dev6 Jun 2025aider.chatT2 History
8#8o1-2024-12-17 (high)61.7%date=2024-12-21 · command=aider --model openrouter/openai/o1 · dirname=2024-12-21-19-23-03--polyglot-o1-hard-diff · versions=0.69.2.dev21 Dec 2024aider.chatT2 History
9#9o3 Mini HighOpenAI60.4%date=2025-01-31 · command=aider --model o3-mini --reasoning-effort high · dirname=2025-01-31-20-42-47--o3-mini-diff-high · versions=0.72.4.dev31 Jan 2025aider.chatT2 History
10#10GPT-4.5 PreviewOpenAI44.9%date=2025-02-27 · command=aider --model openai/gpt-4.5-preview · dirname=2025-02-27-20-26-15--gpt45-diff3 · versions=0.75.2.dev27 Feb 2025aider.chatT2 History

10 results

Scores are reported as published, with their evaluation configuration (harness, prompting, judge). The bar is relative to the best score on this page. Results with different configs are not directly comparable — see methodology.

The config filter matches a value inside each result's configuration (server-side, `config=` on the API). Chips are the values shared by several rows on the first page; per-model identifiers are not offered.