Skip to content
AI Atlas
BenchmarkActivecategory · coding

Aider polyglot

aider.chat/docs/leaderboards

225 Exercism exercises in 6 languages, edit-format aware

quality57

Updated 2 h ago · first seen 11 Sept 2026

bench_01M293SPEMVE6W55699099NES3

Metric
pass rate (2 attempts) · %
Direction
Higher is better
Results
138
Leader
QwQ-32B + Qwen 2.5 Coder Instruct 100%

As of

Rewind the record: see this entity's attributes exactly as AI Atlas knew them on a given day.

Claim history

6 claims · 6 properties

Categorycategory1

Claim history for Category
ValueValid from → toStatusSourceConfidenceExtractor
codingcurrentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Known limitationsknown_limitations1

Claim history for Known limitations
ValueValid from → toStatusSourceConfidenceExtractor
Depends on aider's edit format and prompting; cost column depends on provider pricing.currentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Metricmetric1

Claim history for Metric
ValueValid from → toStatusSourceConfidenceExtractor
pass rate (2 attempts)currentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Tasktask1

Claim history for Task
ValueValid from → toStatusSourceConfidenceExtractor
225 Exercism exercises in 6 languages, edit-format awarecurrentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Unitunit1

Claim history for Unit
ValueValid from → toStatusSourceConfidenceExtractor
%currentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Websitewebsite1

Claim history for Website
ValueValid from → toStatusSourceConfidenceExtractor
https://aider.chat/docs/leaderboards/currentcurrentAI Atlas curated registry (YAML, versioned in git, every entry carries its source URL)T2mediumcurated

Claims are temporal and append-only: a new observation closes the previous claim (valid_to) instead of overwriting it. Conflicting claims from different sources are kept side by side and flagged — never averaged. Methodology →