Updated 41 min ago · first seen 11 Sept 2026
model_01M29A5A47G2WC3DF4AFDZZ42A
Specification
No structured attributes yet.
Each value shows its source, tier and observation time. Conflicting claims are kept side by side and flagged — never averaged. How AI Atlas records facts →
Provenance
Attributed facts
0
Source tiers
—
Freshest observation
—
Conflicts
None
Modalities
Modalities unavailable.
Capabilities
Tool calling
Unavailable
Structured output
Unavailable
Reasoning
Unavailable
Vision
Unavailable
Audio
Unavailable
Fine-tuning available
Unavailable
No capability flags have been observed from a source yet — we do not infer them.
No structured attributes yet.
| Benchmark | Score | Metric | Config | Evaluated | Source |
|---|---|---|---|---|---|
| Aider polyglot | 51.6% | pass_rate_2 | date=2025-01-17 · command=aider --model claude-3-5-sonnet-20241022 · dirname=2025-01-17-19-44-33--sonnet-baseline-jan-17 · versions=0.71.2.dev | 17 Jan 2025 | aider.chatT2 |
| Aider polyglot | 99.6% | percent_cases_well_formed | date=2025-01-17 · command=aider --model claude-3-5-sonnet-20241022 · dirname=2025-01-17-19-44-33--sonnet-baseline-jan-17 · versions=0.71.2.dev | 17 Jan 2025 | aider.chatT2 |
| SWE-bench (full test split) | 24.89% | resolved | date=2024-11-21 · board=Test · system=AutoCodeRover-v2.0 · model_tag=claude-3-5-sonnet-20241022 | 21 Nov 2024 | swebench.comT2 |
| SWE-bench Lite | 30% | resolved | date=2024-12-03 · board=Lite · system=Kortix AI · model_tag=claude-3-5-sonnet-20241022 | 3 Dec 2024 | swebench.comT2 |
| SWE-bench Verified | 51.6% | resolved | date=2025-01-22 · board=Verified · system=AutoCodeRover-v2.1 · model_tag=claude-3-5-sonnet-20241022 | 22 Jan 2025 | swebench.comT2 |
| SWE-bench Verified | 46.2% | resolved | date=2024-11-08 · board=Verified · system=AutoCodeRover-v2.0 · model_tag=claude-3-5-sonnet-20241022 | 8 Nov 2024 | swebench.comT2 |
Scores are reported as published, with their evaluation configuration (harness, prompting, judge). Results with different configs are not directly comparable — see methodology.
Current prices
No current prices recorded
Price history
No hardware estimate available
No lineage recorded
Papers 0
No papers linked yet.
Repositories 0
No repositories linked yet.
As of
Rewind the record: see this entity's attributes exactly as AI Atlas knew them on a given day.
Claim history
No claims recorded yet
claude-3-5-sonnet-20241022 scores 30% on SWE-bench Lite
swebench_leaderboardclaude-3-5-sonnet-20241022 scores 46.2% on SWE-bench Verified
swebench_leaderboardclaude-3-5-sonnet-20241022 scores 51.6% on SWE-bench Verified
swebench_leaderboardclaude-3-5-sonnet-20241022 scores 24.89% on SWE-bench (full test split)
swebench_leaderboardNew model: claude-3-5-sonnet-20241022
aider_leaderboardclaude-3-5-sonnet-20241022 scores 99.6% on Aider polyglot
aider_leaderboardclaude-3-5-sonnet-20241022 scores 51.6% on Aider polyglot
aider_leaderboard
| Source | Document | Type | Tier | Last observed | Snapshots |
|---|---|---|---|---|---|
| SWE-bench leaderboards | swebench.com/ | leaderboard | T2· Quality secondary | 36 min ago | 1 |
| Aider polyglot leaderboard (data file on GitHub) | raw.githubusercontent.com/Aider-AI/aider/main/aider/website/_data/polyglot_leaderboard.yml | leaderboard | T2· Quality secondary | 41 min ago | 1 |
Tier 1 = official/primary, 2 = quality secondary, 3 = community, 4 = unverified. Every snapshot is archived; see all sources and the methodology.