The last 30 days in AI
Deterministic counters over events that occurred in the window — historical backfill excluded, so a re-crawl of old pages never inflates them. Hover a label for how each one is counted.
13 Aug 2026 → 12 Sept 2026 06:34 UTC
Window
All counters use is_backfill = false and occurred_at inside the window. Sparklines show the daily stats history where a series exists (2 days recorded so far).
MethodDeterministic counters over events that OCCURRED in the window and are not back-filled history; each counter carries its own definition. /methodology
Benchmark leadership
New benchmark leaders · 15
benchmarks whose primary-group leader (computed from results observed by each date) changed over the window
| Benchmark | Current leader | Score | Previous leader | Group | Trust |
|---|---|---|---|---|---|
| GPQA | gpt-6-astraOpenAI | 96.26 accuracy | first leader recorded | accuracy · variant=GPQA Diamond · evaluator=Artificial Analysis · n=459 | independent evaluator |
| SWE-bench Verified | Claude Opus 4.5Anthropic | 76.8 resolved | first leader recorded | resolved · board=Verified · system=mini-SWE-agent · n=42 | official benchmark |
| Aider polyglot | gpt-5OpenAI | 86.7 pass_rate_2 | first leader recorded | pass_rate_2 · n=61 | official benchmark |
| LiveBench | Claude Fable 5.1Anthropic | 83.41 global_average | first leader recorded | global_average · n=57 | official benchmark |
| Humanity's Last Exam | Claude Fable 5.1Anthropic | 59.13 accuracy | first leader recorded | accuracy · evaluator=Artificial Analysis · n=453 | independent evaluator |
| Terminal-Bench | gpt-5.6-solOpenAI | 65.91 accuracy | first leader recorded | accuracy · variant=hard · evaluator=Artificial Analysis · n=315 | independent evaluator |
| Artificial Analysis Intelligence Index | Claude Fable 5.1Anthropic | 53.37 index | first leader recorded | index · n=477 | independent evaluator |
| SWE-bench Lite | claude-3-opusAnthropic | 4.33 resolved | first leader recorded | resolved · board=Lite · system=RAG baseline · n=6 | official benchmark |
| SWE-bench (full test split) | claude-3-opusAnthropic | 3.79 resolved | first leader recorded | resolved · board=Test · system=RAG baseline · n=6 | official benchmark |
| SWE-bench Multimodal | o3OpenAI | 35.98 resolved | first leader recorded | resolved · board=Multimodal · system=GUIRepair · n=4 | official benchmark |
| SWE-bench Multilingual | gemini-3-flashGoogle | 72.7 resolved | first leader recorded | resolved · board=Multilingual · system=mini-SWE-agent · n=13 | official benchmark |
| MMMU-Pro | gpt-6-astraOpenAI | 86.88 accuracy | first leader recorded | accuracy · evaluator=Artificial Analysis · n=156 | independent evaluator |
| SciCode | Claude Fable 5.1Anthropic | 63.08 accuracy | first leader recorded | accuracy · evaluator=Artificial Analysis · n=126 | independent evaluator |
| IFBench | Grok 4.3xAI | 83.33 accuracy | first leader recorded | accuracy · evaluator=Artificial Analysis · n=333 | independent evaluator |
| τ²-bench | Z.ai GLM 5.2Z.ai (Zhipu AI) | 99.12 pass^1 | first leader recorded | pass^1 · evaluator=Artificial Analysis · n=323 | independent evaluator |
Prices
Price changes · 20 · median -0.41 %
PRICE_CHANGED events in the window; % change = output price (else input) new vs old from the event's old/new values; median over events with both values
The pulse returns the count only; the rows below are PRICE_CHANGED events since 13 Aug 2026 from the change feed (same window, same backfill rule).
| Model | Provider | Input / 1M | Output / 1M | Change | Observed | Source |
|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.067$0.067↓ | $0.134$0.134↓ | in −0.4%out −0.4% | 2 h ago | openrouter.ai |
| DeepSeek V4 Pro 0423DeepSeek | DeepSeek API | $0.829$0.819↓ | $1.66$1.64↓ | in −1.2%out −1.2% | 2 h ago | openrouter.ai |
| DeepSeek V4 Flash (0731)DeepSeek | DeepSeek API | $0.065$0.04↓ | $0.18$0.08↓ | in −38%out −56% | 2 h ago | openrouter.ai |
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.067$0.067↑ | $0.134$0.134↑ | in +0.4%out +0.4% | 3 h ago | openrouter.ai |
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.067$0.067↓ | $0.135$0.134↓ | in −0.8%out −0.8% | 4 h ago | openrouter.ai |
| DeepSeek V4 Pro 0423DeepSeek | DeepSeek API | $0.85$0.829↓ | $1.7$1.66↓ | in −2.4%out −2.4% | 4 h ago | openrouter.ai |
| Llama 3.1 70B InstructMeta AI | OpenRouter | $0.40$0.72↑ | $0.40$0.72↑ | in +80%out +80% | 7 h ago | openrouter.ai |
| Qwen3 235B A22B Instruct 2507Qwen | OpenRouter | $0.22$0.087↓ | $0.88$0.35↓ | in −60%out −60% | 7 h ago | openrouter.ai |
| MiniMax M2.5MiniMax | MiniMax API | $0.27$0.30↑ | $1.08$1.2↑ | in +11%out +11% | 7 h ago | openrouter.ai |
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.068$0.067↓ | $0.135$0.135↓ | in −0.4%out −0.4% | 7 h ago | openrouter.ai |
| DeepSeek V4 Pro 0423DeepSeek | DeepSeek API | $0.84$0.85↑ | $1.68$1.7↑ | in +1.2%out +1.2% | 7 h ago | openrouter.ai |
| Kimi K3Moonshot AI | Moonshot AI Platform | $1.54$2.3↑ | $7.7$11.55↑ | in +50%out +50% | 7 h ago | openrouter.ai |
| DeepSeek-V4-Pro-0813DeepSeek | DeepSeek API | $0.579$0.578↓ | $1.74$1.73↓ | in −0.2%out −0.2% | 7 h ago | openrouter.ai |
| Qwen3.8 27BQwen | OpenRouter | $0.42$0.214↓ | $3$2.55↓ | in −49%out −15% | 7 h ago | openrouter.ai |
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.085$0.068↓ | $0.169$0.135↓ | in −20%out −20% | 8 h ago | openrouter.ai |
| DeepSeek V4 Pro 0423DeepSeek | DeepSeek API | $0.948$0.84↓ | $1.9$1.68↓ | in −11%out −11% | 8 h ago | openrouter.ai |
| Hy3Tencent | OpenRouter | $0.083$0.132↑ | $0.33$0.528↑ | in +60%out +60% | 8 h ago | openrouter.ai |
| Kimi K3Moonshot AI | Moonshot AI Platform | $1.8$1.54↓ | $9.01$7.7↓ | in −15%out −15% | 8 h ago | openrouter.ai |
| DeepSeek V4 Flash 0423DeepSeek | DeepSeek API | $0.085$0.085↓ | $0.17$0.169↓ | in −0.3%out −0.3% | 10 h ago | openrouter.ai |
| DeepSeek V4 Pro 0423DeepSeek | DeepSeek API | $0.86$0.948↑ | $1.72$1.9↑ | in +10%out +10% | 10 h ago | openrouter.ai |
Movers are PRICE_CHANGED events emitted when a provider's published price for a model differs from the previous observation. Green = cheaper, red = dearer; % is relative to the previous published price.
Long context
New ≥ 1M-context models · 111
new_models whose context_length is at least 1 000 000 tokens
- gpt-6-astraOpenAI1.05M · 4 Sept 2026
- gpt-5.6-solOpenAI1.05M · 9 Jul 2026
- gpt-5.6-terraOpenAI1.05M · 9 Jul 2026
- gpt-5.6-lunaOpenAI1.05M · 9 Jul 2026
- gpt-5.5OpenAI1.05M · 24 Apr 2026
- gpt-5.5-proOpenAI1.05M · 24 Apr 2026
- gpt-5.4OpenAI1.05M · 5 Mar 2026
- gpt-5.4-proOpenAI1.05M · 5 Mar 2026
- gpt-4.1OpenAI1.05M · 14 Apr 2025
- gpt-4.1-miniOpenAI1.05M · 14 Apr 2025
- gpt-4.1-nanoOpenAI1.05M · 14 Apr 2025
- Claude Fable 5.1Anthropic1M · 1 Sept 2026
- Claude Opus 5Anthropic1M · 24 Jul 2026
- Claude Sonnet 5Anthropic1M · 30 Jun 2026
- Gemini 3.8 FlashGoogle1.05M · 2 Sept 2026
- Gemini 3.7 FlashGoogle1.05M · 13 Aug 2026
- Gemini 3.6 FlashGoogle1.05M · 21 Jul 2026
- Gemini 3.5 FlashGoogle1.05M · 19 May 2026
- Gemini 3.5 Flash-LiteGoogle1.05M · 21 Jul 2026
- Gemini 3.1 Flash-LiteGoogle1.05M · 7 May 2026
- Gemini 3.1 Pro PreviewGoogle1.05M · 19 Feb 2026
- Gemini 3 Flash PreviewGoogle1.05M · 17 Dec 2025
- Gemini 2.5 ProGoogle1.05M · 17 Jun 2025
- Gemini 2.5 FlashGoogle1.05M · 17 Jun 2025
- Gemini 2.5 Flash-LiteGoogle1.05M · 22 Jul 2025
- Claude Fable 5Anthropic1M · 9 Jun 2026
- Claude Opus 4.8Anthropic1M · 27 May 2026
- Claude Opus 4.7Anthropic1M · 16 Apr 2026
- Claude Opus 4.6Anthropic1M · 4 Feb 2026
- Claude Sonnet 4.6Anthropic1M · 17 Feb 2026
- Claude Sonnet 4.5Anthropic1M · 29 Sept 2025
- Claude Sonnet 4Anthropic1M · 22 May 2025
- Gemini 2.0 FlashGoogle1.05M · —
- Gemini 2.0 Flash-LiteGoogle1.05M · —
- Gemini 3.1 Flash-Lite PreviewGoogle1.05M · 3 Mar 2026
- Gemini 3 Pro PreviewGoogle1.05M · —
- Daybreak BlueOpenAI1.05M · —
- DeepSeek-V4.1-FlashDeepSeek1M · 10 Sept 2026
- DeepSeek-V4-Pro-0813DeepSeek1M · 12 Aug 2026
- Z.ai GLM 5.2Z.ai (Zhipu AI)1M · 16 Jun 2026
- Kimi K3Moonshot AI1.05M · 13 Jun 2026
- DeepSeek V4 Flash (0731)DeepSeek1.31M · 31 Jul 2026
- DeepSeek V4 Flash Vision ExpDeepSeek1.05M · 31 Aug 2026
- GLM 5.3 FlashZ.ai (Zhipu AI)1.31M · 25 Aug 2026
- GLM 5.3Z.ai (Zhipu AI)1.31M · 25 Aug 2026
- Qwen 3.7 PlusQwen1M · 3 Jun 2026
- Qwen 3.8 MaxQwen1M · —
- Fugu Ultra v2Sakana1M · 11 Sept 2026
- Fugu MaxSakana1M · 11 Sept 2026
- GPT-6 Astra ProOpenAI1.05M · 4 Sept 2026
- Qwen3.8 Max (0902)Qwen1M · 3 Sept 2026
- Muse Spark 1.3 ContributorMeta AI1.05M · 2 Sept 2026
- Muse Spark 1.3Meta AI1.05M · 2 Sept 2026
- Hy4 previewTencent1.05M · 28 Aug 2026
- Qwen3.8 FlashQwen1M · 26 Aug 2026
- Muse Spark 1.2 ContributorMeta AI1.05M · 21 Aug 2026
- Qwen3.8 27BQwen1M · 5 Aug 2026
- InklingThinking Machines1.05M · 17 Jul 2026
- Grok 4.3xAI1M · 30 Apr 2026
- MiMo-V2.5-ProXiaomi1.05M · 22 Apr 2026
- Gemini 2.5 Pro Preview 06-05Google1.05M · 5 Jun 2025
- MiniMax-M3MiniMax1.05M · 2 Jun 2026
- MiniMax-M1-40kMiniMax1M · 5 Jun 2025
- MiniMax-M1-80kMiniMax1M · 13 Jun 2025
- Kimi-Linear-48B-A3B-InstructMoonshot AI1M · 30 Oct 2025
- grok-4.20-0309-non-reasoningxAI1M · —
- gemini-2.0-flash-expGoogle1M · —
- gemini-2.0-flash-thinking-exp-01-21Google1M · —
- grok-3-mini-reasoningSpaceXAI1M · —
- deepseek-v4-flashDeepSeek1M · —
- quasar-438bMultiverse Computing1M · —
- agnes-2-5-pro-betaSapiens AI1M · —
- nova-premierAmazon Web Services1M · —
- gemini-2-0-flash-thinking-exp-1219Google2M · —
- deepseek-v4-flash-0420DeepSeek1M · —
- gemini-3-proGoogle1M · —
- gemini-2-0-pro-experimental-02-05Google2M · —
- deepseek-v4-pro-0424DeepSeek1M · —
- deepseek-v4-flash-0420-non-reasoningDeepSeek1M · —
- gemini-1-5-flash-may-2024Google1M · —
- nemotron-cascade-2-30b-a3bNVIDIA1M · —
- gemini-1-5-flash-8bGoogle1.05M · —
- agnes-2-5-pro-alphaSapiens AI1M · —
- deepseek-v4-flash-0420-highDeepSeek1M · —
- gemini-2-5-flash-preview-09-2025Google1M · —
- deepseek-v4-proDeepSeek1M · 16 Aug 2026
- solar-open2-250bUpstage1.05M · —
- gemini-2-0-flash-lite-001Google1M · —
- gemini-3-flashGoogle1M · —
- deepseek-v4-flash-visionDeepSeek1M · —
- nova-2-0-liteAmazon Web Services1M · —
- gemini-2-5-flash-lite-preview-09-2025Google1M · —
- deepseek-v4-pro-0424-non-reasoningDeepSeek1M · —
- agnes-3-0-flashSapiens AI1M · —
- gemini-2-5-flash-reasoning-04-2025Google1M · —
- gemini-2-5-pro-03-25Google1M · —
- deepseek-v4-pro-0424-highDeepSeek1M · —
- mimo-v2-proXiaomi1M · —
- gemini-2-5-flash-04-2025Google1M · —
- grok-4-1-fastSpaceXAI2M · —
Reading the pulse
Definitions
- New models 1,397
- canonical models with a NEW_MODEL event that occurred in the window (not back-filled)
- New open-weight models 700
- subset of new_models with openness open-weights / open-source
- New artifacts 174
- artifact entities (checkpoints, quantisations, conversions) first seen in the window
- New papers 1,189
- papers with a NEW_PAPER event that occurred in the window
- Provider listings 620
- PROVIDER_LISTED events in the window
- Delistings 0
- PROVIDER_DELISTED events in the window
- Price changes 20
- PRICE_CHANGED events in the window; % change = output price (else input) new vs old from the event's old/new values; median over events with both values
- New ≥ 1M-context models 111
- new_models whose context_length is at least 1 000 000 tokens
- New benchmark leaders 15
- benchmarks whose primary-group leader (computed from results observed by each date) changed over the window
- Documents changed 233
- DOCUMENT_CHANGED events in the window
- Sources observed 26
- distinct sources with at least one snapshot taken in the window
- Events total 10,288
- all non-backfill events (excluding source-document changes) that occurred in the window
Source: GET /pulse?days=30. Nothing on this page is a projection.