Skip to content
AI Atlas
FrameworkActive

vllm

vLLM projectgithub.com/vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

Updated 16 min ago · first seen 11 Sept 2026

framework_01M294DFR8P2NSKPPJYY02VWKA

Version
0.29.0
T2 · 21 min ago
Released
10 Sept 2026
T2 · 21 min ago
License
Apache-2.0
T2 · 21 min ago
Stars
91,519
T2 · 16 min ago

Specification

License
Apache-2.0

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Created at
9 Feb 2023

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Default branch
main

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Homepage
https://vllm.ai

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Kind
runtime

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Latest release
10 Sept 2026

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Latest release tag
v0.29.0

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Latest version
0.29.0

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

License name
Apache License 2.0

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Forks
22,074

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 16 min agomedium

Releases
105

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 16 min agomedium

Stars
91,519

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 16 min agomedium

Tags
191

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 16 min agomedium

Watchers
598

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 16 min agomedium

PyPI
vllm

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Readme url
https://raw.githubusercontent.com/vllm-project/vllm/HEAD/README.md

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Releases url
https://github.com/vllm-project/vllm/releases

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Topics
amd, blackwell, cuda, deepseek, deepseek-v3, gpt, gpt-oss, inference, kimi, llama, llm, llm-serving, model-serving, moe, openai, pytorch, qwen, qwen3, tpu, transformer

Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 21 min agomedium

Each value shows its source, tier and observation time. Conflicting claims are kept side by side and flagged — never averaged. How AI Atlas records facts →

Provenance

Attributed facts

20

Source tiers

T220

Freshest observation

16 min ago

Conflicts

None