TensorRT-LLM
NVIDIAgithub.com/NVIDIA/TensorRT-LLM
TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs. TensorRT LLM also contains components to create Python and C++ runtimes that orchestrate
Updated 15 min ago · first seen 11 Sept 2026
framework_01M294ES1YRZVZWYQP5W3K09DW
- Version
- 1.3.0rc26
- T2 · 20 min ago
- Released
- 9 Sept 2026
- T2 · 20 min ago
- Stars
- 14,597
- T2 · 15 min ago
Specification
- Repository
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Created at
- 16 Aug 2023
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Default branch
- main
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Homepage
- https://nvidia.github.io/TensorRT-LLM
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Kind
- runtime
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Latest release
- 9 Sept 2026
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Latest release tag
- v1.3.0rc26
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Latest version
- 1.3.0rc26
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- License name
- Other
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Forks
- 2,736
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 15 min agomedium
- Releases
- 89
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 15 min agomedium
- Stars
- 14,597
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 15 min agomedium
- Tags
- 99
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 15 min agomedium
- Watchers
- 122
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 15 min agomedium
- PyPI
- tensorrt-llm
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Readme url
- https://raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Releases url
- https://github.com/NVIDIA/TensorRT-LLM/releases
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
- Topics
- blackwell, cuda, llm-serving, moe, pytorch
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 20 min agomedium
Each value shows its source, tier and observation time. Conflicting claims are kept side by side and flagged — never averaged. How AI Atlas records facts →
Provenance
Attributed facts
19
Source tiers
T219
Freshest observation
15 min ago
Conflicts
None
- Developed by
- NVIDIA
As of
Rewind the record: see this entity's attributes exactly as AI Atlas knew them on a given day.
Claim history
Repositoryrepository_url1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| https://github.com/NVIDIA/TensorRT-LLM | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Created atcreated_at1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 16 Aug 2023 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Default branchdefault_branch1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| main | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Descriptiondescription1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs. TensorRT LLM also contains components to create Python and C++ runtimes that orchestrate the inference execution in a performant way. | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Homepagehomepage1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| https://nvidia.github.io/TensorRT-LLM | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Kindkind1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| runtime | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Latest releaselatest_release_at1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 9 Sept 2026 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Latest release taglatest_release_tag1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| v1.3.0rc26 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Latest versionlatest_version1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 1.3.0rc26 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
License namelicense_name1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| Other | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Forksmetric.forks1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 2,736 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Releasesmetric.releases1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 89 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Starsmetric.stars1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 14,597 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Watchersmetric.watchers1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| 122 | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
PyPIpypi1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| tensorrt-llm | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Readme urlreadme_url1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| https://raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Releases urlreleases_url1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| https://github.com/NVIDIA/TensorRT-LLM/releases | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Topicstopics1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| blackwell, cuda, llm-serving, moe, pytorch | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Claims are temporal and append-only: a new observation closes the previous claim (valid_to) instead of overwriting it. Conflicting claims from different sources are kept side by side and flagged — never averaged. Methodology →
NVIDIA/TensorRT-LLM released v1.3.0rc22.post1: [None][chore] Bump version to 1.3.0rc22.post1
githubNVIDIA/TensorRT-LLM released v1.3.0rc23.post1: [None][ci] Recover necessary CI stages for release (#17895)
github
| Source | Document | Type | Tier | Last observed | Snapshots |
|---|---|---|---|---|---|
| GitHub public repositories (HTML, releases.atom, raw files) | github.com/NVIDIA/TensorRT-LLM/releases.atom | feed | T2· Quality secondary | 15 min ago | 1 |
| GitHub public repositories (HTML, releases.atom, raw files) | raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md | readme | T2· Quality secondary | 15 min ago | 1 |
| GitHub public repositories (HTML, releases.atom, raw files) | github.com/NVIDIA/TensorRT-LLM | repository | T2· Quality secondary | 15 min ago | 2 |
Tier 1 = official/primary, 2 = quality secondary, 3 = community, 4 = unverified. Every snapshot is archived; see all sources and the methodology.