TensorRT-LLM
NVIDIAgithub.com/NVIDIA/TensorRT-LLM
TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs. TensorRT LLM also contains components to create Python and C++ runtimes that orchestrate
Updated 40 min ago · first seen 11 Sept 2026
framework_01M294ES1YRZVZWYQP5W3K09DW
- Version
- 1.3.0rc26
- T2 · 45 min ago
- Released
- 9 Sept 2026
- T2 · 45 min ago
- Stars
- 14,597
- T2 · 40 min ago
Specification
- Repository
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Created at
- 16 Aug 2023
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Default branch
- main
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Homepage
- https://nvidia.github.io/TensorRT-LLM
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Kind
- runtime
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Latest release
- 9 Sept 2026
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Latest release tag
- v1.3.0rc26
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Latest version
- 1.3.0rc26
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- License name
- Other
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Forks
- 2,736
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 40 min agomedium
- Releases
- 89
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 40 min agomedium
- Stars
- 14,597
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 40 min agomedium
- Tags
- 99
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 40 min agomedium
- Watchers
- 122
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 40 min agomedium
- PyPI
- tensorrt-llm
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Readme url
- https://raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Releases url
- https://github.com/NVIDIA/TensorRT-LLM/releases
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
- Topics
- blackwell, cuda, llm-serving, moe, pytorch
Source:GitHub public repositories (HTML, releases.atom, raw files)T2observed 45 min agomedium
Each value shows its source, tier and observation time. Conflicting claims are kept side by side and flagged — never averaged. How AI Atlas records facts →
Provenance
Attributed facts
19
Source tiers
T219
Freshest observation
40 min ago
Conflicts
None
- Developed by
- NVIDIA
As of
Rewind the record: see this entity's attributes exactly as AI Atlas knew them on a given day.
Claim history · Readme url
Readme urlreadme_url1
| Value | Valid from → to | Status | Source | Confidence | Extractor |
|---|---|---|---|---|---|
| https://raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md | → current | current | GitHub public repositories (HTML, releases.atom, raw files)T2 | medium | deterministic |
Claims are temporal and append-only: a new observation closes the previous claim (valid_to) instead of overwriting it. Conflicting claims from different sources are kept side by side and flagged — never averaged. Methodology →
NVIDIA/TensorRT-LLM released v1.3.0rc22.post1: [None][chore] Bump version to 1.3.0rc22.post1
githubNVIDIA/TensorRT-LLM released v1.3.0rc23.post1: [None][ci] Recover necessary CI stages for release (#17895)
github
| Source | Document | Type | Tier | Last observed | Snapshots |
|---|---|---|---|---|---|
| GitHub public repositories (HTML, releases.atom, raw files) | github.com/NVIDIA/TensorRT-LLM/releases.atom | feed | T2· Quality secondary | 40 min ago | 1 |
| GitHub public repositories (HTML, releases.atom, raw files) | raw.githubusercontent.com/NVIDIA/TensorRT-LLM/HEAD/README.md | readme | T2· Quality secondary | 40 min ago | 1 |
| GitHub public repositories (HTML, releases.atom, raw files) | github.com/NVIDIA/TensorRT-LLM | repository | T2· Quality secondary | 40 min ago | 2 |
Tier 1 = official/primary, 2 = quality secondary, 3 = community, 4 = unverified. Every snapshot is archived; see all sources and the methodology.