Skip to main content

Supported Models

This page is the model-support entry point. Use the table to find an exact Hugging Face checkpoint and TRTMC profile, then open Model Recipes to browse declared E2E recipes by task and model family.

One table, one source

The table below is rendered from website/data/model-support-matrix.md; the project README links to this page instead of carrying a second copy. The docs build resolves each row's TRTMC family from the exact matching E2E manifest profile. Hugging Face model_type, architectures, and Diffusers pipeline-class values come from the revision-pinned metadata snapshot in website/data/hf-model-metadata.json; the same snapshot renders every family recipe page.

How to read support

  • A row applies only to its exact hf_id, checkpoint resolution, TRTMC profile, and build configuration.
  • model_type identifies the Hugging Face config family. Architecture names identify the checkpoint class or, for Diffusers checkpoints, the pipeline class. They are not interchangeable with the TRTMC family ID.
  • Architecture metadata describes the source checkpoint. The supported TRTMC task/head contract is shown separately and documented on the linked family page. It may intentionally consume only the base graph, such as an encoder that returns hidden states rather than a pretraining head.
  • For a manifest without hf_revision, the metadata snapshot SHA pins only the displayed configuration fields; it does not retroactively turn that unpinned recipe into an exact-revision support claim.
  • If a retained release row and the current manifest disagree on hf_id, the table shows both values. The GB300 light remains attached to the release-row checkpoint; the current manifest value identifies today's declared CLI recipe.
  • Untested fine-tunes from the same family are best-effort compatible; they are not verified supported checkpoints.
  • Platform specialization identifies a provider integration for an exact checkpoint or tuple. It does not replace native-runtime platform support.
  • Performance color is evidence for the dated release comparison described below, not a blanket compatibility or correctness guarantee.

Release performance snapshot

This is the completed July 29, 2026 release comparison on NVIDIA GB300 at source revision 508613d0bcc7003b123cf5be3d1b3f6e6c6cb667. It covers 105 unique single-process release profiles across 76 families. Distributed and L0 smoke profiles are outside this matrix.

Each light compares TRTMC inference p50 with the row's declared reference under matching workload, output, and timing contracts:

  • 🟢 Green: TRTMC is more than 5% faster than the reference.
  • 🟡 Yellow: TRTMC is within 5% of the reference.
  • 🔴 Red: TRTMC is more than 5% slower than the reference.
  • — Not supported: the profile is explicitly unsupported on that platform.

Bundle preparation, model loading, compilation when used, and warmup are excluded from infer-p50 values. Baselines are declared per row and are not uniformly torch.compile. See the revision-matched comparison contract and benchmark documentation for reproduction and interpretation details.

TRTMC familyHF model_typeHF architecture / pipeline classTRTMC task/head contractHugging Face ID (hf_id, CLI input)Checkpoint ID (TRTMC profile)GB300 performancePrecisionQuantizationOptimized runtime dispatch
albertalbertAlbertForMaskedLM
Source: config.architectures
encoder_only_nlpalbert/albert-base-v2
Architecture metadata: config.json at 8e2f239c5f8a
albert-base🟢 GreenFP16NoneNo
bertbertBertModel
Source: config.architectures
encoder_only_nlpsentence-transformers/all-MiniLM-L6-v2
Architecture metadata: config.json at 1110a243fdf4
all-minilm-l6-v2🟢 GreenFP16NoneNo
mpnetmpnetMPNetForMaskedLM
Source: config.architectures
encoder_only_nlpsentence-transformers/all-mpnet-base-v2
Architecture metadata: config.json at e8c3b32edf54
all-mpnet-base-v2🟢 GreenFP16NoneNo
barkbarkBarkModel
Source: config.architectures
text_to_audiosuno/bark
Architecture metadata: config.json at 70a8a7d34168
bark-large🟢 GreenFP32NoneNo
barkbarkBarkModel
Source: config.architectures
text_to_audiosuno/bark-small
Architecture metadata: config.json at 1dbd7a128513
bark-small🟢 GreenFP16NoneNo
bartbartBartModel
Source: config.architectures
text_generation_causalfacebook/bart-base
Architecture metadata: config.json at aadd2ab0ae0c
bart-base🟢 GreenFP16NoneNo
bertbertBertForMaskedLM
Source: config.architectures
encoder_only_nlpgoogle-bert/bert-base-uncased
Architecture metadata: config.json at 86b5e0934494
bert-base-uncased🟢 GreenFP16NoneNo
bertbertBertModel
Source: config.architectures
encoder_only_nlpBAAI/bge-small-en-v1.5
Architecture metadata: config.json at 5c38ec7c405e
bge-small-en-v1.5🟢 GreenFP16NoneNo
bloombloomBloomForCausalLM
Source: config.architectures
text_generation_causalbigscience/bloom-560m
Architecture metadata: config.json at ac2ae5fab2ce
bloom-560m🟢 GreenFP32NoneNo
robertacamembertCamembertForMaskedLM
Source: config.architectures
encoder_only_nlpalmanach/camembert-base
Architecture metadata: config.json at a75967561c78
camembert-base🟢 GreenFP16NoneNo
canarynemo.collections.asr.models.aed_multitask_models.EncDecMultiTaskModel
Source: model_config.target
speech_to_textnvidia/canary-1b-v2
Architecture metadata: canary-1b-v2.nemo:model_config.yaml at 87bc52657add
canary-1b-v2🟢 GreenFP16NoneNo
chronos_boltt5ChronosBoltModelForForecasting
Source: config.architectures
neural_operatoramazon/chronos-bolt-tiny
Architecture metadata: config.json at a0e552de8349
chronos-bolt-tiny-official🟢 GreenFP32NoneNo
codegencodegenCodeGenForCausalLM
Source: config.architectures
text_generation_causalSalesforce/codegen-350M-mono
Architecture metadata: config.json at d9107f71cca4
codegen-350m🟢 GreenFP16NoneNo
convbertconvbertConvBertModel
Source: config.architectures
encoder_only_nlpYituTech/conv-bert-base
Architecture metadata: config.json at 5cb451936b5c
convbert-base🟢 GreenFP16NoneNo
debertadeberta
Not declared by checkpoint metadata
encoder_only_nlpmicrosoft/deberta-base
Architecture metadata: config.json at 0d1b43ccf21b
deberta-base🟢 GreenFP16NoneNo
deepseek_ocrdeepseek_vl_v2DeepseekOCR2ForCausalLM
Source: config.architectures
vision_language_generationdeepseek-ai/DeepSeek-OCR-2
Architecture metadata: config.json at aaa02f381194
deepseek-ocr🟢 GreenFP16
FP32 layers: 6, 7, 8, 9, 10, 11, 12
NoneNo
deepseek_v2deepseek_v2DeepseekV2ForCausalLM
Source: config.architectures
text_generation_causaldeepseek-ai/DeepSeek-V2-Lite
Architecture metadata: config.json at 604d5664dddd
deepseek-v2-lite🟢 GreenFP16NoneNo
deepseek_v2deepseek_v3DeepseekV3ForCausalLM
Source: config.architectures
text_generation_causalyujiepan/deepseek-v3-tiny-random
Current manifest hf_id: katuni4ka/tiny-random-deepseek-v3
Architecture metadata: config.json at cc35c93ec832
deepseek-v2-tiny🟢 GreenFP16NoneNo
distilbertdistilbertDistilBertForMaskedLM
Source: config.architectures
encoder_only_nlpdistilbert/distilbert-base-uncased
Architecture metadata: config.json at 12040accade4
distilbert-base-uncased🟢 GreenFP16NoneNo
gpt2gpt2GPT2LMHeadModel
Source: config.architectures
text_generation_causaldistilbert/distilgpt2
Architecture metadata: config.json at 2290a62682d0
distilgpt2🟢 GreenFP16NoneNo
dprdprDPRContextEncoder
Source: config.architectures
encoder_only_nlpfacebook/dpr-ctx_encoder-single-nq-base
Architecture metadata: config.json at bb21a3c2b165
dpr-ctx-encoder🟢 GreenFP16NoneNo
electraelectraElectraForPreTraining
Source: config.architectures
encoder_only_nlpgoogle/electra-base-discriminator
Architecture metadata: config.json at 1ae76a97c7e8
electra-base-discriminator🟢 GreenFP16NoneNo
falconfalconFalconForCausalLM
Source: config.architectures
text_generation_causaltiiuae/falcon-rw-1b
Architecture metadata: config.json at e4b9872bb803
falcon-rw-1b🟢 GreenFP16NoneNo
llamallamaLlamaForCausalLM
Source: config.architectures
text_generation_causaltiiuae/Falcon3-1B-Base
Architecture metadata: config.json at cb37ef3559b1
falcon3-1b🟢 GreenFP16NoneNo
fluxFlux2Pipeline
Source: model_index._class_name
diffusion_media_generationblack-forest-labs/FLUX.2-dev
Architecture metadata: model_index.json at 26afe3a78bb2
flux-2-dev🟢 GreenFP16NoneNo
fluxFlux2Pipeline
Source: model_index._class_name
diffusion_media_generationblack-forest-labs/FLUX.2-dev
Architecture metadata: model_index.json at 26afe3a78bb2
flux-2-dev-fp8🟢 GreenFP16fp8_scales=data/flux2-fp8-scales.jsonNo
fluxFluxPipeline
Source: model_index._class_name
diffusion_media_generationblack-forest-labs/FLUX.1-schnell
Architecture metadata: model_index.json at 741f7c3ce8b3
flux-schnell🟢 GreenFP16NoneNo
fnetfnetFNetForPreTraining
Source: config.architectures
encoder_only_nlpgoogle/fnet-base
Architecture metadata: config.json at d89b6fad3cf5
fnet-base🟢 GreenFP16NoneNo
gemmagemma2Gemma2ForCausalLM
Source: config.architectures
text_generation_causalgoogle/gemma-2-2b-it
Architecture metadata: config.json at 299a8560bedf
gemma-2-2b🟢 GreenFP16NoneNo
glmglmGlmForCausalLM
Source: config.architectures
text_generation_causalTHUDM/glm-4-9b-hf
Architecture metadata: config.json at b44e98fcc8df
glm-4-9b🟢 GreenFP16NoneNo
gpt_neogpt_neoGPTNeoForCausalLM
Source: config.architectures
text_generation_causalEleutherAI/gpt-neo-125m
Architecture metadata: config.json at 21def0189f57
gpt-neo-125m🟢 GreenFP16NoneNo
gpt_ossgpt_ossGptOssForCausalLM
Source: config.architectures
text_generation_causalopenai/gpt-oss-20b
Architecture metadata: config.json at 6cee5e81ee83
gpt-oss-20b🟢 GreenFP16NoneNo
gpt2gpt2GPT2LMHeadModel
Source: config.architectures
text_generation_causalopenai-community/gpt2
Architecture metadata: config.json at 607a30d783df
gpt2-125m🟢 GreenFP32NoneNo
granitegraniteGraniteForCausalLM
Source: config.architectures
text_generation_causalibm-granite/granite-3.1-2b-base
Architecture metadata: config.json at bcf4e33e7deb
granite-3.1-2b🟢 GreenFP16NoneNo
internlminternlm2InternLM2ForCausalLM
Source: config.architectures
text_generation_causalinternlm/internlm2-math-plus-1_8b
Architecture metadata: config.json at 998dd540b927
internlm2-1.8b🟢 GreenFP16NoneNo
internvlinternvlInternVLForConditionalGeneration
Source: config.architectures
vision_language_generationOpenGVLab/InternVL3-2B-hf
Architecture metadata: config.json at cb57a075cb75
internvl3-2b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
internvlinternvlInternVLForConditionalGeneration
Source: config.architectures
vision_language_generationOpenGVLab/InternVL3-8B-hf
Architecture metadata: config.json at 259a3b64a146
internvl3-8b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
lanceLance
Source: config.model_name
vision_language_generationbytedance-research/Lance
Architecture metadata: config.json at 739531575886
lance-3b-x2t-image🟢 GreenBF16NoneNo
locateanythinglocateanythingLocateAnythingForConditionalGeneration
Source: config.architectures
vision_language_generationnvidia/LocateAnything-3B
Architecture metadata: config.json at c32291ca5e99
locateanything-3b🟢 GreenFP16NoneNo
magpie_ttsdecoder_cenemo.collections.tts.models.magpietts.MagpieTTSModel
Source: model_config.target
text_to_audionvidia/magpie_tts_multilingual_357m
Revision: 34d7e40da85cabc97f92198889b65cea27bc7fd1
Architecture metadata: magpie_tts_multilingual_357m.nemo:model_config.yaml at 34d7e40da85c
magpie-tts-357m🟢 GreenFP32NoneNo
mambamambaMambaForCausalLM
Source: config.architectures
text_generation_causalstate-spaces/mamba-130m-hf
Architecture metadata: config.json at 1e76775f628f
mamba-130m🟢 GreenFP32NoneNo
marianmarianMarianMTModel
Source: config.architectures
text_generation_causalHelsinki-NLP/opus-mt-en-ru
Architecture metadata: config.json at bb09c99d1800
marian-en-ru🟢 GreenFP16NoneNo
llamallamaLlamaForCausalLM
Source: config.architectures
text_generation_causalnvidia/Llama-3.1-Minitron-4B-Depth-Base
Architecture metadata: config.json at 47f17b2c73bb
minitron-4b-depth🟢 GreenFP16NoneNo
llamallamaLlamaForCausalLM
Source: config.architectures
text_generation_causalnvidia/Llama-3.1-Minitron-4B-Width-Base
Architecture metadata: config.json at 5205ef7d3620
minitron-4b-width🟢 GreenFP32 (manifest default)NoneNo
mistralmistralMistralForCausalLM
Source: config.architectures
text_generation_causalmistralai/Mistral-7B-Instruct-v0.1
Architecture metadata: config.json at ec5deb64f2c6
mistral-7b🟢 GreenFP16NoneNo
mixtralmixtralMixtralForCausalLM
Source: config.architectures
text_generation_causalggml-org/stories15M_MOE
Architecture metadata: config.json at b6dd73749746
mixtral-stories-15m🟢 GreenFP16
FP32 layers: 4
NoneNo
modernbertmodernbertModernBertForMaskedLM
Source: config.architectures
encoder_only_nlpanswerdotai/ModernBERT-base
Architecture metadata: config.json at 8949b909ec90
modernbert-base🟢 GreenFP32NoneNo
nemotron_speech_streamingnemotron3_5_asrNemotron3_5AsrForRNNT
Source: config.architectures
speech_to_textnvidia/nemotron-3.5-asr-streaming-0.6b
Architecture metadata: config.json at 1c8deaecc64b
nemotron-3.5-asr-streaming-0.6b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
eagle_vlmllama_nemotron_vlLlamaNemotronVLModel
Source: config.architectures
embeddingnvidia/llama-nemotron-embed-vl-1b-v2
Architecture metadata: config.json at 582e3bf72aee
nemotron-embed-vl-1b-v2🟢 GreenFP16NoneNo
nemotron_hnemotron_hNemotronHForCausalLM
Source: config.architectures
text_generation_causalnvidia/NVIDIA-Nemotron-Nano-9B-v2
Architecture metadata: config.json at 6533e8de2c68
nemotron-h-nano-9b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
nemotronnemotronNemotronForCausalLM
Source: config.architectures
text_generation_causalnvidia/Nemotron-4-Mini-Hindi-4B-Base
Architecture metadata: config.json at 05c6ef6d2dda
nemotron-hindi-4b🟢 GreenFP16NoneNo
nemotron_labs_diffusionnemotron_labs_diffusionNemotronLabsDiffusionModel
Source: config.architectures
text_generation_causalnvidia/Nemotron-Labs-Diffusion-8B
Architecture metadata: config.json at 16c67f0560b9
nemotron-labs-diffusion-8b🟢 GreenBF16NoneNo
nemotronnemotronNemotronForCausalLM
Source: config.architectures
text_generation_causalnvidia/Nemotron-Mini-4B-Instruct
Architecture metadata: config.json at 791833e92ebd
nemotron-mini-4b🟢 GreenFP16NoneNo
llamallamaLlamaForCausalLM
Source: config.architectures
text_generation_causalnvidia/Llama-3.1-Nemotron-Nano-4B-v1.1
Architecture metadata: config.json at d552708a9d57
nemotron-nano-4b🟢 GreenFP16NoneNo
eagle_vlmllama_nemotron_vl_rerankLlamaNemotronVLForSequenceClassification
Source: config.architectures
rerankingnvidia/llama-nemotron-rerank-vl-1b-v2
Architecture metadata: config.json at 9c20c4aedf9e
nemotron-rerank-vl-1b-v2🟢 GreenFP16NoneNo
nemotron_speech_streamingnemotron_asr_streamingNemotronAsrStreamingForRNNT
Source: config.architectures
speech_to_textnvidia/nemotron-speech-streaming-en-0.6b
Architecture metadata: config.json at ebe59e5a8171
nemotron-speech-streaming-en-0.6b🟢 GreenFP16NoneNo
m2m_100m2m_100M2M100ForConditionalGeneration
Source: config.architectures
text_generation_causalfacebook/nllb-200-distilled-600M
Architecture metadata: config.json at f8d333a098d1
nllb-200-distilled-600m🟢 GreenFP16NoneNo
olmoolmoOlmoForCausalLM
Source: config.architectures
text_generation_causalallenai/OLMo-1B-hf
Architecture metadata: config.json at aee7752d9c08
olmo-1b🟢 GreenFP16NoneNo
olmo2olmo2Olmo2ForCausalLM
Source: config.architectures
text_generation_causalallenai/OLMo-2-0425-1B
Architecture metadata: config.json at a1847dff3500
olmo2-1b🟢 GreenFP16NoneNo
optoptOPTForCausalLM
Source: config.architectures
text_generation_causalfacebook/opt-125m
Architecture metadata: config.json at 27dcfa74d334
opt-125m🟢 GreenFP16NoneNo
bertbertBertModel
Source: config.architectures
encoder_only_nlpsentence-transformers/paraphrase-multilingual-MiniLM-L12-v2
Architecture metadata: config.json at e8f8c211226b
paraphrase-multilingual-minilm-l12-v2🟢 GreenFP16NoneNo
patchtsmixerpatchtsmixerPatchTSMixerForPrediction
Source: config.architectures
neural_operatoribm-granite/granite-timeseries-patchtsmixer
Architecture metadata: config.json at 90dc5a88d45f
patchtsmixer-granite-official🟢 GreenFP16NoneNo
patchtstpatchtstPatchTSTForRegression
Source: config.architectures
neural_operatoribm-research/patchtst-etth1-regression-distribution
Architecture metadata: config.json at d5ef731ed80f
patchtst-etth1-regression-distribution🟢 GreenFP16
FP32 layers: 5
NoneNo
patchtstpatchtstPatchTSTForPrediction
Source: config.architectures
neural_operatoribm-granite/granite-timeseries-patchtst
Architecture metadata: config.json at 7fe295d8bc8f
patchtst-granite-official🟢 GreenFP16NoneNo
personaplexpersonaplex
Not declared by checkpoint metadata
speech_to_speechnvidia/personaplex-7b-v1
Architecture metadata: config.json at fdaf4090a61c
personaplex-7b🟢 GreenFP16
FP32 layers: 0, 1
NoneNo
phi_moephimoePhiMoEForCausalLM
Source: config.architectures
text_generation_causalmicrosoft/Phi-tiny-MoE-instruct
Architecture metadata: config.json at 2fe50e88d0e2
phi-moe🟢 GreenFP16NoneNo
phiphi3Phi3ForCausalLM
Source: config.architectures
text_generation_causalmicrosoft/Phi-3-mini-4k-instruct
Architecture metadata: config.json at f39ac1d28e92
phi3-mini🟢 GreenFP16NoneNo
phi4_multimodalphi4mmPhi4MMForCausalLM
Source: config.architectures
vision_language_generationmicrosoft/Phi-4-multimodal-instruct
Architecture metadata: config.json at 93f923e1a772
phi4-multimodal🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
pixartPixArtSigmaPipeline
Source: model_index._class_name
diffusion_media_generationPixArt-alpha/PixArt-Sigma-XL-2-1024-MS
Architecture metadata: model_index.json at e102b3591cc8
pixart-sigma-1024🟢 GreenFP16
FP32 layers: 0
NoneNo
gpt_neoxgpt_neoxGPTNeoXForCausalLM
Source: config.architectures
text_generation_causalEleutherAI/pythia-70m
Architecture metadata: config.json at a39f36b100fe
pythia-70m🟢 GreenFP32NoneNo
qwen_imageQwenImagePipeline
Source: model_index._class_name
diffusion_media_generationQwen/Qwen-Image
Architecture metadata: model_index.json at 75e0b4be04f6
qwen-image🟢 GreenBF16NoneNo
qwen_imageQwenImagePipeline
Source: model_index._class_name
diffusion_media_generationQwen/Qwen-Image-2512
Architecture metadata: model_index.json at 25468b98e327
qwen-image-2512🟢 GreenBF16NoneNo
qwen_imageQwenImageEditPlusPipeline
Source: model_index._class_name
diffusion_media_generationQwen/Qwen-Image-Edit-2511
Architecture metadata: model_index.json at 6f3ccc0b56e4
qwen-image-edit-2511🟢 GreenBF16NoneNo
qwen_vlqwen2_5_vlQwen2_5_VLForConditionalGeneration
Source: config.architectures
vision_language_generationQwen/Qwen2.5-VL-3B-Instruct
Architecture metadata: config.json at 66285546d2b8
qwen25vl-3b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
qwenqwen3Qwen3ForCausalLM
Source: config.architectures
text_generation_causalQwen/Qwen3-0.6B
Architecture metadata: config.json at c1899de289a0
qwen3-0.6b-fp16🟢 GreenFP16NoneYes
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Linux x86_64, NVIDIA A100 80GB PCIe (SM80), FP16
Additional dispatch targets: Coming soon
qwenqwen3Qwen3ForCausalLM
Source: config.architectures
text_generation_causalQwen/Qwen3-0.6B
Architecture metadata: config.json at c1899de289a0
qwen3-0.6b-fp8🟢 GreenBF16format=fp8
scale_source=modelopt
calibration_samples=64
Yes
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Linux x86_64, NVIDIA A100 80GB PCIe (SM80), FP16
Additional dispatch targets: Coming soon
qwenqwen3Qwen3ForCausalLM
Source: config.architectures
text_generation_causalQwen/Qwen3-0.6B
Architecture metadata: config.json at c1899de289a0
qwen3-0.6b-topp🟢 GreenFP16NoneYes
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Linux x86_64, NVIDIA A100 80GB PCIe (SM80), FP16
Additional dispatch targets: Coming soon
qwenqwen3Qwen3ForCausalLM
Source: config.architectures
text_generation_causalQwen/Qwen3-4B-Instruct-2507
Architecture metadata: config.json at cdbee75f17c0
qwen3-4b-instruct-2507🟢 GreenFP16NoneYes
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Linux x86_64, NVIDIA A100 80GB PCIe (SM80), FP16
Additional dispatch targets: Coming soon
qwen_moeqwen3_moeQwen3MoeForCausalLM
Source: config.architectures
text_generation_causalQwen/Qwen3-30B-A3B
Architecture metadata: config.json at ad44e777bcd1
qwen3-moe-30b-a3b🟢 GreenFP16NoneNo
qwen_moeqwen3_moeQwen3MoeForCausalLM
Source: config.architectures
text_generation_causalamd-quark/tiny-random-qwen3_moe
Architecture metadata: config.json at ca2aaa9a82e9
qwen3-moe-tiny-random🟢 GreenFP16NoneNo
qwen3_omniqwen3_omni_moeQwen3OmniMoeForConditionalGeneration
Source: config.architectures
omni_multimodalQwen/Qwen3-Omni-30B-A3B-Instruct
Architecture metadata: config.json at 26291f793822
qwen3-omni-30b-a3b-instruct🔴 RedBF16NoneNo
qwen_vlqwen3_vlQwen3VLForConditionalGeneration
Source: config.architectures
vision_language_generationQwen/Qwen3-VL-2B-Instruct
Architecture metadata: config.json at 89644892e4d8
qwen3-vl-2b🟢 GreenFP16
FP32 layers: 0, 1, 2
NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
qwen3_5qwen3_5Qwen3_5ForConditionalGeneration
Source: config.architectures
text_generation_causalQwen/Qwen3.5-9B
Architecture metadata: config.json at c20223623576
qwen35-9b🟢 GreenFP16NoneComing soon
TensorRT Edge-LLM
Qualified TRTMC dispatch target: Coming soon
mistralmistralMistralForCausalLM
Source: config.architectures
text_generation_causalnvidia/Riva-Translate-4B-Instruct-v1.1
Architecture metadata: config.json at 1eb944ce9f27
riva-translate-4b🟢 GreenFP16NoneNo
robertarobertaRobertaForMaskedLM
Source: config.architectures
encoder_only_nlpFacebookAI/roberta-base
Architecture metadata: config.json at e2da8e2f811d
roberta-base🟢 GreenFP16NoneNo
robertarobertaRobertaForMaskedLM
Source: config.architectures
encoder_only_nlpFacebookAI/roberta-large
Architecture metadata: config.json at 722cf37b1afa
roberta-large🟢 GreenFP16NoneNo
rwkvrwkvRwkvForCausalLM
Source: config.architectures
text_generation_causalRWKV/rwkv-4-169m-pile
Architecture metadata: config.json at 46bdc280eb97
rwkv-169m🟢 GreenFP32NoneNo
samsamSamModel
Source: config.architectures
prompted_segmentationfacebook/sam-vit-base
Architecture metadata: config.json at 70c1a07f894e
sam-vit-base🟢 GreenFP16NoneNo
sam3sam3_videoSam3VideoModel
Source: config.architectures
prompted_segmentationfacebook/sam3
Architecture metadata: config.json at 3c879f39826c
sam3🟢 GreenFP32NoneNo
sana_wmSanaMSVideoCamCtrl_1600M_P1_D20
Source: config.model.model
diffusion_media_generationEfficient-Large-Model/SANA-WM_bidirectional
Architecture metadata: config.yaml at e96271d77398
sana-wm-bidirectional🟡 YellowBF16NoneNo
segformersegformerSegformerForSemanticSegmentation
Source: config.architectures
segmentationnvidia/segformer-b0-finetuned-ade-512-512
Architecture metadata: config.json at 489d5cd81a0b
segformer-b0-ade🟢 GreenFP16NoneNo
stablelmstablelmStableLmForCausalLM
Source: config.architectures
text_generation_causalstabilityai/stablelm-2-1_6b
Architecture metadata: config.json at f499ead74c53
stablelm2-1.6b🟢 GreenFP16NoneNo
starcoder2starcoder2Starcoder2ForCausalLM
Source: config.architectures
text_generation_causalbigcode/starcoder2-3b
Architecture metadata: config.json at 733247c55e3f
starcoder2-3b🟢 GreenFP16NoneNo
t5t5T5ForConditionalGeneration
Source: config.architectures
text_generation_causalgoogle-t5/t5-small
Architecture metadata: config.json at df1b051c4962
t5-small🟢 GreenFP16NoneNo
timesfmtimesfmTimesFmModelForPrediction
Source: config.architectures
neural_operatorgoogle/timesfm-2.0-500m-pytorch
Architecture metadata: config.json at dc2443792ce5
timesfm-2.0-500m-official🟢 GreenFP32NoneNo
timm_vitvit_base_patch16_224
Source: config.architecture
image_classificationtimm/vit_base_patch16_224.augreg_in21k_ft_in1k
Architecture metadata: config.json at 2ec9fb3d7bb6
timm-vit-base-p16-224-augreg-in21k-ft-in1k🟢 GreenFP16NoneNo
llamallamaLlamaForCausalLM
Source: config.architectures
text_generation_causalTinyLlama/TinyLlama-1.1B-Chat-v1.0
Architecture metadata: config.json at fe8a4ea1ffed
tinyllama-1.1b🟢 GreenFP16NoneNo
wan_t2vWanPipeline
Source: model_index._class_name
diffusion_media_generationWan-AI/Wan2.1-T2V-1.3B-Diffusers
Architecture metadata: model_index.json at 0fad780a534b
wan21-t2v-1.3b🟢 GreenFP16
FP32 layers: 24
NoneNo
wan2_2_ti2vti2vWanModel
Source: config._class_name
diffusion_media_generationWan-AI/Wan2.2-TI2V-5B
Revision: 921dbaf3f1674a56f47e83fb80a34bac8a8f203e
Architecture metadata: config.json at 921dbaf3f167
wan22-ti2v-5b🟢 GreenBF16NoneNo
whisperwhisperWhisperForConditionalGeneration
Source: config.architectures
speech_to_textopenai/whisper-large-v3-turbo
Architecture metadata: config.json at 41f01f3fe87f
whisper-large-v3-turbo🟢 GreenFP32NoneNo
whisperwhisperWhisperForConditionalGeneration
Source: config.architectures
speech_to_textopenai/whisper-tiny
Architecture metadata: config.json at 169d4a4341b3
whisper-tiny-fp16🟢 GreenFP16
FP32 layers: 0
NoneNo
xglmxglmXGLMForCausalLM
Source: config.architectures
text_generation_causalfacebook/xglm-564M
Architecture metadata: config.json at f3059f01b98c
xglm-564m🟢 GreenFP16NoneNo
robertaxlm-robertaXLMRobertaForMaskedLM
Source: config.architectures
encoder_only_nlpFacebookAI/xlm-roberta-base
Architecture metadata: config.json at e73636d4f797
xlm-roberta-base🟢 GreenFP16NoneNo
xlnetxlnetXLNetLMHeadModel
Source: config.architectures
encoder_only_nlpxlnet/xlnet-base-cased
Architecture metadata: config.json at ceaa69c7bc5e
xlnet-base🟢 GreenFP16NoneNo
z_imageZImagePipeline
Source: model_index._class_name
diffusion_media_generationTongyi-MAI/Z-Image-Turbo
Architecture metadata: model_index.json at f332072aa78b
z-image-turbo🔴 RedFP16
FP32 layers: 2, 3, 4, 7, 8
NoneNo

Declared recipes beyond the release snapshot

The support table is a retained release snapshot. The current checkout may contain additional E2E manifests, L0 replacements, and distributed variants. Those declarations are available through Model Recipes, organized as Hugging Face task → model family → exact manifest recipe.

Platform specializations will roll out in phases aligned with model coverage available in TensorRT Edge-LLM and TensorRT-Model-Connect releases. Each batch must document the exact qualified model, target, precision, and configuration tuple.