Model Optimizer
Getting Started
Overview
Installation
Quick Start: PTQ - PyTorch
Quick Start: PTQ - ONNX
Quick Start: PTQ - PyTorch to ONNX
Quick Start: PTQ - Windows
Quick Start: QAT
Quick Start: Pruning
Quick Start: Distillation
Quick Start: Speculative Decoding
Quick Start: Sparsity
Guides
Support Matrix
Recipes
ModelOpt Config System
Quantization
Saving & Restoring
Pruning
Distillation
Speculative Decoding
Sparsity
NAS
AutoCast (ONNX)
Autotune (ONNX)
Deployment
TensorRT-LLM
Onnxruntime
Unified HuggingFace Checkpoint
Examples
All GitHub Examples
Reference
Changelog
modelopt API
Support
Contact us
FAQs
Model Optimizer
Index
Index
_
|
A
|
B
|
C
|
D
|
E
|
F
|
G
|
H
|
I
|
J
|
K
|
L
|
M
|
N
|
O
|
P
|
Q
|
R
|
S
|
T
|
U
|
V
|
W
|
X
|
Y
|
Z
_
__init__() (AcceptanceRateValidation method)
(AccumulatingTimer method)
(ArchitectureCandidate method)
(ArtifactChoice method)
(AsyncEvaluationClient method)
(AttemptSpec method)
(AttentionConfig method)
,
[1]
(AttnRemovalSpec method)
(AxisCapabilities method)
(AxisSearchConfig method)
(BaseCalibrateModeDescriptor method)
(BaseDataclass method)
(BaseQuantizedTensor method)
(BaseSearcher method)
(BiasCalibrator method)
(BlockConfig method)
(BlockTarget method)
(BoundValue method)
(CalibrationDataProvider method)
(Campaign method)
(CampaignController method)
(CampaignModel method)
(CampaignPlan method)
(CampaignStageIdentity method)
(Candidate method)
(CandidateLedger method)
(CandidateLibrary method)
(CandidateRevision method)
(CandidateSet method)
(ChildRegionInputInsertionPoint method)
(ChildRegionOutputInsertionPoint method)
(ChunkedCrossEntropy method)
(CombinedRegionSearch method)
(CommandSpec method)
(CompiledPostMIPNode method)
(ComposedScoreRecord method)
(ComposedScoreTable method)
(ConcatNodeProcessor method)
(ConcatSymbol method)
(ConcatSymbol.Input method)
(Config method)
(ConstantLengthDataset method)
(ConvConfig method)
(CoverageReport method)
(CoverageRow method)
(CrossModelCampaign method)
(DecoderLayerConfig method)
(DecoderLayout method)
(DepthOfReductionRule method)
(DepthSelection method)
(DescriptorResolution method)
(DisabledNodeNameRegexRule method)
(DisabledOpTypes method)
(Discriminator method)
(Discriminator_ImageDiT method)
(DistillationLossBalancer method)
(DistillationPipeline method)
(DistributedProcessGroup method)
(DMDPipeline method)
(DummyBlock method)
(DummyLMHead method)
(DummyModule method)
(DummyWTE method)
(DynamicModule method)
(DynamicSpace method)
(DynamicThresholdCalibrator method)
(EagleOfflineDataCollator method)
(ElasticSizeSampler method)
(EmbeddingConfig method)
(EmbeddingPruningSpec method)
(EmptyInitOnDevice method)
(enable_modelopt_patches method)
(EvaluationCache method)
(EvaluationCacheSlot method)
(EvaluationClient method)
,
[1]
(EvaluationMetadataCache method)
(EvaluationRequest method)
(EvaluationResult method)
(EvaluationService method)
(ExpertConfig method)
(ExpertRemovalLayerDescriptor method)
(ExpertRemovalPruningMixIn method)
(ExponentialMovingAverage method)
(ExportCapabilities method)
(FFNConfig method)
(FFNIntermediateLayerDescriptor method)
(FFNIntermediatePruningMixIn method)
(FFNRemovalSpec method)
(GatedDeltaNetLayerDescriptor method)
(GatedDeltaNetPruningMixIn method)
(GatedDenseFFNContract method)
(GDNPermutation method)
(GDNShape method)
(GenericDecoderContract method)
(GlobalKDConfig method)
(GlobalKDResult method)
(GptOssExpertRemovalLayerDescriptor method)
(GptOssKVHeadsLayerDescriptor method)
(GPUMemoryMonitor method)
(GraphCollection method)
(GraphSanitizer method)
(HistogramCalibrator method)
(HomogeneousPolicy method)
(Hparam method)
(Identity method)
(IndependentChannelContributionHook method)
(IndependentKvHeadContributionHook method)
(InitializerConsumerTracker method)
(InitializerRangeRule method)
(InputIndexTracker method)
(InsertionScheme method)
(IORangeRule method)
(IterativeChannelContributionHook method)
(JobHandle method)
(JobStatus method)
(KDLossTermConfig method)
(KVHeadsLayerDescriptor method)
(KVHeadsPruningMixIn method)
(L2NormHook method)
(LatentAttentionContract method)
(LatentMoETensorLayout method)
(LatentMoETransform method)
(LayerLayout method)
(LayernormConfig method)
(LayerNormContributionHook method)
(LinearActConfig method)
(LinearConfig method)
(Llama4AttentionConfig method)
(LlamaFFNIntermediateLayerDescriptor method)
(LlamaKVHeadsLayerDescriptor method)
(LLM method)
(LmmsEvalTimeoutError method)
(LogitsDistillationLoss method)
(LossMaskRecovery method)
(LowMemorySparseTensor method)
(MagnitudeFallbackSpec method)
(Mamba2TensorLayout method)
(MambaConfig method)
(MambaLayerDescriptor method)
(MambaPruningMixIn method)
(MaxCalibrator method)
(MedusaHeadConfig method)
(MFTLoss method)
(MGDLoss method)
(MIPProfile method)
(MistralFFNIntermediateLayerDescriptor method)
(MistralKVHeadsLayerDescriptor method)
(MLAConfig method)
(MLPConfig method)
(ModelConfig method)
(ModelLoader method)
(ModeloptStateManager method)
(MOEConfig method)
(MoEConfig method)
(MoELayerDescriptor method)
(MoEPruningMixIn method)
(MseCalibrator method)
(MTPContract method)
(NemotronHExpertRemovalLayerDescriptor method)
(NemotronHFFNIntermediateLayerDescriptor method)
(NemotronHKVHeadsLayerDescriptor method)
(NemotronHMambaLayerDescriptor method)
(NemotronHMoELayerDescriptor method)
(NemotronHV2ExpertRemovalLayerDescriptor method)
(NemotronHV2FFNIntermediateLayerDescriptor method)
(NemotronHV2KVHeadsLayerDescriptor method)
(NemotronTarPlusJsonlIterable method)
(NFSWorkspace method)
(no_modelopt_patches method)
(NodeCapabilities method)
(NodeClassifier method)
(NodeInputInsertionPoint method)
(NodeObservation method)
(NVFP4MSECalibrator method)
(ObjectiveSpec method)
(OfflineSupervisedDataset method)
(OutputSaveHook method)
(PackedMinitronImportance method)
(PackedSequenceMetadata method)
(PackedTokenMemmapDataset method)
(PackingSpec method)
(ParallelCapabilities method)
(ParallelMesh method)
(ParallelMeshOverride method)
(ParallelState method)
(ParallelTopology method)
(PatchManager method)
(PatternCache method)
(PatternSchemes method)
(PLEContract method)
(PLEPruningSpec method)
(PrecisionConverter method)
(ProfileConstraint method)
(PrunableAxis method)
(PruningMixIn method)
(PuzzletronBatch method)
(PuzzletronCapabilities method)
(PuzzletronDataSpec method)
(QDQConvTranspose method)
(QDQCustomOp method)
(QDQNormalization method)
(QKVConfig method)
(QuantRecipe method)
(QuantRecipeHparam method)
(Qwen2FFNIntermediateLayerDescriptor method)
(Qwen3FFNIntermediateLayerDescriptor method)
(Qwen3KVHeadsLayerDescriptor method)
(Qwen3P5KVHeadsPruningMixIn method)
(Qwen3P5TextFFNIntermediateLayerDescriptor method)
(Qwen3P5TextGatedDeltaNetLayerDescriptor method)
(Qwen3P5TextKVHeadsLayerDescriptor method)
(Qwen3P5VLFFNIntermediateLayerDescriptor method)
(Qwen3P5VLGatedDeltaNetLayerDescriptor method)
(Qwen3P5VLKVHeadsLayerDescriptor method)
(Qwen3VLExpertRemovalLayerDescriptor method)
(Qwen3VLFFNIntermediateLayerDescriptor method)
(Qwen3VLKVHeadsLayerDescriptor method)
(RandomDataProvider method)
(RankedChoiceVotingHook method)
(RecurrentConfig method)
(ReferenceRunner method)
(Region method)
(RegionPattern method)
(RelativeAttentionTableConfig method)
(RemovableCandidateHandle method)
(RemoveExpertsIndependentHook method)
(ReplacementLibrary method)
(ResBlock method)
(ResolvedInsertionPoint method)
(RgLruConfig method)
(RNNLayerForward method)
(RobustTracer method)
(RoutedMoEContract method)
(RulerDatasetBuilder method)
(RunnerEnvironment method)
(RuntimeConfig method)
(RuntimeMeasurement method)
(RuntimeTopology method)
(ScenarioKey method)
(ScoringParent method)
(SearchSpace method)
,
[1]
(SequentialQuantizer method)
(set_modelopt_patches_enabled method)
(SharedQuantState method)
(SharedWeightGlobalAmaxState method)
(SolverOptions method)
(SparseAttentionMethod method)
(SparseAttentionStatsManager method)
(SparseSampleManifest method)
(SparseSampleRecord method)
(SparseSamplingPolicy method)
(StageCapabilities method)
(StageExecutionSpec method)
(StageManifest method)
(StageResult method)
(StageSpec method)
(StageTerminalState method)
(StandardGQAAttentionContract method)
(StaticLossBalancer method)
(StoreWithExplicitFlag method)
(SubblockCapabilities method)
(SubblockConfig method)
(SubblockRef method)
(Symbol method)
(SymDepth method)
(SymInfo method)
(SymMap method)
(TaskTopology method)
(TensorAxisRule method)
(TensorQuantizer method)
(TensorQuantizerCache method)
(TensorRTPyBenchmark method)
(TensorStats method)
(TerminalControls method)
(TextAcquisitionSpec method)
(Timer method)
(TrainingFlashKLD method)
(Tree method)
(TreeNode method)
(TrtExecBenchmark method)
(VariantAxis method)
(VFRNNForward method)
(VisionLanguageContract method)
(VllmMeasurement method)
(VlmAcquisitionSpec method)
(WorkItem method)
(WorkPlan method)
(WrapperModelForCausalLM method)
__new__() (ArtifactKind method)
(AttemptStatus method)
(DataLayout method)
(DatasetKind method)
(ErrorKind method)
(ExecutionStrategy method)
(FailureClass method)
(FailurePolicy method)
(HaltPolicy method)
(LayerNormPositionType method)
(LayerNormType method)
(MLPType method)
(Modality method)
(ModelKind method)
(NodeKind method)
(PrecisionTypes static method)
(QTensorWrapper static method)
(ShutdownAction method)
(StageSkipReason method)
(StageStatus method)
(TaskLauncher method)
(WorkerState method)
_lora_adapters (LoRAModule attribute)
A
a_log_key (Mamba2TensorLayout attribute)
absmax (TensorStats attribute)
AcceptanceRateValidation (class in modelopt.torch.speculative.utils)
accepts (NodeCapabilities attribute)
accumulate() (ForwardHook method)
(IndependentChannelContributionHook method)
(IndependentKvHeadContributionHook method)
(IterativeChannelContributionHook method)
(L2NormHook method)
(LayerNormContributionHook method)
(RankedChoiceVotingHook method)
(RemoveExpertsIndependentHook method)
AccumulatingTimer (class in modelopt.torch.utils.perf)
action_for_choice() (TerminalControls static method)
activation (StageCapabilities attribute)
activation_checkpointing (GlobalKDConfig attribute)
activation_diagnostic_stage() (in module modelopt.torch.puzzletron.stages)
activation_samples (CrossModelCampaign attribute)
activation_scaling_factor (LinearConfig attribute)
(QKVConfig property)
activation_stage() (in module modelopt.torch.puzzletron.stages)
active (ConcatTracedHp property)
(Hparam property)
(QuantRecipeHparam property)
active_slice (ConcatTracedHp property)
(Hparam property)
ActiveSlice (Hparam attribute)
adapt_loaded_state_dict_for_model() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
adapt_materialized_state_dict_for_model() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
adapt_module_name_for_model() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
adapt_runtime_hydra_config() (in module modelopt.torch.puzzletron.pipeline_config)
adapter_cfg (PEFTConfig attribute)
adapter_name (PEFTConfig attribute)
adapter_names (LoRAModule property)
adapter_type (PEFTConfig attribute)
AdaptiveAvgPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
AdaptiveAvgPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
AdaptiveAvgPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
add_child() (Region method)
add_cross_kv_to_encoder() (in module modelopt.onnx.graph_surgery)
add_mode() (ModeloptStateManager method)
add_noise() (in module modelopt.torch.fastgen.flow_matching)
add_pattern_from_region() (PatternCache method)
add_pattern_schemes() (PatternCache method)
add_revision() (CandidateLedger method)
add_sym_info() (SymMap method)
additional_exempt_patterns (GenericDecoderContract attribute)
additional_tensor_rules (GenericDecoderContract attribute)
adjust_attn_amax_values() (in module modelopt.torch.export.quant_utils)
after_search() (BaseSearcher method)
(IterativeSearcher method)
(SparseGPTSearcher method)
after_step() (BinarySearcher method)
(EvolveSearcher method)
(IterativeSearcher method)
aggregate_post_mip_node() (in module modelopt.torch.puzzletron.post_mip.runner)
aggregate_query_scores_to_kv() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
aggregate_required (WorkPlan attribute)
aiperf (StageCapabilities attribute)
aiperf_stage() (in module modelopt.torch.puzzletron.stages)
AIPerfNode (class in modelopt.torch.puzzletron.post_mip.builtin)
algorithm (QuantizeConfig attribute)
alibi_bias_max (DecoderLayerConfig attribute)
alignment (EmbeddingPruningSpec attribute)
all_input_quantizers_disabled (QuantRNNBase property)
all_items_same() (in module modelopt.torch.export.quant_utils)
allocation_gpus (AttemptSpec attribute)
allocation_nodes (AttemptSpec attribute)
allow_real_quant_gemm (RealQuantLinear attribute)
allows_completion() (StageTerminalState method)
alpha (SmoothQuantCalibConfig attribute)
alpha_step (AWQLiteCalibConfig attribute)
amax (TensorQuantizer property)
amaxs (MaxCalibrator property)
analyze_symbols() (in module modelopt.torch.trace.analyzer)
anymodel_arch_info() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(NemotronHV2ModelDescriptor class method)
(Qwen3P5MoeTextModelDescriptor class method)
(Qwen3P5VLModelDescriptor class method)
anymodel_arch_info_required (ExportCapabilities attribute)
APPLICATION (FailureClass attribute)
apply_column_major_transformation() (in module modelopt.onnx.quantization.qdq_utils)
apply_filter() (in module modelopt.torch.puzzletron.post_mip.filters)
apply_latent_moe_sort() (in module modelopt.torch.puzzletron.pruning.latent_moe_surgery)
apply_latent_moe_transform() (in module modelopt.torch.puzzletron.pruning.latent_moe_surgery)
apply_mode() (in module modelopt.torch.opt.conversion)
apply_prune_hooks() (in module modelopt.torch.puzzletron.pruning.dynamic_block_prune)
apply_residual_connection_post_layernorm (DecoderLayerConfig attribute)
apply_runtime_candidate() (in module modelopt.torch.puzzletron.pruning.runtime_candidate)
apply_sparsity() (SparseAttentionMethod method)
apply_vllm_measurement() (in module modelopt.torch.puzzletron.subblock_stats.measurements)
architecture (ModelConfig attribute)
architecture_id (ArchitectureCandidate attribute)
(BenchmarkResult attribute)
(CandidateRevision attribute)
ArchitectureCandidate (class in modelopt.torch.puzzletron.post_mip.records)
argv (CommandSpec attribute)
artifact (ArtifactChoice attribute)
(CandidateRevision attribute)
artifact_choices (StageSpec attribute)
artifact_kind (CandidateRevision attribute)
ArtifactChoice (class in modelopt.torch.puzzletron.stages)
ArtifactImportError
ArtifactKind (class in modelopt.torch.puzzletron.post_mip.records)
artifacts (EvaluationResult attribute)
,
[1]
(NodeObservation attribute)
as_completed() (AsyncEvaluationClient method)
as_dict() (DepthSelection method)
(ParallelMesh method)
assert_compatibility_as_next_mode_of() (ModeDescriptor method)
AsyncEvaluationClient (class in modelopt.torch.puzzletron.distributed_eval)
atomic_print() (in module modelopt.torch.utils.logging)
attach() (SharedQuantState class method)
attempt_id (AttemptRecord attribute)
(AttemptSpec attribute)
(JobHandle attribute)
AttemptSpec (class in modelopt.torch.puzzletron.orchestration)
AttemptStatus (class in modelopt.torch.puzzletron.distributed_eval)
attention (DecoderLayerConfig attribute)
(GenericDecoderContract attribute)
attention_chunk_size (Llama4AttentionConfig attribute)
attention_dropout (Llama4AttentionConfig attribute)
attention_head_size (DecoderLayerConfig attribute)
attention_keep_mask() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
attention_layernorm (DecoderLayerConfig attribute)
attention_permutations() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
attention_permutations_from_scores() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
AttentionConfig (class in modelopt.torch.export.model_config)
(class in modelopt.torch.puzzletron.block_config)
attn_implementation (GlobalKDConfig attribute)
attn_logit_softcapping (DecoderLayerConfig attribute)
attn_no_op_post_init() (AutoModelDescriptor static method)
(GenericContractModelDescriptor static method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
attn_no_op_supported() (ModelDescriptor class method)
attn_prefix() (KVHeadsLayerDescriptor method)
attn_prefix_name (GptOssKVHeadsLayerDescriptor attribute)
(KVHeadsLayerDescriptor attribute)
(LlamaKVHeadsLayerDescriptor attribute)
(MistralKVHeadsLayerDescriptor attribute)
(NemotronHKVHeadsLayerDescriptor attribute)
(NemotronHV2KVHeadsLayerDescriptor attribute)
(Qwen3KVHeadsLayerDescriptor attribute)
(Qwen3P5TextKVHeadsLayerDescriptor attribute)
(Qwen3P5VLKVHeadsLayerDescriptor attribute)
(Qwen3VLKVHeadsLayerDescriptor attribute)
attn_replacing_linear (DecoderLayerConfig attribute)
attn_scale (Llama4AttentionConfig attribute)
attn_temperature_tuning (Llama4AttentionConfig attribute)
AttnRemovalSpec (class in modelopt.torch.puzzletron.pruning.dynamic_block_prune)
attrs (Hparam property)
(QuantRecipeHparam property)
audit_state_dict() (EmbeddingPruningSpec method)
auto_quantize() (in module modelopt.torch.quantization.model_quant)
automodel_model_kwargs() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
automodel_patcher() (in module modelopt.torch.puzzletron.anymodel.automodel)
automodel_recipe (CampaignManifest attribute)
automodel_tp_linear_backend() (ModelDescriptor class method)
AutoModelDescriptor (class in modelopt.torch.puzzletron.anymodel.automodel)
AutoModelDescriptorFactory (class in modelopt.torch.puzzletron.anymodel.automodel)
AutoNASModeDescriptor (class in modelopt.torch.nas.autonas)
AutoNASPatchManager (class in modelopt.torch.nas.autonas)
AutoQuantizeGradientSearcher (class in modelopt.torch.quantization.algorithms)
AutoQuantizeKLDivSearcher (class in modelopt.torch.quantization.algorithms)
AutoQuantizeSearcher (in module modelopt.torch.quantization.algorithms)
AutotunerError
AutotunerNotInitializedError
AvgPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
AvgPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
AvgPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
awq() (in module modelopt.torch.quantization.model_calib)
awq_block_size (LinearConfig attribute)
(QKVConfig property)
axes (PuzzletronCapabilities attribute)
(SearchSpace attribute)
(TensorAxisRule attribute)
axes_default (MIPProfile attribute)
axis (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
axis_id (AxisCapabilities attribute)
(AxisSearchConfig attribute)
(PrunableAxis attribute)
(VariantAxis attribute)
axis_options (MIPProfile attribute)
AxisCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
AxisSearchConfig (class in modelopt.torch.puzzletron.search_space)
B
backend (JobHandle attribute)
(QuantizerAttributeConfig attribute)
(SolverOptions attribute)
(SparseAttentionAttributeConfig attribute)
backend() (in module modelopt.torch.utils.distributed)
backend_extra_args (QuantizerAttributeConfig attribute)
backward() (ClipFunction static method)
(DynamicBlockQuantizationFunction static method)
(FakeTensorQuantFunction static method)
(FastHadamardTransform static method)
(ScaledE4M3Function static method)
(StaticBlockwiseFP4FakeQuantFunction static method)
backward_simulation (DMDConfig attribute)
baremetal (RunnerEnvironment attribute)
barrier() (in module modelopt.torch.utils.distributed)
base_profile_id (MIPProfile property)
BaseCalibrateModeDescriptor (class in modelopt.torch.quantization.mode)
BaseDataclass (class in modelopt.torch.puzzletron.block_config)
Baseline Latency
BaseQuantizedTensor (class in modelopt.torch.quantization.qtensor.base_qtensor)
BaseSearcher (class in modelopt.torch.opt.searcher)
BaseSparseSearcher (class in modelopt.torch.sparsity.weight_sparsity.searcher)
batch() (EvaluationClient method)
,
[1]
(EvaluationService method)
batch_from_automodel() (in module modelopt.torch.puzzletron.dataset)
batch_size (EMAConfig attribute)
(PuzzletronBatch property)
(RuntimeConfig attribute)
(VllmMeasurement attribute)
bc (SparseAttentionAttributeConfig attribute)
before_search() (BaseSearcher method)
(BinarySearcher method)
(EvolveSearcher method)
(IterativeSearcher method)
(SparseGPTSearcher method)
before_step() (BinarySearcher method)
(EvolveSearcher method)
(IterativeSearcher method)
bench_fn() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm)
best (IterativeSearcher attribute)
best_history (IterativeSearcher attribute)
best_scheme (PatternSchemes property)
bfloat16_to_float32() (in module modelopt.onnx.utils)
bias (ConvConfig attribute)
(LayernormConfig attribute)
(LinearConfig attribute)
(QKVConfig property)
(QuantizerAttributeConfig attribute)
(TensorQuantizer property)
bias_axis (TensorQuantizer property)
bias_calibrator (TensorQuantizer property)
bias_key (Mamba2TensorLayout property)
bias_method (TensorQuantizer property)
bias_type (TensorQuantizer property)
bias_value (TensorQuantizer property)
BiasCalibrator (class in modelopt.torch.quantization.calib.bias)
bigger_is_better (ObjectiveSpec property)
BinarySearcher (class in modelopt.torch.prune.fastnas)
block_config (Candidate attribute)
(ComposedScoreRecord attribute)
(DecoderLayerConfig attribute)
(SparseSampleRecord attribute)
block_config_identity() (in module modelopt.torch.puzzletron.identity)
block_config_to_config_overrides() (AutoModelDescriptor static method)
(ContractAutoModelDescriptor class method)
block_config_to_layer_overrides() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor class method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
block_config_to_str() (in module modelopt.torch.puzzletron.utils.misc)
block_configs (ArchitectureCandidate attribute)
block_embedding (ModelConfig attribute)
block_idx_from_module_name() (LayerDescriptor method)
block_size (GPTQCalibConfig attribute)
(LocalHessianCalibConfig attribute)
BLOCK_SIZE (MXFP8QTensor attribute)
block_size (RotateConfig attribute)
block_size_3d (VSAAttributeConfig attribute)
block_sizes (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
block_targets_from_replacements() (in module modelopt.torch.puzzletron.pruning.materialize)
BlockConfig (class in modelopt.torch.puzzletron.block_config)
blocksparse_block_size (DecoderLayerConfig attribute)
blocksparse_homo_head_pattern (DecoderLayerConfig attribute)
blocksparse_num_local_blocks (DecoderLayerConfig attribute)
blocksparse_vertical_stride (DecoderLayerConfig attribute)
BlockTarget (class in modelopt.torch.puzzletron.pruning.materialize)
boot_id (WorkerRecord attribute)
bos_token_id (ModelConfig attribute)
BoundValue (class in modelopt.torch.puzzletron.mip.profiles)
br (SparseAttentionAttributeConfig attribute)
budget_grid (AxisSearchConfig attribute)
build_attention_config() (in module modelopt.torch.export.layer_utils)
build_automodel_global_kd_recipe() (in module modelopt.torch.puzzletron.distillation.global_automodel)
build_block_prune_specs() (in module modelopt.torch.puzzletron.pruning.dynamic_block_prune)
build_calibration_dataset() (RulerDatasetBuilder method)
build_candidate_library() (in module modelopt.torch.puzzletron.candidates)
build_candidate_library_from_checkpoint() (in module modelopt.torch.puzzletron.candidates)
build_conv_config() (in module modelopt.torch.export.layer_utils)
build_decoder_config() (in module modelopt.torch.export.layer_utils)
build_distribution_loss() (in module modelopt.torch.puzzletron.distillation.loss)
build_embedding_config() (in module modelopt.torch.export.layer_utils)
build_fused_linear_config() (in module modelopt.torch.export.layer_utils)
build_global_kd_config() (in module modelopt.torch.puzzletron.distillation.global_automodel)
build_grid_budget_entries() (in module modelopt.torch.puzzletron.mip.grid_budgeting)
build_layer_layouts() (in module modelopt.torch.puzzletron.pruning.sorted_teacher)
build_layernorm_config() (in module modelopt.torch.export.layer_utils)
build_layerwise_quant_metadata() (in module modelopt.torch.export.diffusers_utils)
build_library_stage() (in module modelopt.torch.puzzletron.stages)
build_linear_config() (in module modelopt.torch.export.layer_utils)
build_medusa_heads_config() (in module modelopt.torch.export.layer_utils)
build_mlp_config() (in module modelopt.torch.export.layer_utils)
build_moe_config() (in module modelopt.torch.export.layer_utils)
build_non_residual_input_map() (in module modelopt.onnx.quantization.graph_utils)
build_post_mip_report_payloads() (in module modelopt.torch.puzzletron.post_mip.reporting)
build_profile_solution_registry() (in module modelopt.torch.puzzletron.solution_registry)
build_qkv() (in module modelopt.torch.export.layer_utils)
build_recurrent_config() (in module modelopt.torch.export.layer_utils)
build_replacement_library_from_sorted_teacher() (in module modelopt.torch.puzzletron.replacement_library.build_replacement_library)
build_sequential_pipeline_module_fqns() (ModelDescriptor class method)
build_sorted_teacher() (in module modelopt.torch.puzzletron.pruning.sorted_teacher)
build_stacked_experts() (in module modelopt.torch.export.layer_utils)
build_subblock_replacement_payload() (in module modelopt.torch.puzzletron.replacement_library.subblock_scoring)
build_subblock_replacement_solutions() (in module modelopt.torch.puzzletron.replacement_library.subblock_scoring)
BUSY (WorkerState attribute)
bypass (StageCapabilities attribute)
(SubblockCapabilities attribute)
bypass_diagnostic_stage() (in module modelopt.torch.puzzletron.stages)
bypass_enabled (CoverageReport attribute)
bypass_manifest_fingerprint (ScoringParent attribute)
bypass_manifest_path (ScoringParent attribute)
bypass_overfit_stage() (in module modelopt.torch.puzzletron.stages)
bypass_stage() (in module modelopt.torch.puzzletron.stages)
C
cache_dir (CalibrationConfig attribute)
cache_id (EvaluationCacheSlot attribute)
cache_identity (BenchmarkResult attribute)
cache_key() (in module modelopt.torch.puzzletron.identity)
calc_runtime_for_blocks() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats)
calc_runtime_for_subblocks() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats)
calc_subblock_active_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_additive_metrics() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_batch_outputs() (in module modelopt.torch.puzzletron.utils.validation)
calculate_batch_outputs_flash_kd() (in module modelopt.torch.puzzletron.utils.validation)
calculate_ffn_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_kv_dim() (in module modelopt.torch.puzzletron.utils.misc)
calculate_losses() (in module modelopt.torch.puzzletron.utils.validation)
calculate_mamba_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_mamba_state_size() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_non_block_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_non_block_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_sparsity() (SparseAttentionMethod method)
calculate_subblock_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_subblock_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory)
calculate_subblock_stats() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats)
calib (ExportConfig attribute)
calibrate() (DynamicThresholdCalibrator method)
(in module modelopt.torch.quantization.model_quant)
(in module modelopt.torch.sparsity.attention_sparsity.model_sparsify)
calibrate_frequent_vocab() (in module modelopt.torch.speculative.utils)
calibrate_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.calibration)
calibrate_weights() (in module modelopt.torch.quantization.calib.histogram)
CalibrationDataProvider (class in modelopt.onnx.quantization.calib_utils)
calibrator (QuantizerAttributeConfig attribute)
call_post_eval() (PatchManager method)
Campaign (class in modelopt.torch.puzzletron.distributed_eval)
campaign_fingerprint (CampaignStageIdentity attribute)
campaign_id (Campaign property)
(CampaignManifest property)
(EvaluationHandle attribute)
(EvaluationRequest attribute)
(EvaluationResult attribute)
(WorkerRecord attribute)
CampaignController (class in modelopt.torch.puzzletron.orchestration)
CampaignModel (class in modelopt.torch.puzzletron.campaigns)
CampaignPlan (class in modelopt.torch.puzzletron.orchestration)
CampaignStageIdentity (class in modelopt.torch.puzzletron.campaigns)
CANCEL (ShutdownAction attribute)
cancel() (AsyncEvaluationClient method)
(EvaluationClient method)
CANCELLED (AttemptStatus attribute)
(ErrorKind attribute)
(FailureClass attribute)
Candidate (class in modelopt.torch.puzzletron.candidates)
CANDIDATE (ErrorKind attribute)
candidate (IterativeSearcher attribute)
candidate_id (SparseSampleRecord attribute)
candidate_identity() (in module modelopt.torch.puzzletron.identity)
candidate_metadata() (CandidateLedger method)
candidate_slope() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
CandidateLedger (class in modelopt.torch.puzzletron.post_mip.records)
CandidateLibrary (class in modelopt.torch.puzzletron.candidates)
CandidateRevision (class in modelopt.torch.puzzletron.post_mip.records)
candidates (CandidateLibrary attribute)
(EvolveSearcher attribute)
CandidateSet (class in modelopt.torch.puzzletron.post_mip.records)
canonical_json() (in module modelopt.torch.puzzletron.identity)
canonical_receipt_identity() (in module modelopt.torch.puzzletron.artifact_import_contract)
canonical_score_key() (GatedDeltaNetLayerDescriptor method)
(MambaLayerDescriptor method)
(MoELayerDescriptor method)
canonical_solution_id() (in module modelopt.torch.puzzletron.solution_registry)
canonical_stage_name() (in module modelopt.torch.puzzletron.pipeline_config)
canonicalize() (in module modelopt.torch.puzzletron.identity)
capabilities (AIPerfNode attribute)
(CompiledPostMIPNode attribute)
(DescriptorResolution attribute)
(DownstreamEvaluationNode attribute)
(EvaluationNode attribute)
(FilterNode attribute)
(GlobalKDNode attribute)
(ManualFilterNode attribute)
(MaterializeNode attribute)
(PostMIPNode attribute)
(PTQNode attribute)
(WorkerRecord attribute)
capabilities() (GenericDecoderContract method)
capability_snapshot (StageManifest attribute)
CapabilityValidationError
capture_io() (in module modelopt.torch.utils.logging)
cast_custom_ops() (in module modelopt.onnx.quantization.graph_utils)
cast_initializer_to_dtype() (in module modelopt.onnx.quantization.qdq_utils)
ce_mask (PuzzletronBatch attribute)
ce_weight (GlobalKDConfig attribute)
centroid() (in module modelopt.torch.utils.random)
cfg (QuantizerCfgEntry attribute)
change_casts_to_fp16() (in module modelopt.onnx.utils)
changed_axes (SparseSampleRecord attribute)
chatglm_version (DecoderLayerConfig attribute)
check() (NodeRuleBase method)
check_data_consistency_across_ranks() (AcceptanceRateValidation method)
check_draft() (AcceptanceRateValidation method)
check_mode() (ModeloptStateManager method)
check_model() (in module modelopt.onnx.utils)
check_model_compatibility() (in module modelopt.torch.export.layer_utils)
check_model_uses_external_data() (in module modelopt.onnx.utils)
check_weight_shape_valid() (in module modelopt.torch.export.postprocess)
CHECKPOINT (ArtifactKind attribute)
checkpoint_dir (BenchmarkResult attribute)
checkpoint_equivalence_tolerances() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
checkpoint_every_steps (GlobalKDConfig attribute)
checkpoint_format (GlobalKDConfig attribute)
checkpoint_key_candidates_for_model_key() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
checkpoint_key_rewrites (GenericDecoderContract attribute)
child_region_inputs (InsertionScheme attribute)
ChildRegionInputInsertionPoint (class in modelopt.onnx.quantization.autotune)
ChildRegionOutputInsertionPoint (class in modelopt.onnx.quantization.autotune)
choice() (in module modelopt.torch.utils.random)
choices (Hparam property)
choose_revisions() (TerminalControls method)
choose_shutdown() (TerminalControls method)
chunk_size (CalibrationConfig attribute)
(KDLossTermConfig attribute)
chunked_axes (TensorAxisRule attribute)
ChunkedCrossEntropy (class in modelopt.torch.puzzletron.distillation.loss)
cl_type (Symbol property)
CLASS_MAPPING (ConverterFactory attribute)
(ModelDescriptorFactory attribute)
classifier_free_guidance() (in module modelopt.torch.fastgen.utils)
classify_partially_quantized_weighted_ops() (in module modelopt.onnx.quantization.graph_utils)
classify_partition_nodes() (in module modelopt.onnx.quantization.graph_utils)
cleanup_model() (GraphSanitizer method)
clear_cuda_cache() (in module modelopt.torch.utils.perf)
clear_inputs() (in module modelopt.onnx.llm_export_utils.surgeon_utils)
clear_outputs() (in module modelopt.onnx.llm_export_utils.surgeon_utils)
clear_stale_value_info() (in module modelopt.onnx.utils)
clip_qkv (AttentionConfig attribute)
(DecoderLayerConfig attribute)
ClipFunction (class in modelopt.torch.quantization.nn.functional)
clone() (set_modelopt_patches_enabled method)
clone_hydra_config() (in module modelopt.torch.puzzletron.tools.hydra_utils)
close() (AsyncEvaluationClient method)
(EvaluationClient method)
collate_puzzletron_llm_batch() (in module modelopt.torch.puzzletron.distillation.dataset)
collect() (BiasCalibrator method)
(HistogramCalibrator method)
(MaxCalibrator method)
(MseCalibrator method)
(NVFP4MSECalibrator method)
(SparseAttentionStatsManager method)
(TensorQuantizer method)
collect_from_region() (ChildRegionInputInsertionPoint static method)
(ChildRegionOutputInsertionPoint static method)
(NodeInputInsertionPoint static method)
collect_stats (SparseAttentionAttributeConfig attribute)
(VSAAttributeConfig attribute)
CombinedRegionSearch (class in modelopt.onnx.quantization.autotune)
command (AttemptSpec attribute)
(BenchmarkResult attribute)
CommandSpec (class in modelopt.torch.puzzletron.orchestration)
common_fields (ManualFilterNode attribute)
(PostMIPNode attribute)
compact_gated_delta_net_forward() (in module modelopt.torch.puzzletron.pruning.compact_runtime)
compact_grouped_attention_forward() (in module modelopt.torch.puzzletron.pruning.compact_runtime)
compare() (CoverageRow class method)
compare_dict() (in module modelopt.torch.utils.network)
compare_multi_layer() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
compile_campaign_plan() (in module modelopt.torch.puzzletron.orchestration)
compile_post_mip_flows() (in module modelopt.torch.puzzletron.post_mip.base)
compile_profile_constraints() (in module modelopt.torch.puzzletron.mip.profiles)
CompiledPostMIPNode (class in modelopt.torch.puzzletron.post_mip.base)
complete (CoverageReport property)
complete() (StageManifest method)
completed_at (BenchmarkResult attribute)
(EvaluationResult attribute)
completion_artifacts (StageSpec attribute)
compose_full_block_metrics() (in module modelopt.torch.puzzletron.replacement_library.score_composition)
composed_table_to_gathered_metrics() (in module modelopt.torch.puzzletron.replacement_library.score_composition)
ComposedScoreRecord (class in modelopt.torch.puzzletron.replacement_library.score_composition)
ComposedScoreTable (class in modelopt.torch.puzzletron.replacement_library.score_composition)
COMPOSITE (RegionType attribute)
compress (CompressConfig attribute)
compress() (in module modelopt.torch.quantization)
compress_weights() (FP8QuantExporter static method)
(INT4QuantExporter static method)
(INT8QuantExporter static method)
(MXFP8QuantExporter static method)
(NVFP4QuantExporter static method)
(ONNXQuantExporter static method)
compute (LossMaskRecovery attribute)
compute_amax() (HistogramCalibrator method)
(MaxCalibrator method)
(MseCalibrator method)
(NVFP4MSECalibrator method)
compute_bias() (BiasCalibrator method)
compute_cosine_similarity() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
compute_discriminator_loss() (DMDPipeline method)
compute_dynamic_bias() (BiasCalibrator method)
compute_e8m0() (in module modelopt.onnx.quantization.quant_utils)
compute_fake_score_loss() (DMDPipeline method)
compute_fp4_scales() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel)
compute_kd_loss() (DistillationModel method)
compute_latent_moe_transform() (in module modelopt.torch.puzzletron.pruning.latent_moe_surgery)
compute_layer_metrics() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
compute_quantization_mse() (in module modelopt.torch.quantization.model_quant)
compute_rmse() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
compute_scales() (FP8QuantExporter static method)
(INT4QuantExporter static method)
(INT8QuantExporter static method)
(MXFP8QuantExporter static method)
(NVFP4QuantExporter static method)
(ONNXQuantExporter static method)
compute_student_loss() (DMDPipeline method)
compute_valid_1d_patterns() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
concat_sym (ConcatSymbol.Input property)
ConcatExpertsIntoDenseFFN (MlpInitMode attribute)
ConcatNodeProcessor (class in modelopt.torch.trace.modules.concat)
ConcatSymbol (class in modelopt.torch.trace.modules.concat)
ConcatSymbol.Input (class in modelopt.torch.trace.modules.concat)
ConcatTracedHp (class in modelopt.torch.nas.hparams.concat)
concurrency (BenchmarkResult attribute)
conditional_parents (StageSpec attribute)
confidence (DescriptorResolution attribute)
CONFIG (ArtifactKind attribute)
config (BaseSearcher attribute)
Config (class in modelopt.onnx.quantization.autotune)
config (CompiledPostMIPNode attribute)
(DMDPipeline attribute)
CONFIG (FailureClass attribute)
config (StageManifest attribute)
(SubblockRef attribute)
config() (DynamicSpace method)
config_class (AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(DFlashModeDescriptor property)
(EagleModeDescriptor property)
(ExportNASModeDescriptor property)
(ExportPEFTModeDescriptor property)
(ExportSparseModeDescriptor property)
(ExportStudentModeDescriptor property)
(FastNASModeDescriptor property)
(KnowledgeDistillationModeDescriptor property)
(LayerwiseKDModeDescriptor property)
(MedusaModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseGPTModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
(SubblockCapabilities attribute)
config_identity (StageManifest property)
config_identity() (in module modelopt.torch.puzzletron.identity)
config_paths (EmbeddingPruningSpec attribute)
configure_anymodel_metadata() (in module modelopt.torch.puzzletron.utils.vllm_adapter)
configure_linear_module_onnx_quantizers() (in module modelopt.torch.quantization.export_onnx)
configure_logging() (in module modelopt.onnx.autocast.logging_config)
(in module modelopt.onnx.logging_config)
configure_ort() (in module modelopt.onnx.quantization.ort_utils)
configured_parent_stage_ids() (in module modelopt.torch.puzzletron.stages)
configured_stage_ids() (in module modelopt.torch.puzzletron.stages)
CONFLICT (AttemptStatus attribute)
consecutive_ngrams() (in module modelopt.torch.puzzletron.mip.utils)
ConstantLengthDataset (class in modelopt.torch.puzzletron.utils.data.dataset)
constraint_weights (HomogeneousPolicy attribute)
constraints (AxisCapabilities attribute)
(BaseSearcher attribute)
(MIPProfile attribute)
constraints_func (IterativeSearcher attribute)
construct_forward_loop() (BaseSearcher method)
constructor_intermediate_size() (GatedDenseFFNContract method)
contains_node() (Region method)
contains_node_within_region_and_descendants() (Region method)
CONTINUE (ShutdownAction attribute)
contract (RunnerEnvironment attribute)
contract_hash (AttemptSpec attribute)
(CampaignPlan attribute)
ContractAutoModelDescriptor (class in modelopt.torch.puzzletron.anymodel.automodel)
conv1 (ModelConfig attribute)
Conv1d (in module modelopt.torch.quantization.nn.modules.quant_conv)
conv1d (RecurrentConfig attribute)
conv2 (ModelConfig attribute)
Conv2d (in module modelopt.torch.quantization.nn.modules.quant_conv)
Conv3d (in module modelopt.torch.quantization.nn.modules.quant_conv)
conv3d_implicit_gemm_cuda() (in module modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda)
conv_bias_key (Mamba2TensorLayout attribute)
conv_kernel_size (MambaConfig attribute)
conv_size (Mamba2TensorLayout property)
conv_weight_key (Mamba2TensorLayout attribute)
ConvConfig (class in modelopt.torch.export.model_config)
convert (AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(DFlashModeDescriptor property)
(EagleModeDescriptor property)
(ExportNASModeDescriptor property)
(ExportPEFTModeDescriptor property)
(ExportSparseModeDescriptor property)
(ExportStudentModeDescriptor property)
(FastNASModeDescriptor property)
(KnowledgeDistillationModeDescriptor property)
(LayerwiseKDModeDescriptor property)
(MedusaModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
(StageCapabilities attribute)
convert() (ConcatSymbol.Input static method)
(Converter class method)
(DynamicModule class method)
(GenericDecoderConverter class method)
(in module modelopt.torch.distill.distillation)
(in module modelopt.torch.nas.conversion)
(in module modelopt.torch.speculative.speculative_decoding)
(PrecisionConverter method)
(QuantModule class method)
convert_autonas_searchspace() (in module modelopt.torch.nas.autonas)
convert_block_configs_to_per_layer_config() (in module modelopt.torch.puzzletron.utils.vllm_adapter)
convert_configs_in_dirs() (Converter class method)
convert_fastnas_searchspace() (in module modelopt.torch.prune.fastnas)
convert_fp16_io() (in module modelopt.onnx.quantization.graph_utils)
convert_fp16_to_bf16() (in module modelopt.onnx.graph_surgery)
convert_fp64_to_fp32() (GraphSanitizer method)
convert_hf_quant_config_format() (in module modelopt.torch.export.convert_hf_config)
convert_model() (in module modelopt.torch.puzzletron.anymodel.converter.convert_any_model)
convert_opset() (GraphSanitizer method)
convert_quantization_axis_to_reduce_axis() (in module modelopt.torch.quantization.utils)
convert_searchspace() (in module modelopt.torch.nas.autonas)
convert_sparse_model() (in module modelopt.torch.sparsity.weight_sparsity.mode)
convert_stage() (in module modelopt.torch.puzzletron.stages)
convert_to_dflash_model() (in module modelopt.torch.speculative.dflash.conversion)
convert_to_dynamic() (DynamicSpace method)
convert_to_eagle_model() (in module modelopt.torch.speculative.eagle.conversion)
convert_to_f16() (in module modelopt.onnx.autocast.convert)
convert_to_medusa_model() (in module modelopt.torch.speculative.medusa.conversion)
convert_to_mixed_precision() (in module modelopt.onnx.autocast.convert)
convert_to_single_quantizer() (SequentialQuantizer static method)
convert_to_sparse_attention_model() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
convert_to_tensorrt_llm_config() (in module modelopt.torch.export.tensorrt_llm_utils)
convert_to_transformer_engine() (in module modelopt.torch.export.transformer_engine)
Converter (class in modelopt.torch.puzzletron.anymodel.converter.base)
ConverterFactory (class in modelopt.torch.puzzletron.anymodel.converter.converter_factory)
ConvTranspose1d (in module modelopt.torch.quantization.nn.modules.quant_conv)
ConvTranspose2d (in module modelopt.torch.quantization.nn.modules.quant_conv)
ConvTranspose3d (in module modelopt.torch.quantization.nn.modules.quant_conv)
coordinator_lease() (Campaign method)
copy_checkpoint_files() (Converter static method)
copy_to() (ExponentialMovingAverage method)
copy_tokenizer() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
CopyAsIs (GQAInitMode attribute)
(HiddenSizeInitMode attribute)
(MlpInitMode attribute)
cosine_embedding_loss() (in module modelopt.torch.puzzletron.utils.validation)
cosine_embedding_loss_batched() (in module modelopt.torch.puzzletron.tools.kd_model)
cost_identity (Candidate attribute)
counts (DepthSelection attribute)
(EvaluationResult attribute)
CoverageReport (class in modelopt.torch.puzzletron.artifact_coverage)
CoverageRow (class in modelopt.torch.puzzletron.artifact_coverage)
cp (GlobalKDConfig attribute)
(ParallelCapabilities attribute)
(ParallelMesh attribute)
(ParallelMeshOverride attribute)
(ParallelTopology attribute)
cp_partition() (PuzzletronBatch method)
cp_rank (PackedSequenceMetadata attribute)
cp_size (PackedSequenceMetadata attribute)
(ParallelismSpec attribute)
create() (Campaign class method)
(CampaignStageIdentity class method)
(CandidateSet class method)
create_asp_mask() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
create_attention_mask() (Tree method)
create_benchmark_model() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats)
create_block_configs() (GenericDecoderConverter static method)
create_block_configs_from_main_config() (Converter static method)
(GenericDecoderConverter static method)
(GptOssConverter static method)
(LlamaConverter static method)
(MistralSmallConverter static method)
(NemotronHConverter static method)
(NemotronHV2Converter static method)
(Qwen2Converter static method)
(Qwen3Converter static method)
(Qwen3P5Converter static method)
(Qwen3VLConverter static method)
create_child_state_dict() (in module modelopt.torch.puzzletron.tools.bypassed_training.child_init)
create_dummy_block() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(NemotronHV2ModelDescriptor class method)
(Qwen2ModelDescriptor class method)
(Qwen3ModelDescriptor class method)
create_fake_score() (in module modelopt.torch.fastgen.factory)
create_forward_loop() (in module modelopt.torch.utils.dataset_utils)
create_inference_session() (in module modelopt.onnx.quantization.ort_utils)
create_linked_copy() (ConcatSymbol.Input method)
create_model_config() (ReplacementLibrary method)
create_padded_tensor() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
create_param_grad_clear_hook() (in module modelopt.torch.utils.network)
create_runtime_benchmark_model() (GptOssModelDescriptor class method)
(LlamaModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(Qwen3P5TextModelDescriptor class method)
create_sgpt_mask() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt)
create_sharded_model() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils)
create_train_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
create_tree() (Tree method)
create_validation_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
criterion (KDLossConfig attribute)
cross_attention (DecoderLayerConfig attribute)
cross_attention_layernorm (DecoderLayerConfig attribute)
cross_attention_layers (DecoderLayerConfig attribute)
CrossModelCampaign (class in modelopt.torch.puzzletron.campaigns)
cuopt_available() (in module modelopt.torch.puzzletron.mip.solver_backend)
current_request_id (WorkerRecord attribute)
customize_rule() (ModeloptBaseRule class method)
cwd (CommandSpec attribute)
D
d_key (Mamba2TensorLayout attribute)
data (CampaignManifest attribute)
(EvaluationRequest attribute)
(GlobalKDConfig attribute)
data_dir (CalibrationConfig attribute)
data_identity (DepthScenario attribute)
data_layout (CrossModelCampaign attribute)
data_parallel_size (RuntimeTopology attribute)
DataLayout (class in modelopt.torch.puzzletron.dataset)
dataset (CampaignModel attribute)
dataset_name (GlobalKDConfig attribute)
dataset_split (GlobalKDConfig attribute)
DatasetKind (class in modelopt.torch.puzzletron.campaigns)
debug (AWQClipCalibConfig attribute)
(AWQFullCalibConfig attribute)
(AWQLiteCalibConfig attribute)
(LocalHessianCalibConfig attribute)
decay (EMAConfig attribute)
deci_x_patcher() (in module modelopt.torch.puzzletron.anymodel.puzzformer.patcher)
decode_context_parallel_size (RuntimeTopology attribute)
decode_ms (RuntimeMeasurement property)
decode_ms_per_token() (RuntimeMeasurement method)
DECODER_LAYER_CLS (GenericContractModelDescriptor attribute)
decoder_layer_cls() (AutoModelDescriptor static method)
(GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
decoder_start_token_id (ModelConfig attribute)
decoder_type (DecoderLayerConfig attribute)
DecoderLayerConfig (class in modelopt.torch.export.model_config)
DecoderLayout (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
default_capabilities() (in module modelopt.torch.puzzletron.anymodel.capabilities)
default_cross_model_campaign() (in module modelopt.torch.puzzletron.campaigns)
default_dq_dtype (Config attribute)
default_enabled (StageSpec attribute)
default_patterns (SharedQuantState attribute)
(SharedWeightGlobalAmaxState attribute)
default_q_scale (Config attribute)
default_q_zero_point (Config attribute)
default_quant_desc_input (QuantInputBase attribute)
(QuantRNNBase attribute)
default_quant_desc_output (QuantInputBase attribute)
default_quant_desc_weight (QuantConv1d attribute)
(QuantConv2d attribute)
(QuantConv3d attribute)
(QuantConvTranspose1d attribute)
(QuantConvTranspose2d attribute)
(QuantConvTranspose3d attribute)
(QuantLinear attribute)
(QuantLinearConvBase attribute)
(QuantRNNBase attribute)
default_quant_type (Config attribute)
default_search_config (AutoQuantizeGradientSearcher property)
(AutoQuantizeKLDivSearcher property)
(BaseSearcher property)
(BaseSparseSearcher property)
(EvolveSearcher property)
(IterativeSearcher property)
(SparseGPTSearcher property)
default_state_dict (BaseSearcher property)
(BaseSparseSearcher property)
(BinarySearcher property)
(EvolveSearcher property)
(IterativeSearcher property)
default_strategy (NodeCapabilities attribute)
defaults (RunnerEnvironment attribute)
Degrouping (GQAInitMode attribute)
dense (AttentionConfig attribute)
DENSE (ModelKind attribute)
dense_attention_every_n_layers (DecoderLayerConfig attribute)
dense_ffn (GenericDecoderContract attribute)
dense_recent_tokens (SparseAttentionAttributeConfig attribute)
dense_sink_tokens (SparseAttentionAttributeConfig attribute)
dependency_stage_ids (CompiledPostMIPNode attribute)
deployment (BaseSearcher attribute)
DeprecatedError
depth_selections (MIPProfile attribute)
depth_stage() (in module modelopt.torch.puzzletron.stages)
DepthHparam (class in modelopt.torch.nas.hparams.container)
DepthOfReductionRule (class in modelopt.onnx.autocast.nodeclassifier)
depths (MIPProfile attribute)
DepthSelection (class in modelopt.torch.puzzletron.mip.profiles)
dequantize() (BaseQuantizedTensor method)
(FP8QTensor method)
(INT4QTensor method)
(INT8QTensor method)
(MXFP4QTensor method)
(MXFP8QTensor method)
(NF4QTensor method)
(NVFP4QTensor method)
(TensorQuantizer method)
description (TensorAxisRule attribute)
(VllmMeasurement attribute)
descriptor (CampaignManifest attribute)
(DescriptorResolution attribute)
(GlobalKDConfig attribute)
(RuntimeConfig attribute)
descriptor_name (GenericDecoderContract attribute)
(PuzzletronCapabilities attribute)
descriptor_version (PuzzletronCapabilities attribute)
DescriptorResolution (class in modelopt.torch.puzzletron.anymodel.registry)
DETACH (ShutdownAction attribute)
detect (LossMaskRecovery attribute)
device (DistillationPipeline property)
device_count (GPUMemoryMonitor attribute)
dflash_architecture_config (DFlashConfig attribute)
dflash_block_size (DFlashConfig attribute)
dflash_freeze_base_model (DFlashConfig attribute)
dflash_loss_decay_factor (DFlashConfig attribute)
dflash_mask_token_id (DFlashConfig attribute)
dflash_num_anchors (DFlashConfig attribute)
dflash_offline (DFlashConfig attribute)
dflash_report_acc (DFlashConfig attribute)
dflash_self_logit_distillation (DFlashConfig attribute)
dflash_use_torch_compile (DFlashConfig attribute)
DFlashModeDescriptor (class in modelopt.torch.speculative.mode)
DFlashModel (class in modelopt.torch.speculative.dflash.dflash_model)
dim() (QTensorWrapper method)
DIRECT (TaskLauncher attribute)
direction (ObjectiveSpec attribute)
disable() (ConcatSymbol method)
(SparseAttentionModule method)
(Symbol method)
(SymDepth method)
(TensorQuantizer method)
disable_adapters() (in module modelopt.torch.peft.convert)
disable_calib() (TensorQuantizer method)
disable_folding_pqs_to_weights() (QuantRecipe static method)
disable_pre_quant_scale() (TensorQuantizer method)
disable_quant() (TensorQuantizer method)
disable_quantizer() (in module modelopt.torch.quantization.model_quant)
disable_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
DISABLED (StageSkipReason attribute)
DisabledNodeNameRegexRule (class in modelopt.onnx.autocast.nodeclassifier)
DisabledOpTypes (class in modelopt.onnx.autocast.nodeclassifier)
discover_bypass_checkpoints() (in module modelopt.torch.puzzletron.candidates)
discover_prunable_modules() (GenericDecoderContract method)
Discriminator (class in modelopt.torch.fastgen.discriminators)
Discriminator_ImageDiT (class in modelopt.torch.fastgen.discriminators)
display_name (StageSpec attribute)
distance() (InsertionScheme method)
distillation_overfit_stage() (in module modelopt.torch.puzzletron.stages)
distillation_stage() (in module modelopt.torch.puzzletron.stages)
DistillationLossBalancer (class in modelopt.torch.distill.loss_balancers)
DistillationModel (class in modelopt.torch.distill.distillation_model)
DistillationPipeline (class in modelopt.torch.fastgen.pipeline)
distributed (NodeCapabilities attribute)
(StageSpec attribute)
distributed_backend (ParallelismSpec attribute)
distributed_executor_backend (RuntimeTopology attribute)
distributed_isend_obj() (in module modelopt.torch.puzzletron.utils.distributed_object)
distributed_recv_obj() (in module modelopt.torch.puzzletron.utils.distributed_object)
distributed_send_obj() (in module modelopt.torch.puzzletron.utils.distributed_object)
distributed_stage_ids() (in module modelopt.torch.puzzletron.stages)
distributed_sync (LocalHessianCalibConfig attribute)
(MaxCalibConfig attribute)
(MseCalibConfig attribute)
DistributedProcessGroup (class in modelopt.torch.utils.distributed)
DMDPipeline (class in modelopt.torch.fastgen.methods.dmd)
domain (GlobalKDConfig attribute)
double_quantization() (NF4QTensor class method)
double_wide_field (GatedDenseFFNContract attribute)
down_key (LayerLayout attribute)
down_proj_name (FFNIntermediateLayerDescriptor attribute)
(GatedDenseFFNContract attribute)
(LlamaFFNIntermediateLayerDescriptor attribute)
(MistralFFNIntermediateLayerDescriptor attribute)
(NemotronHFFNIntermediateLayerDescriptor attribute)
(NemotronHV2FFNIntermediateLayerDescriptor attribute)
(Qwen3FFNIntermediateLayerDescriptor attribute)
(Qwen3P5TextFFNIntermediateLayerDescriptor attribute)
(Qwen3P5VLFFNIntermediateLayerDescriptor attribute)
(Qwen3VLFFNIntermediateLayerDescriptor attribute)
(RoutedMoEContract attribute)
download_hf_dataset_as_jsonl() (in module modelopt.torch.utils.dataset_utils)
DownstreamEvaluationNode (class in modelopt.torch.puzzletron.post_mip.builtin)
dp (GlobalKDConfig attribute)
dp_replicate (ParallelMesh attribute)
(ParallelMeshOverride attribute)
dp_shard (ParallelMesh attribute)
(ParallelMeshOverride attribute)
dp_size (ParallelismSpec attribute)
dp_slice() (PuzzletronBatch method)
dq_tensor() (in module modelopt.onnx.quantization.quant_utils)
DRAIN (HaltPolicy attribute)
DRAINING (WorkerState attribute)
drop_long_samples (PackingSpec attribute)
dsm_loss() (in module modelopt.torch.fastgen.losses)
dt_bias_key (Mamba2TensorLayout attribute)
dtype (DistillationPipeline property)
(EMAConfig attribute)
(ModelConfig attribute)
dummy_input (BaseSearcher attribute)
DummyBlock (class in modelopt.torch.puzzletron.utils.dummy_modules)
DummyLMHead (class in modelopt.torch.puzzletron.utils.dummy_modules)
DummyModule (class in modelopt.torch.puzzletron.utils.dummy_modules)
DummyWTE (class in modelopt.torch.puzzletron.utils.dummy_modules)
dump_activations_logs() (ForwardHook class method)
(LayerNormContributionHook class method)
dup_kv_weight() (in module modelopt.torch.export.layer_utils)
DUPLICATE (AttemptStatus attribute)
duplicate_shared_constants() (GraphSanitizer method)
(in module modelopt.onnx.utils)
DynamicBlockQuantizationFunction (class in modelopt.torch.quantization.tensor_quant)
DynamicModule (class in modelopt.torch.opt.dynamic)
DynamicModuleList (class in modelopt.torch.nas.modules.container)
DynamicSpace (class in modelopt.torch.opt.dynamic)
DynamicThresholdCalibrator (class in modelopt.torch.sparsity.attention_sparsity.calibration)
E
E2M1_bounds (MXFP4QTensor attribute)
e2m1_bounds_on_device (NVFP4QTensor attribute)
E2M1_max (MXFP4QTensor attribute)
E2M1_values (MXFP4QTensor attribute)
e2m1_values_on_device (NVFP4QTensor attribute)
E4M3_MAX (MXFP8QTensor attribute)
eagle_architecture_config (EagleConfig attribute)
eagle_base_lora (EagleConfig attribute)
eagle_base_lora_alpha (EagleConfig attribute)
eagle_base_lora_logits_detach_prob (EagleConfig attribute)
eagle_base_lora_preservation_loss_weight (EagleConfig attribute)
eagle_base_lora_rank (EagleConfig attribute)
eagle_base_lora_start_layer (EagleConfig attribute)
eagle_base_lora_target_modules (EagleConfig attribute)
eagle_base_lora_warmup_steps (EagleConfig attribute)
eagle_decoder_type (EagleConfig attribute)
eagle_enable_nvtx (EagleConfig attribute)
eagle_export_rope_scaling (EagleConfig attribute)
eagle_freeze_base_model (EagleConfig attribute)
eagle_hidden_state_distillation (EagleConfig attribute)
eagle_loss_decay_factor (EagleConfig attribute)
eagle_mix_hidden_states (EagleConfig attribute)
eagle_offline (EagleConfig attribute)
eagle_report_acc (EagleConfig attribute)
eagle_reuse_base_decoder (EagleConfig attribute)
eagle_self_logit_distillation (EagleConfig attribute)
eagle_ttt_steps (EagleConfig attribute)
eagle_use_torch_compile (EagleConfig attribute)
EagleModeDescriptor (class in modelopt.torch.speculative.mode)
EagleModel (class in modelopt.torch.speculative.eagle.eagle_model)
EagleOfflineDataCollator (class in modelopt.torch.speculative.eagle.utils)
early_stop() (BinarySearcher method)
(IterativeSearcher method)
effective_config (StageManifest attribute)
effective_repeat_count (RuntimeConfig attribute)
effective_repeat_count() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
elastic_dims (Symbol property)
elastic_no_op_subblocks (CampaignModel attribute)
ElasticSizeSampler (class in modelopt.torch.puzzletron.pruning.elastic_sampling)
eligible (SparseSampleManifest attribute)
ema (DMDConfig attribute)
(DMDPipeline property)
emb_scale_by_sqrt_dim (DecoderLayerConfig attribute)
embedding_pruning_spec() (GenericContractModelDescriptor class method)
(GenericDecoderContract method)
(GptOssModelDescriptor class method)
(LlamaModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(Qwen3P5TextModelDescriptor class method)
(Qwen3P5VLModelDescriptor class method)
embedding_widths (MIPProfile attribute)
EmbeddingConfig (class in modelopt.torch.export.model_config)
EmbeddingPruningSpec (class in modelopt.torch.puzzletron.pruning.embedding_pruning)
EmptyInitOnDevice (class in modelopt.torch.puzzletron.utils.misc)
enable (PEFTAttributeConfig attribute)
(QuantizerAttributeConfig attribute)
(QuantizerCfgEntry attribute)
(RotateConfig attribute)
(SparseAttentionAttributeConfig attribute)
(VSAAttributeConfig attribute)
enable() (HardDisabledTensorQuantizer method)
(SparseAttentionModule method)
(TensorQuantizer method)
enable_adapters() (in module modelopt.torch.peft.convert)
enable_calib() (HardDisabledTensorQuantizer method)
(TensorQuantizer method)
enable_cp_ttt_patch() (in module modelopt.torch.speculative.utils)
enable_expert_parallel (RuntimeTopology attribute)
enable_huggingface_checkpointing() (in module modelopt.torch.opt.plugins.huggingface)
enable_modelopt_patches (class in modelopt.torch.nas.utils)
enable_quant() (HardDisabledTensorQuantizer method)
(TensorQuantizer method)
enable_quantizer() (in module modelopt.torch.quantization.model_quant)
enable_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
enabled (AxisSearchConfig attribute)
(HomogeneousPolicy attribute)
enabled_axes (SearchSpace property)
enabled_requires (StageSpec attribute)
enabled_stage_ids() (in module modelopt.torch.puzzletron.stages)
enabled_when (StageSpec attribute)
enc_dec (ModelConfig attribute)
encoder_head_size (ModelConfig attribute)
encoder_hidden_size (ModelConfig attribute)
encoder_num_heads (ModelConfig attribute)
ended_at (StageManifest attribute)
endpoint (WorkerRecord property)
enforce_order() (Hparam method)
engine (BenchmarkResult attribute)
ensure_custom_ops_precision() (GraphSanitizer method)
ensure_graph_name_exists() (GraphSanitizer method)
ensure_scoring_parent() (in module modelopt.torch.puzzletron.scoring_parent)
enumerate_runtime_block_configs() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats)
env (CommandSpec attribute)
eos_token_id (ModelConfig attribute)
ep (GlobalKDConfig attribute)
(ParallelCapabilities attribute)
(ParallelMesh attribute)
(ParallelMeshOverride attribute)
(ParallelTopology attribute)
ep_size (ParallelismSpec attribute)
ep_supported (GenericDecoderContract attribute)
eps (LayernormConfig attribute)
error (AttemptRecord attribute)
(InsertionScheme attribute)
(NodeObservation attribute)
ErrorKind (class in modelopt.torch.puzzletron.distributed_eval)
estimate_quant_compression() (in module modelopt.torch.quantization.algorithms)
estimate_sensitivity_scores() (AutoQuantizeGradientSearcher method)
(AutoQuantizeKLDivSearcher method)
estimator_mode (RuntimeConfig attribute)
estimator_schema (RuntimeConfig attribute)
eval_score() (BaseSearcher method)
evaluate() (EvaluationClient method)
,
[1]
(EvaluationService method)
evaluate_batch_with_prefix() (EvaluationClient method)
(EvaluationService method)
evaluate_importance_scores() (in module modelopt.torch.prune.importance_hooks.base_hooks_analysis)
evaluation (StageCapabilities attribute)
evaluation_stage() (in module modelopt.torch.puzzletron.stages)
EvaluationCache (class in modelopt.torch.puzzletron.rpc_eval.cache)
EvaluationCacheSlot (class in modelopt.torch.puzzletron.rpc_eval.metadata)
EvaluationClient (class in modelopt.torch.puzzletron.distributed_eval)
(class in modelopt.torch.puzzletron.rpc_eval.service)
EvaluationMetadataCache (class in modelopt.torch.puzzletron.rpc_eval.metadata)
EvaluationNode (class in modelopt.torch.puzzletron.post_mip.builtin)
EvaluationRequest (class in modelopt.torch.puzzletron.rpc_eval.cache)
EvaluationResult (class in modelopt.torch.puzzletron.rpc_eval.cache)
EvaluationService (class in modelopt.torch.puzzletron.rpc_eval.service)
EVALUATOR (NodeKind attribute)
evaluator_revision (CampaignManifest attribute)
(DepthScenario attribute)
(EvaluationRequest attribute)
evict_expired_prefixes() (EvaluationMetadataCache method)
EvolveSearcher (class in modelopt.torch.nas.autonas)
excluded (SparseSampleManifest attribute)
exclusive (AttemptSpec attribute)
execution_defaults (CampaignPlan attribute)
execution_record (StageManifest attribute)
ExecutionStrategy (class in modelopt.torch.puzzletron.orchestration)
exempt_patterns (EmbeddingPruningSpec attribute)
(MTPContract attribute)
(VisionLanguageContract attribute)
exit_code (JobStatus attribute)
expand_like() (in module modelopt.torch.fastgen.utils)
expand_mask() (in module modelopt.torch.speculative.eagle.utils)
expand_node_names_from_patterns() (in module modelopt.onnx.quantization.graph_utils)
expect_native_automodel (CampaignModel attribute)
expected (CoverageRow attribute)
expected_post_mip_candidate_count() (in module modelopt.torch.puzzletron.post_mip.identity)
expected_post_mip_execution_contract() (in module modelopt.torch.puzzletron.post_mip.identity)
expected_post_mip_execution_identity() (in module modelopt.torch.puzzletron.post_mip.identity)
(in module modelopt.torch.puzzletron.post_mip.runner)
expected_size (MagnitudeFallbackSpec attribute)
experiment_config (CampaignPlan attribute)
experiment_config_path (CampaignPlan attribute)
expert_biases (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
expert_down_keys (LatentMoETensorLayout attribute)
expert_down_proj_regex (MoELayerDescriptor attribute)
expert_idx_from_module_name() (MoELayerDescriptor method)
expert_intermediate_size (MoEConfig attribute)
expert_keep_indices (BlockTarget attribute)
expert_prefix() (ExpertRemovalLayerDescriptor method)
expert_prefix_name (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
expert_up_keys (LatentMoETensorLayout attribute)
expert_weights (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
ExpertConfig (class in modelopt.torch.export.model_config)
ExpertRemoval (MlpInitMode attribute)
ExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin)
ExpertRemovalPruningMixIn (class in modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin)
experts (MOEConfig attribute)
experts_name (MoELayerDescriptor attribute)
(RoutedMoEContract attribute)
experts_prefix() (MoELayerDescriptor method)
explicit_full_attention_window (GenericDecoderContract attribute)
ExponentialMovingAverage (class in modelopt.torch.fastgen.ema)
export (PuzzletronCapabilities attribute)
export() (DistillationModel method)
(DynamicModule method)
(DynamicSpace method)
(in module modelopt.torch.distill.distillation)
(in module modelopt.torch.nas.conversion)
(in module modelopt.torch.sparsity.weight_sparsity.sparsification)
(LayerwiseDistillationModel method)
(SearchSpace method)
export_amax() (TensorQuantizer method)
export_format (SparseAttentionConfig attribute)
export_fp4() (in module modelopt.torch.quantization.export_onnx)
export_fp8() (in module modelopt.torch.quantization.export_onnx)
export_fp8_mha() (in module modelopt.torch.quantization.export_onnx)
export_hf_checkpoint() (in module modelopt.torch.export.unified_export_hf)
export_int4() (in module modelopt.torch.quantization.export_onnx)
export_int8() (in module modelopt.torch.quantization.export_onnx)
export_mcore_gpt_to_hf() (in module modelopt.torch.export.unified_export_megatron)
export_mode (AutoNASModeDescriptor property)
(FastNASModeDescriptor property)
(KnowledgeDistillationModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
export_mxfp8() (in module modelopt.torch.quantization.export_onnx)
export_sparse() (in module modelopt.torch.sparsity.weight_sparsity.mode)
export_sparse_attention_config() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
export_sparse_softmax (SparseAttentionAttributeConfig attribute)
export_speculative_decoding() (in module modelopt.torch.export.unified_export_hf)
export_tensorrt_llm_checkpoint() (in module modelopt.torch.export.model_config_export)
export_torch_mode() (in module modelopt.torch.quantization.utils)
ExportCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
ExportNASModeDescriptor (class in modelopt.torch.nas.conversion)
ExportPEFTModeDescriptor (class in modelopt.torch.peft.mode)
ExportSparseModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode)
ExportStudentModeDescriptor (class in modelopt.torch.distill.mode)
expose_minimal_state_dict (KDLossConfig attribute)
extra (CoverageRow attribute)
extra_repr() (DynamicModule method)
(TensorQuantizer method)
extra_vllm_args (RuntimeConfig attribute)
extract_block_configs_and_locations() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
extract_first_image_from_messages() (in module modelopt.torch.utils.nemotron_vlm_dataset_utils)
extract_layer_id() (in module modelopt.onnx.llm_export_utils.surgeon_utils)
extract_solution_results() (in module modelopt.torch.puzzletron.mip.sweep)
F
FAIL_FAST (HaltPolicy attribute)
FAILED (AttemptStatus attribute)
(WorkerState attribute)
failure_msg() (GraphCollection method)
(RobustTracer method)
failure_policy (StageExecutionSpec attribute)
FailureClass (class in modelopt.torch.puzzletron.orchestration)
FailurePolicy (class in modelopt.torch.puzzletron.orchestration)
failures (BenchmarkResult attribute)
fake_quant (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
fake_quant_impl() (in module modelopt.torch.quantization.tensor_quant)
fake_score_pred_type (DMDConfig attribute)
FakeTensorQuantFunction (class in modelopt.torch.quantization.tensor_quant)
fallback (ArtifactChoice attribute)
FastHadamardTransform (class in modelopt.torch.quantization.nn.functional)
FastNASModeDescriptor (class in modelopt.torch.prune.fastnas)
FastNASPatchManager (class in modelopt.torch.prune.fastnas)
fc (ExpertConfig attribute)
(MLPConfig attribute)
(MOEConfig property)
fc1_key (LatentMoETensorLayout attribute)
fc2_key (LatentMoETensorLayout attribute)
ffn_hidden_size_local (DecoderLayerConfig property)
ffn_intermediate (LayerLayout attribute)
ffn_keep_mask() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
ffn_permutation() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
ffn_prefix() (FFNIntermediateLayerDescriptor method)
ffn_prefix_name (FFNIntermediateLayerDescriptor attribute)
(LlamaFFNIntermediateLayerDescriptor attribute)
(MistralFFNIntermediateLayerDescriptor attribute)
(NemotronHFFNIntermediateLayerDescriptor attribute)
(NemotronHV2FFNIntermediateLayerDescriptor attribute)
(Qwen3FFNIntermediateLayerDescriptor attribute)
(Qwen3P5TextFFNIntermediateLayerDescriptor attribute)
(Qwen3P5VLFFNIntermediateLayerDescriptor attribute)
(Qwen3VLFFNIntermediateLayerDescriptor attribute)
FFNConfig (class in modelopt.torch.puzzletron.block_config)
FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin)
FFNIntermediatePruningMixIn (class in modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin)
FFNRemovalSpec (class in modelopt.torch.puzzletron.pruning.dynamic_block_prune)
field (AxisCapabilities attribute)
(PrunableAxis attribute)
(VariantAxis attribute)
fill() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
filter_metric_references() (in module modelopt.torch.puzzletron.post_mip.filters)
filter_quantizable_kgen_heads() (in module modelopt.onnx.quantization.graph_utils)
filter_replacements_by_axes() (in module modelopt.torch.puzzletron.mip.search_space)
filter_subblock_stats_by_args() (in module modelopt.torch.puzzletron.mip.run_puzzle)
FilterNode (class in modelopt.torch.puzzletron.post_mip.builtin)
final_logit_softcapping (DecoderLayerConfig attribute)
final_norm (DecoderLayout attribute)
final_norm_name() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
finalize() (SharedQuantState method)
(SharedWeightGlobalAmaxState method)
find_conv_to_layernorm_nodes() (in module modelopt.onnx.quantization.graph_utils)
find_custom_nodes() (GraphSanitizer method)
find_fusible_partitions() (in module modelopt.onnx.quantization.partitioning)
find_hardcoded_patterns() (in module modelopt.onnx.quantization.partitioning)
find_layer_norm_partitions() (in module modelopt.onnx.quantization.partitioning)
find_lowest_common_ancestor() (in module modelopt.onnx.utils)
find_mha_partitions() (in module modelopt.onnx.quantization.graph_utils)
(in module modelopt.onnx.quantization.partitioning)
find_nodes_from_convs_to_exclude() (in module modelopt.onnx.quantization.graph_utils)
find_nodes_from_matmul_to_exclude() (in module modelopt.onnx.quantization.graph_utils)
find_nodes_from_mha_to_exclude() (in module modelopt.onnx.quantization.graph_utils)
find_nodes_to_exclude() (in module modelopt.onnx.quantization.graph_utils)
find_non_quantizable_partitions_from_patterns() (in module modelopt.onnx.quantization.partitioning)
find_quant_cfg_entry_by_path() (in module modelopt.torch.quantization.config)
find_quantizable_nodes() (in module modelopt.onnx.quantization.partitioning)
find_scales() (in module modelopt.onnx.quantization.quant_utils)
find_shared_input_groups() (in module modelopt.torch.quantization.utils)
fingerprint (CampaignStageIdentity property)
(CrossModelCampaign property)
(PuzzletronBatch attribute)
(ScoringParent attribute)
finished_at (AttemptRecord attribute)
FirstKV (GQAInitMode attribute)
fit_logspace (CalibrationConfig attribute)
FIXED (DataLayout attribute)
fixed_intercept() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
flash_ce_kd_loss() (in module modelopt.torch.puzzletron.utils.flash_kd)
floor_scale (Llama4AttentionConfig attribute)
flow_id (CandidateSet attribute)
(CompiledPostMIPNode attribute)
fold_dq_fp32_to_fp16_casts() (in module modelopt.onnx.utils)
fold_fp8_qdq_to_dq() (in module modelopt.onnx.llm_export_utils.surgeon_utils)
fold_pqs_to_weights() (QuantRecipe static method)
fold_q_fp16_to_fp32_casts() (in module modelopt.onnx.utils)
fold_qdq_scale_fp16_to_fp32_casts() (in module modelopt.onnx.utils)
fold_weight() (in module modelopt.torch.quantization.model_quant)
(QuantModule method)
(SVDQuantLinear method)
force_cache_dynamic_modules() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
force_hf (AxisCapabilities attribute)
(CampaignManifest attribute)
(CampaignModel attribute)
(GlobalKDConfig attribute)
force_hf_supported (PuzzletronCapabilities attribute)
format_global_config() (in module modelopt.torch.puzzletron.utils.parsing)
format_stitched_losses() (in module modelopt.torch.puzzletron.utils.parsing)
format_tree() (RegionPattern method)
forward() (ChunkedCrossEntropy method)
(ClipFunction static method)
(Discriminator method)
(Discriminator_ImageDiT method)
(DistillationLossBalancer method)
(DistillationModel method)
(DummyBlock method)
(DummyLMHead method)
(DummyWTE method)
(DynamicBlockQuantizationFunction static method)
(FakeTensorQuantFunction static method)
(FastHadamardTransform static method)
(LogitsDistillationLoss method)
(LoRAModule method)
(MatchingZeros method)
(MFTLoss method)
(MGDLoss method)
(QuantInputBase method)
(QuantLinearConvBase method)
(QuantRNNBase method)
(RealQuantLinear method)
(ResBlock method)
(Same method)
(ScaledE4M3Function static method)
(SparseAttentionModule method)
(StaticBlockwiseFP4FakeQuantFunction static method)
(StaticLossBalancer method)
(SVDQuantLinear method)
(TensorQuantizer method)
(TrainingFlashKLD method)
(VFRNNForward method)
(WrapperModelForCausalLM method)
forward_attention() (SparseAttentionMethod method)
forward_loop (BaseSearcher attribute)
forward_no_checkpoint() (ChunkedCrossEntropy method)
ForwardHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
fp4_compatible() (in module modelopt.torch.quantization.backends.utils)
fp4_dequantize() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel)
fp4_fake_quant() (in module modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda)
fp4_fake_quant_block() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper)
fp4qdq_to_2dq() (in module modelopt.onnx.quantization.qdq_utils)
fp8_compatible() (in module modelopt.torch.quantization.backends.utils)
fp8_eager() (in module modelopt.torch.quantization.tensor_quant)
fp8_scale_candidates() (in module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep)
fp8_scale_sweep (LocalHessianCalibConfig attribute)
(MseCalibConfig attribute)
FP8QTensor (class in modelopt.torch.quantization.qtensor.fp8_tensor)
FP8QuantExporter (class in modelopt.onnx.export)
freeze() (DynamicModule method)
freeze_base_model (PEFTConfig attribute)
freeze_lora_weights (PEFTConfig attribute)
freeze_lora_weights() (in module modelopt.torch.peft.conversion)
freeze_policy (GlobalKDConfig attribute)
from_campaign() (AsyncEvaluationClient class method)
(EvaluationClient class method)
from_candidates() (CandidateLibrary class method)
from_config() (RuntimeTopology class method)
from_dict() (Candidate class method)
(CandidateLibrary class method)
(ChildRegionInputInsertionPoint class method)
(ChildRegionOutputInsertionPoint class method)
(EvaluationRequest class method)
(EvaluationResult class method)
(InsertionScheme class method)
(NodeInputInsertionPoint class method)
(PatternCache class method)
(PatternSchemes class method)
(ResolvedInsertionPoint class method)
(RuntimeMeasurement class method)
from_mamba_config() (GDNShape class method)
from_mapping() (AxisSearchConfig class method)
(ParallelMesh class method)
(PuzzletronDataSpec class method)
from_module() (GDNShape class method)
from_quantized_weight() (in module modelopt.torch.export.quant_utils)
from_region() (RegionPattern class method)
from_registry() (EvaluationClient class method)
from_score_payload() (GDNPermutation class method)
from_tensor_quantizer() (NVFP4StaticQuantizer class method)
from_wire() (EvaluationRequest class method)
from_yaml() (DMDConfig class method)
FromTeacher (LinearInitMode attribute)
fsdp (ParallelCapabilities attribute)
(ParallelismSpec attribute)
(ParallelTopology attribute)
fsdp2 (EMAConfig attribute)
functionals_to_replace (QuantRNNBase property)
fuse_prequant_layernorm() (in module modelopt.torch.export.quant_utils)
fuse_prequant_to_linear() (in module modelopt.torch.export.quant_utils)
fused (GPTQCalibConfig attribute)
fused_expert_weights (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
FusedGatedMLP (MLPType attribute)
G
gamma (EMAConfig attribute)
gan_disc_loss() (in module modelopt.torch.fastgen.losses)
gan_gen_loss() (in module modelopt.torch.fastgen.losses)
gan_loss_weight_gen (DMDConfig attribute)
gan_r1_reg_alpha (DMDConfig attribute)
gan_r1_reg_weight (DMDConfig attribute)
gan_use_same_t_noise (DMDConfig attribute)
gate (MLPConfig attribute)
gate_attn (DecoderLayerConfig attribute)
gate_ffwd (DecoderLayerConfig attribute)
gate_key (LayerLayout attribute)
gate_name (MoELayerDescriptor attribute)
gate_prefix() (MoELayerDescriptor method)
gate_proj_name (GatedDenseFFNContract attribute)
(RoutedMoEContract attribute)
gated_delta_net (LayerLayout attribute)
gated_delta_net_prefix_indices() (in module modelopt.torch.puzzletron.pruning.gated_delta_net)
GatedDeltaNetLayerDescriptor (class in modelopt.torch.puzzletron.pruning.gated_delta_net_pruning_mixin)
GatedDeltaNetPruningMixIn (class in modelopt.torch.puzzletron.pruning.gated_delta_net_pruning_mixin)
GatedDenseFFNContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
GatedMLP (MLPType attribute)
gather_context_logits (LLM property)
gather_multi_layer_puzzle_metrics() (in module modelopt.torch.puzzletron.mip.run_puzzle)
gdn_prefix() (GatedDeltaNetLayerDescriptor method)
gdn_prefix_name (GatedDeltaNetLayerDescriptor attribute)
(Qwen3P5TextGatedDeltaNetLayerDescriptor attribute)
(Qwen3P5VLGatedDeltaNetLayerDescriptor attribute)
GDNPermutation (class in modelopt.torch.puzzletron.pruning.gated_delta_net)
GDNShape (class in modelopt.torch.puzzletron.pruning.gated_delta_net)
gegelu_limit (DecoderLayerConfig attribute)
gemm_registry (in module modelopt.torch.quantization.backends)
gen_random_inputs() (in module modelopt.onnx.utils)
generate() (SearchSpace method)
generate_campaign_report() (in module modelopt.torch.puzzletron.diagnostics)
generate_context_logits() (LLM method)
generate_diffusion_dummy_forward_fn() (in module modelopt.torch.export.diffusers_utils)
generate_diffusion_dummy_inputs() (in module modelopt.torch.export.diffusers_utils)
generate_replace_block_report() (in module modelopt.torch.puzzletron.diagnostics)
generate_search_space() (in module modelopt.torch.nas.search_space)
generate_text() (LLM method)
generate_tokens() (LLM method)
generate_vllm_stats_report() (in module modelopt.torch.puzzletron.diagnostics)
generation_seq_len (RuntimeConfig attribute)
(VllmMeasurement attribute)
generic_decoder_contract() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor class method)
(LlamaModelDescriptor class method)
(ModelDescriptor class method)
GenericContractModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
GenericDecoderContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
GenericDecoderConverter (class in modelopt.torch.puzzletron.anymodel.converter.generic_decoder)
get() (AutoModelDescriptorFactory class method)
(ConverterFactory class method)
(EvaluationCache method)
(ModelDescriptorFactory class method)
(ModeloptBaseConfig method)
(TracedHpRegistry class method)
get_activation_ops() (in module modelopt.onnx.op_types)
get_activation_scaling_factor() (in module modelopt.torch.export.quant_utils)
(NVFP4QTensor class method)
get_aggregation_ops() (in module modelopt.onnx.op_types)
get_all_input_names() (in module modelopt.onnx.utils)
get_amax() (in module modelopt.onnx.quantization.quant_utils)
get_arbitrary_checkpoint_dir() (ReplacementLibrary method)
get_attribute() (in module modelopt.onnx.utils)
get_auto_name_for_config() (QuantRecipe static method)
get_auto_quantize_config() (in module modelopt.torch.quantization.algorithms)
(in module modelopt.torch.quantization.model_quant)
get_available_surgeries() (in module modelopt.onnx.graph_surgery)
get_batch_size() (in module modelopt.onnx.utils)
get_batch_size_from_bytes() (in module modelopt.onnx.utils)
get_bitwise_ops() (in module modelopt.onnx.op_types)
get_bool_ops() (in module modelopt.onnx.op_types)
get_calibration_stats() (SparseAttentionStatsManager method)
get_call_count() (AccumulatingTimer class method)
get_cast_to_type() (in module modelopt.onnx.utils)
get_child_nodes() (in module modelopt.onnx.utils)
get_children() (Region method)
get_comparison_ops() (in module modelopt.onnx.op_types)
get_concat_eliminated_tensors() (in module modelopt.onnx.quantization.graph_utils)
get_conditional_ops() (in module modelopt.onnx.op_types)
get_config_class() (ModeloptStateManager static method)
get_configs_parallel() (in module modelopt.torch.export.distribute)
get_consumer_nodes() (in module modelopt.onnx.utils)
get_copy_ops() (in module modelopt.onnx.op_types)
get_cost() (QuantRecipeHparam method)
get_cuda_ext() (in module modelopt.torch.quantization.extensions)
get_cuda_ext_fp8() (in module modelopt.torch.quantization.extensions)
get_cuda_ext_mx() (in module modelopt.torch.quantization.extensions)
get_cuda_memory_stats() (in module modelopt.torch.utils.perf)
get_custom_layers() (in module modelopt.onnx.trt_utils)
get_dataset_dataloader() (in module modelopt.torch.utils.dataset_utils)
get_dataset_samples() (in module modelopt.torch.utils.dataset_utils)
get_default_attention_mask_and_position_ids() (in module modelopt.torch.speculative.utils)
get_diffusers_components() (in module modelopt.torch.export.diffusers_utils)
get_diffusion_components() (in module modelopt.torch.export.diffusers_utils)
get_diffusion_model_type() (in module modelopt.torch.export.diffusers_utils)
get_dist_syncd_obj() (DistributedProcessGroup static method)
get_dtype() (in module modelopt.torch.export.layer_utils)
get_dynamic_graph_inputs() (in module modelopt.onnx.utils)
get_e2m1_bounds() (NVFP4QTensor class method)
get_e2m1_values() (NVFP4QTensor class method)
get_enc_dec_models() (in module modelopt.torch.export.layer_utils)
get_enc_dec_token_ids() (in module modelopt.torch.export.layer_utils)
get_encoder_config() (in module modelopt.torch.export.layer_utils)
get_expert_linear_names() (in module modelopt.torch.export.layer_utils)
get_experts_linear_names() (in module modelopt.torch.export.layer_utils)
get_experts_list() (in module modelopt.torch.export.layer_utils)
get_extended_model_outputs() (in module modelopt.onnx.quantization.graph_utils)
get_field_name_from_key() (ModeloptBaseConfig method)
get_fim_token_ids() (in module modelopt.torch.puzzletron.utils.data.dataset)
get_first() (CalibrationDataProvider method)
(RandomDataProvider method)
get_full_insertion_scheme() (RegionPattern method)
get_fusible_backbone() (in module modelopt.onnx.quantization.graph_utils)
get_ground_truth() (AcceptanceRateValidation method)
get_hash() (RegionPattern method)
get_hparam() (DynamicModule method)
(DynamicSpace method)
(in module modelopt.torch.opt.utils)
get_input_names() (in module modelopt.onnx.utils)
get_input_names_from_bytes() (in module modelopt.onnx.utils)
get_input_shapes() (in module modelopt.onnx.quantization.graph_utils)
(in module modelopt.onnx.utils)
get_input_shapes_from_bytes() (in module modelopt.onnx.utils)
get_jsonl_text_samples() (in module modelopt.torch.utils.dataset_utils)
get_kv_cache_bias() (in module modelopt.torch.export.quant_utils)
get_kv_cache_dtype() (in module modelopt.torch.export.quant_utils)
get_kv_cache_scaling_factor() (in module modelopt.torch.export.quant_utils)
get_kwargs_for_create_model_with_rules() (in module modelopt.torch.opt.config)
get_language_model_config() (GenericContractModelDescriptor class method)
(ModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
get_language_model_from_vl() (in module modelopt.torch.export.model_utils)
get_layer_axis() (in module modelopt.onnx.quantization.quant_utils)
get_layer_block_size() (in module modelopt.onnx.quantization.quant_utils)
get_layer_info() (in module modelopt.onnx.quantization.graph_utils)
get_layer_precision_mapping() (in module modelopt.onnx.quantization.graph_utils)
get_loss_mask_recovery() (in module modelopt.torch.utils.loss_mask)
get_manager() (PatchManager class method)
get_max_batch_size() (in module modelopt.torch.utils.dataset_utils)
get_min_opset_for_precisions() (in module modelopt.onnx.utils)
get_model_attributes() (in module modelopt.torch.utils.network)
get_model_type() (in module modelopt.torch.export.model_utils)
(ModelLoader method)
get_modelopt_state() (SequentialQuantizer method)
(TensorQuantizer method)
get_module_device() (in module modelopt.torch.utils.network)
get_module_names_to_hook() (PruningMixIn method)
get_modules_names_to_hook() (GptOssExpertRemovalLayerDescriptor method)
(LayerDescriptor method)
(MoELayerDescriptor method)
(NemotronHExpertRemovalLayerDescriptor method)
(NemotronHV2ExpertRemovalLayerDescriptor method)
get_named_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.utils)
get_nested_key() (in module modelopt.torch.puzzletron.mip.utils)
(in module modelopt.torch.puzzletron.utils.parsing)
get_next() (CalibrationDataProvider method)
(RandomDataProvider method)
get_nmprune_info() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
get_node_filter_list() (in module modelopt.onnx.quantization.autotune)
get_node_names() (in module modelopt.onnx.utils)
get_node_names_from_bytes() (in module modelopt.onnx.utils)
get_nodes() (Region method)
get_num_bits() (in module modelopt.onnx.quantization.quant_utils)
get_op_types_not_supported_in_low_precision() (in module modelopt.onnx.autocast.utils)
get_opset_version() (in module modelopt.onnx.utils)
get_or_submit() (EvaluationClient method)
get_or_submit_batch() (EvaluationClient method)
get_original_cls_by_level() (DynamicModule method)
get_output_names() (in module modelopt.onnx.utils)
get_output_names_from_bytes() (in module modelopt.onnx.utils)
get_output_shapes() (in module modelopt.onnx.utils)
get_outputs_list() (OutputSaveHook method)
get_parent_nodes() (in module modelopt.onnx.utils)
get_passthrough_weight_groups() (ModelDescriptor class method)
get_pattern_schemes() (PatternCache method)
get_prequant_scaling_factor() (in module modelopt.torch.export.quant_utils)
get_producer_nodes() (in module modelopt.onnx.utils)
get_progress_info() (ForwardHook method)
(IterativeChannelContributionHook method)
(RankedChoiceVotingHook method)
get_qdq_precisions() (in module modelopt.onnx.utils)
get_qkv_group_key() (in module modelopt.torch.export.diffusers_utils)
get_qtensor() (QTensorWrapper method)
get_quant_config() (in module modelopt.onnx.llm_export_utils.quantization_utils)
(in module modelopt.torch.export.quant_utils)
get_quantizable_op_types() (in module modelopt.onnx.quantization.ort_utils)
get_quantization_format() (in module modelopt.torch.export.quant_utils)
get_quantized_rnn_layer_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn)
get_quantized_rnn_layer_variable_len_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn)
get_quantized_rnn_layer_variable_len_reverse_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn)
get_quantized_tensors() (in module modelopt.onnx.quantization.qdq_utils)
get_region_nodes_and_descendants() (Region method)
get_resize_scales() (in module modelopt.onnx.quantization.graph_utils)
get_rope_type() (ModelLoader method)
get_router_logits_and_routed_experts() (NemotronHRemoveExpertsIndependentHook method)
(Qwen3VLRemoveExpertsIndependentHook method)
(RemoveExpertsIndependentHook method)
get_rule_type() (ModeloptBaseRule class method)
get_same_padding() (in module modelopt.torch.utils.network)
get_scaling_factor() (in module modelopt.torch.export.quant_utils)
get_scaling_factor_from_weight() (in module modelopt.torch.export.quant_utils)
get_score() (QuantRecipeHparam method)
get_set_ops() (in module modelopt.onnx.op_types)
get_shapes() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm)
get_short_signature() (RegionPattern method)
get_size_of_region_and_descendants() (Region method)
get_skip_softmax_context() (in module modelopt.torch.kernels.sparsity.attention)
get_skipped_output_layers() (in module modelopt.onnx.quantization.partitioning)
get_sliced_tensor() (in module modelopt.torch.nas.modules.utils)
get_sliced_tensor_by_slices() (in module modelopt.torch.nas.modules.utils)
get_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.utils)
get_sparse_context() (SparseAttentionMethod method)
get_sparse_method() (in module modelopt.torch.sparsity.attention_sparsity.methods)
get_speech_dataset_dataloader() (in module modelopt.torch.utils.speech_dataset_utils)
get_state() (QTensorWrapper method)
get_stats() (SparseAttentionModule method)
get_subblock() (BlockConfig method)
get_subnet_config() (in module modelopt.torch.nas.utils)
get_summary() (SparseAttentionStatsManager method)
get_supported_datasets() (in module modelopt.torch.utils.dataset_utils)
get_supported_speech_datasets() (in module modelopt.torch.utils.speech_dataset_utils)
get_supported_vlm_datasets() (in module modelopt.torch.utils.vlm_dataset_utils)
get_symbol() (SymMap method)
get_symmetric_ops() (in module modelopt.onnx.op_types)
get_teacher_memory_from_subblock_stats() (in module modelopt.torch.puzzletron.mip.sweep)
get_teacher_num_params_from_subblock_stats() (in module modelopt.torch.puzzletron.mip.sweep)
get_tensor_by_name() (in module modelopt.onnx.utils)
get_tensor_consumer_node_indices() (in module modelopt.onnx.quantization.graph_utils)
get_tensor_consumer_nodes() (in module modelopt.onnx.quantization.graph_utils)
get_tensor_dtype() (in module modelopt.onnx.quantization.qdq_utils)
get_tensor_from_name() (in module modelopt.onnx.quantization.graph_utils)
get_tensor_producer_nodes() (in module modelopt.onnx.quantization.graph_utils)
get_tensors_parallel() (in module modelopt.torch.export.distribute)
get_threshold_info() (SparseAttentionMethod method)
(SparseAttentionModule method)
get_total_time() (AccumulatingTimer class method)
get_transformer_layers() (in module modelopt.torch.export.layer_utils)
get_ttt_msk_func() (in module modelopt.torch.speculative.utils)
get_unique_consumer_node() (in module modelopt.onnx.autocast.utils)
get_unwrapped_name() (in module modelopt.torch.utils.network)
get_used_gpu_mem_fraction() (in module modelopt.torch.utils.perf)
get_value_check_ops() (in module modelopt.onnx.op_types)
get_variable_inputs() (in module modelopt.onnx.utils)
get_vlm_dataset_dataloader() (in module modelopt.torch.utils.vlm_dataset_utils)
get_weight_block_size() (in module modelopt.torch.export.quant_utils)
get_weight_groups() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(NemotronHV2ModelDescriptor class method)
get_weight_scaling_factor() (in module modelopt.torch.export.quant_utils)
get_weight_scaling_factor_2() (in module modelopt.torch.export.quant_utils)
get_weights_scaling_factor() (in module modelopt.onnx.quantization.quant_utils)
(MXFP8QTensor class method)
(NVFP4QTensor class method)
get_weights_scaling_factor_2() (in module modelopt.onnx.quantization.quant_utils)
(NVFP4QTensor class method)
get_weights_scaling_factor_2_from_quantizer() (NVFP4QTensor class method)
get_weights_scaling_factor_from_quantizer() (MXFP8QTensor class method)
(NVFP4QTensor class method)
global_amax (NVFP4StaticQuantizer property)
(SharedWeightGlobalAmaxState property)
global_batch_size (GlobalKDConfig attribute)
global_cu_seqlens (PackedSequenceMetadata attribute)
global_head_dim_field (StandardGQAAttentionContract attribute)
global_kd (StageCapabilities attribute)
global_kv_heads_field (StandardGQAAttentionContract attribute)
GlobalKDConfig (class in modelopt.torch.puzzletron.distillation.global_automodel)
GlobalKDNode (class in modelopt.torch.puzzletron.post_mip.builtin)
GlobalKDResult (class in modelopt.torch.puzzletron.distillation.global_automodel)
GptOssConverter (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter)
GptOssExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor)
GptOssKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor)
GptOssModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor)
gptq_fused_block_scalar() (in module modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel)
gpu_count (BenchmarkResult attribute)
gpu_group_size (RuntimeTopology attribute)
(VllmMeasurement property)
GPUMemoryMonitor (class in modelopt.torch.utils.memory_monitor)
gpus_per_instance (WorkItem attribute)
gpus_per_node (StageExecutionSpec attribute)
gpus_per_task (ParallelismSpec attribute)
(TaskTopology attribute)
GQAInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils)
granularity (DepthScenario attribute)
(VllmMeasurement attribute)
granularity_label (StageSpec attribute)
GraphCollection (class in modelopt.torch.trace.tracer)
GraphSanitizer (class in modelopt.onnx.autocast.graphsanitizer)
group_size (PrunableAxis attribute)
grouped_attention_permutations() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
grouped_axes (TensorAxisRule attribute)
grouped_state_size (Mamba2TensorLayout property)
GroupNorm (LayerNormType attribute)
guidance_scale (DistillationConfig attribute)
H
halflife_kimg (EMAConfig attribute)
HaltPolicy (class in modelopt.torch.puzzletron.orchestration)
handle (JobStatus attribute)
handle_arg_string() (in module modelopt.torch.puzzletron.utils.parsing)
handle_id (JobHandle attribute)
handler (EvaluationRequest attribute)
,
[1]
HardDisabledTensorQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer)
has_attribute() (in module modelopt.onnx.utils)
has_const_input() (in module modelopt.onnx.quantization.graph_utils)
has_path_type() (in module modelopt.onnx.quantization.graph_utils)
has_pattern() (PatternCache method)
has_qdq_nodes() (in module modelopt.onnx.quantization.qdq_utils)
has_quantized_modules() (in module modelopt.torch.export.quant_utils)
has_real_quant_gemm_impl() (RealQuantLinear method)
has_score (BaseSearcher property)
has_state (ModeloptStateManager property)
has_state_for_mode_type() (ModeloptStateManager static method)
hash (InsertionScheme property)
head_dim (LayerLayout attribute)
(Mamba2TensorLayout attribute)
(MambaConfig attribute)
head_dim_field (StandardGQAAttentionContract attribute)
heartbeat_at (WorkerRecord attribute)
hf (ExportCapabilities attribute)
hf_id (CampaignModel attribute)
hf_revision (CampaignModel attribute)
hidden_act (LinearActConfig attribute)
(MLPConfig attribute)
(ModelConfig property)
(MOEConfig attribute)
hidden_kd_weight (GlobalKDConfig attribute)
hidden_mask (PuzzletronBatch attribute)
hidden_permutation_group_size (GenericDecoderContract attribute)
hidden_size (DecoderLayerConfig property)
(EmbeddingConfig property)
(EmbeddingPruningSpec attribute)
(ModelConfig property)
(RuntimeConfig attribute)
hidden_size_field (DecoderLayout attribute)
hidden_width (Candidate attribute)
(DepthScenario attribute)
(ScenarioKey attribute)
(SparseSampleRecord attribute)
hidden_width_layer_context() (in module modelopt.torch.puzzletron.pruning.runtime_hidden_width)
hidden_width_module_context() (in module modelopt.torch.puzzletron.pruning.runtime_hidden_width)
HiddenSizeInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils)
hide_loss_modules() (DistillationModel method)
hide_quantizers_from_state_dict() (in module modelopt.torch.export.diffusers_utils)
hide_teacher_model() (DistillationModel method)
high_precision_nodes (InitializerConsumerTracker attribute)
HistogramCalibrator (class in modelopt.torch.quantization.calib.histogram)
history (IterativeSearcher attribute)
homogeneous (MIPProfile attribute)
homogeneous_layout() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
HomogeneousPolicy (class in modelopt.torch.puzzletron.mip.profiles)
hooked__replicate_for_data_parallel() (PatchManager static method)
hooked_forward() (PatchManager static method)
hooked_train() (PatchManager static method)
host (WorkerRecord attribute)
Hparam (class in modelopt.torch.opt.hparam)
hparam_names_for_search (BinarySearcher property)
hparam_types_for_search (BinarySearcher property)
I
identity (Candidate property)
(CandidateLibrary property)
(CandidateSet attribute)
Identity (class in modelopt.torch.puzzletron.identity)
identity (EvaluationRequest property)
(GlobalKDConfig property)
(ScenarioKey property)
(SearchSpace property)
(SparseSampleManifest property)
(VllmMeasurement property)
identity() (TextAcquisitionSpec method)
(VlmAcquisitionSpec method)
identity_mismatches (CoverageReport attribute)
IDLE (WorkerState attribute)
implementation_provenance (StageManifest attribute)
implemented (NodeCapabilities attribute)
import_campaign_artifacts() (in module modelopt.torch.puzzletron.artifact_import)
import_mcore_gpt_from_hf() (in module modelopt.torch.export.unified_export_megatron)
import_plugin() (in module modelopt.torch.utils.import_utils)
import_scales_from_calib_cache() (in module modelopt.onnx.quantization.calib_utils)
Importance (Hparam attribute)
importance (Hparam property)
(QuantRecipeHparam property)
ImportanceEstimator (Hparam attribute)
IMPORTED (StageStatus attribute)
imported_completion_payload() (in module modelopt.torch.puzzletron.artifact_import_contract)
imported_stage_manifest_is_complete() (in module modelopt.torch.puzzletron.artifact_import_contract)
in_proj_bias_key (Mamba2TensorLayout attribute)
in_proj_key (Mamba2TensorLayout attribute)
in_proj_name (MambaLayerDescriptor attribute)
in_proj_size (Mamba2TensorLayout property)
IncludeNodeNameRegexRule (class in modelopt.onnx.autocast.nodeclassifier)
IncludeOpTypes (class in modelopt.onnx.autocast.nodeclassifier)
INCOMING (Symbol.CLType attribute)
IndependentChannelContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
IndependentKvHeadContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
index (SubblockRef attribute)
indices() (GDNPermutation method)
InfeasibleError
infer_descriptor_name() (in module modelopt.torch.puzzletron.anymodel.registry)
infer_dtype_from_model() (in module modelopt.torch.export.diffusers_utils)
infer_shapes() (in module modelopt.onnx.utils)
infer_types() (in module modelopt.onnx.utils)
infer_types_shapes() (in module modelopt.onnx.trt_utils)
infer_types_shapes_tensorrt() (in module modelopt.onnx.trt_utils)
infer_types_verification() (in module modelopt.onnx.utils)
infer_weights_dtype() (in module modelopt.torch.puzzletron.tools.common)
inference_flops() (in module modelopt.torch.nas.utils)
ingest_mip() (CandidateLedger method)
init_empty_module() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
init_model_from_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
init_model_from_model_like() (in module modelopt.torch.utils.network)
init_module_with_state_dict() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
init_rotary_embedding() (GenericContractModelDescriptor static method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5MoeTextModelDescriptor static method)
(Qwen3P5MoeVLModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
init_weights() (MatchingZeros method)
(Same method)
initial_disabled_steps (SparseAttentionAttributeConfig attribute)
initialize() (QDQAutotuner method)
initialize_from() (TracedHp class method)
(TracedHpRegistry class method)
initialize_hydra_config() (in module modelopt.torch.puzzletron.tools.hydra_utils)
initialize_hydra_config_for_dir() (in module modelopt.torch.puzzletron.tools.hydra_utils)
InitializerConsumerTracker (class in modelopt.onnx.autocast.precisionconverter)
InitializerRangeRule (class in modelopt.onnx.autocast.nodeclassifier)
inner_size (Mamba2TensorLayout property)
input_artifact (CompiledPostMIPNode attribute)
input_basis (LatentMoETransform attribute)
input_embedding (DecoderLayout attribute)
input_embedding_name() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
input_gate (RgLruConfig attribute)
input_id (CompiledPostMIPNode attribute)
input_ids (PuzzletronBatch property)
input_index (ChildRegionInputInsertionPoint attribute)
(NodeInputInsertionPoint attribute)
(ResolvedInsertionPoint attribute)
input_layernorm (DecoderLayerConfig attribute)
input_quantizer (QuantInputBase attribute)
input_revision_id (NodeObservation attribute)
input_syms (ConcatSymbol property)
InputIndexTracker (class in modelopt.onnx.autocast.precisionconverter)
inputs (StageManifest attribute)
insert_dq_nodes() (in module modelopt.onnx.quantization.qdq_utils)
insert_fp8_mha_casts() (in module modelopt.onnx.quantization.graph_utils)
insert_matmul_casts() (in module modelopt.onnx.quantization.graph_utils)
insert_pre_quant_scale_nodes() (in module modelopt.onnx.quantization.qdq_utils)
insert_qdq_nodes() (in module modelopt.onnx.quantization.qdq_utils)
insert_transpose_nodes_for_column_major() (in module modelopt.onnx.quantization.qdq_utils)
Insertion Scheme
InsertionScheme (class in modelopt.onnx.quantization.autotune)
install_hooks() (SharedQuantState method)
install_pp_checkpoint_state_dict_support() (in module modelopt.torch.puzzletron.distillation.global_kd_recipe)
instances (StageExecutionSpec attribute)
INT4QTensor (class in modelopt.torch.quantization.qtensor.int4_tensor)
INT4QuantExporter (class in modelopt.onnx.export)
int8_to_fp8() (in module modelopt.onnx.quantization.fp8)
INT8QTensor (class in modelopt.torch.quantization.qtensor.int8_tensor)
INT8QuantExporter (class in modelopt.onnx.export)
intermediate_field (GatedDenseFFNContract attribute)
(RoutedMoEContract attribute)
intermediate_size (FFNConfig attribute)
INTERNAL (ErrorKind attribute)
interpret_trt_plugins_precision_flag() (in module modelopt.onnx.trt_utils)
invalid_combinations (ParallelCapabilities attribute)
INVALID_REQUEST (ErrorKind attribute)
invalidate_realization() (in module modelopt.torch.puzzletron.checkpoint_transactions)
InvalidSchemeError
inventory_campaign_artifacts() (in module modelopt.torch.puzzletron.artifact_inventory)
inverse_param_probs() (in module modelopt.torch.puzzletron.pruning.elastic_sampling)
inverse_width_probs() (in module modelopt.torch.puzzletron.pruning.elastic_sampling)
invert() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt)
IORangeRule (class in modelopt.onnx.autocast.nodeclassifier)
is_attention() (in module modelopt.torch.export.layer_utils)
is_attn_sparsified() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
is_available() (in module modelopt.torch.utils.distributed)
is_binary_op() (in module modelopt.onnx.op_types)
is_causal (SparseAttentionAttributeConfig attribute)
is_channels_last() (in module modelopt.torch.utils.network)
is_composite (RegionPattern property)
is_configurable (Hparam property)
is_configurable() (DynamicSpace method)
(in module modelopt.torch.opt.utils)
is_const_input() (in module modelopt.onnx.quantization.graph_utils)
is_constant (ConcatSymbol property)
(Symbol property)
is_control_flow_op() (in module modelopt.onnx.op_types)
is_conv() (in module modelopt.torch.export.layer_utils)
is_conversion_op() (in module modelopt.onnx.op_types)
is_converted() (ModeloptStateManager class method)
is_copy_op() (in module modelopt.onnx.op_types)
is_cross_layer (Symbol property)
is_dangling (Symbol property)
is_data_dependent_shape_op() (in module modelopt.onnx.op_types)
is_decoder_list() (in module modelopt.torch.export.layer_utils)
is_default_quantizable_op_by_ort() (in module modelopt.onnx.op_types)
is_descendant_of() (Region method)
is_diffusers_object() (in module modelopt.torch.export.diffusers_utils)
is_dynamic (Symbol property)
is_dynamic() (DynamicSpace method)
(in module modelopt.torch.opt.utils)
is_embedding() (in module modelopt.torch.export.layer_utils)
is_empty (InsertionScheme property)
(RegionPattern property)
is_enabled (SparseAttentionModule property)
(TensorQuantizer property)
is_export_mode (ExportNASModeDescriptor property)
(ExportPEFTModeDescriptor property)
(ExportSparseModeDescriptor property)
(ExportStudentModeDescriptor property)
(ModeDescriptor property)
is_failed() (GraphCollection method)
(RobustTracer method)
is_free (Symbol property)
is_fused_experts (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
is_fusible_reduction_op() (in module modelopt.onnx.op_types)
is_fusible_scaling_op() (in module modelopt.onnx.op_types)
is_generator_op() (in module modelopt.onnx.op_types)
is_in_safetensors_format() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils)
is_incoming (Symbol property)
is_initialized (NFSWorkspace property)
is_initialized() (DistributedProcessGroup method)
(in module modelopt.torch.utils.distributed)
is_irregular_mem_access_op() (in module modelopt.onnx.op_types)
is_layernorm() (in module modelopt.torch.export.layer_utils)
is_leaf (RegionPattern property)
is_leaf_module() (RobustTracer method)
is_linear() (in module modelopt.torch.export.layer_utils)
is_linear_op() (in module modelopt.onnx.op_types)
is_master() (in module modelopt.torch.utils.distributed)
is_mlp() (in module modelopt.torch.export.layer_utils)
is_modelopt_patches_enabled() (in module modelopt.torch.nas.utils)
is_modifier_op() (in module modelopt.onnx.op_types)
is_moe() (in module modelopt.torch.export.layer_utils)
is_multiclass_op() (in module modelopt.onnx.op_types)
is_multimodal (CampaignModel attribute)
is_multimodal_model() (in module modelopt.torch.export.model_utils)
is_mx_format (TensorQuantizer property)
is_mxfp() (TensorQuantizer method)
is_non_reshape_copy_op() (in module modelopt.onnx.op_types)
is_normalization_op() (in module modelopt.onnx.op_types)
is_nvfp4_static (TensorQuantizer property)
is_outgoing (Symbol property)
is_parallel() (in module modelopt.torch.utils.network)
is_passthrough_weight_name() (ModelDescriptor class method)
is_patched() (PatchManager class method)
is_peft_model() (in module modelopt.torch.peft.convert)
is_pointwise_or_elementwise_op() (in module modelopt.onnx.op_types)
is_pooling_or_window_op() (in module modelopt.onnx.op_types)
is_profiled (InsertionScheme property)
is_qkv_projection() (in module modelopt.torch.export.diffusers_utils)
is_quantized() (in module modelopt.torch.quantization.utils)
is_quantized_column_parallel_linear() (in module modelopt.torch.quantization.utils)
is_quantized_linear() (in module modelopt.torch.quantization.utils)
is_quantized_row_parallel_linear() (in module modelopt.torch.quantization.utils)
is_quantlinear() (in module modelopt.torch.export.layer_utils)
is_recurrent() (in module modelopt.torch.export.layer_utils)
is_recurrent_op() (in module modelopt.onnx.op_types)
is_registered_leaf() (RobustTracer class method)
is_registered_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer)
is_replacement_identical_to_teacher() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
is_running (GPUMemoryMonitor attribute)
is_searchable (ConcatSymbol property)
(Symbol property)
is_selection_op() (in module modelopt.onnx.op_types)
is_sequence_op() (in module modelopt.onnx.op_types)
is_shape_op() (in module modelopt.onnx.op_types)
is_shape_preserving (SymInfo property)
is_shape_preserving() (SymMap method)
is_skippable() (SymDepth method)
is_sortable (Hparam property)
(Symbol property)
is_special_node() (ConcatNodeProcessor method)
is_static_block_quant (TensorQuantizer property)
is_tensorrt_llm_0_8_or_9() (in module modelopt.torch.export.tensorrt_llm_utils)
is_unary_op() (in module modelopt.onnx.op_types)
is_unvisited() (GraphCollection method)
(RobustTracer method)
is_valid_decilm_checkpoint() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
items (WorkPlan attribute)
items() (ModeloptBaseConfig method)
(SymMap method)
iter_num (IterativeSearcher attribute)
iter_safetensor_weight_files() (in module modelopt.torch.puzzletron.pruning.sorted_teacher)
iter_shared_quant_states() (in module modelopt.torch.quantization.utils)
iter_subblocks() (in module modelopt.torch.puzzletron.block_config)
iter_weights_for_calibration() (QuantModule method)
IterativeChannelContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
IterativeSearcher (class in modelopt.torch.nas.autonas)
J
JobHandle (class in modelopt.torch.puzzletron.orchestration)
JobStatus (class in modelopt.torch.puzzletron.orchestration)
json_dump() (in module modelopt.torch.utils.robust_json)
json_dumps() (in module modelopt.torch.utils.robust_json)
json_load() (in module modelopt.torch.utils.robust_json)
K
k (QKVConfig attribute)
k_cache_bias (AttentionConfig attribute)
k_cache_scaling_factor (AttentionConfig attribute)
k_eq_v (AttentionConfig attribute)
k_eq_v_field (StandardGQAAttentionContract attribute)
k_key (LayerLayout attribute)
k_layernorm (AttentionConfig attribute)
K_MROPE (RopeType attribute)
K_NONE (RopeType attribute)
k_proj_name (StandardGQAAttentionContract attribute)
K_ROPE_ROTATE_GPTJ (RopeType attribute)
K_ROPE_ROTATE_NEOX (RopeType attribute)
kd_id (GlobalKDResult attribute)
kd_mask (PuzzletronBatch attribute)
kd_steps (CrossModelCampaign attribute)
kd_weight (GlobalKDConfig attribute)
KDLoss (class in modelopt.torch.puzzletron.distillation.loss)
KDLossTermConfig (class in modelopt.torch.puzzletron.distillation.global_automodel)
keep (HomogeneousPolicy attribute)
keep_mask (AttnRemovalSpec attribute)
(FFNRemovalSpec attribute)
key_dim (GDNPermutation attribute)
key_groups (GDNPermutation attribute)
key_head_dim (GDNShape attribute)
keys() (ModeloptBaseConfig method)
kind (AttentionConfig attribute)
(EvaluationCacheSlot attribute)
(EvaluationError attribute)
(FFNConfig attribute)
(Identity attribute)
(MambaConfig attribute)
(MLAConfig attribute)
(MoEConfig attribute)
(NodeCapabilities attribute)
(RunnerEnvironment attribute)
(SubblockCapabilities attribute)
(SubblockConfig attribute)
(SubblockRef attribute)
(SublayerRemoval attribute)
kl_div() (in module modelopt.torch.puzzletron.utils.validation)
KnowledgeDistillationModeDescriptor (class in modelopt.torch.distill.mode)
KnowledgeDistillationRecipeForNextTokenPrediction (class in modelopt.torch.puzzletron.distillation.global_kd_recipe)
KnowledgeDistillationRecipeForVLM (class in modelopt.torch.puzzletron.distillation.global_kd_recipe)
kv_cache_dtype (AttentionConfig attribute)
kv_heads_field (StandardGQAAttentionContract attribute)
kv_lora_rank (MLAConfig attribute)
kv_lora_rank_field (LatentAttentionContract attribute)
kv_source_layer (AttentionConfig attribute)
KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin)
KVHeadsPruningMixIn (class in modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin)
L
L2NormHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
labels (PuzzletronBatch attribute)
language_config() (DecoderLayout method)
(GenericDecoderContract method)
language_config_path (DecoderLayout attribute)
language_prefix (DecoderLayout attribute)
(PLEPruningSpec attribute)
last_mode (ModeloptStateManager property)
latency_ms (InsertionScheme attribute)
latent_attention (GenericDecoderContract attribute)
latent_dim (MoEConfig attribute)
latent_fc1_name (MoELayerDescriptor attribute)
latent_fc2_name (MoELayerDescriptor attribute)
LatentAttentionContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
LatentMoETensorLayout (class in modelopt.torch.puzzletron.pruning.latent_moe_surgery)
LatentMoETransform (class in modelopt.torch.puzzletron.pruning.latent_moe_surgery)
launch_build_replacement_library() (in module modelopt.torch.puzzletron.replacement_library.build_replacement_library)
launch_bypass_distillation() (in module modelopt.torch.puzzletron.bypass_distillation)
launch_calc_subblock_stats() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats)
launch_iterative_depth_automodel() (in module modelopt.torch.puzzletron.depth)
launch_memory_monitor() (in module modelopt.torch.utils.memory_monitor)
launch_mip_and_realize_model() (in module modelopt.torch.puzzletron.mip.mip_and_realize_models)
launch_realize_model() (in module modelopt.torch.puzzletron.mip.mip_and_realize_models)
launch_score_activations() (in module modelopt.torch.puzzletron.activation_scoring.score_pruning_activations)
launch_scoring() (in module modelopt.torch.puzzletron.scoring)
launcher (TaskTopology attribute)
layer_block_name() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
layer_filter (SearchSpace attribute)
layer_gate_name (PLEContract attribute)
(PLEPruningSpec attribute)
layer_geometry() (StandardGQAAttentionContract method)
layer_idx (Candidate attribute)
(ComposedScoreRecord attribute)
(LayerLayout attribute)
(PrunableAxis attribute)
(SparseSampleRecord attribute)
(SublayerRemoval attribute)
(VariantAxis attribute)
layer_intermediate_size() (GatedDenseFFNContract method)
layer_name_predicates() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
layer_norm_names (DecoderLayout attribute)
layer_override_fields() (StandardGQAAttentionContract method)
layer_path() (DecoderLayout method)
layer_pattern (DecoderLayout property)
layer_prefix() (PLEPruningSpec method)
layer_projection_name (PLEContract attribute)
(PLEPruningSpec attribute)
layer_score_key() (PLEPruningSpec method)
layer_template (DecoderLayout attribute)
(PLEPruningSpec attribute)
layer_types (DecoderLayerConfig attribute)
LayerDescriptor (class in modelopt.torch.puzzletron.pruning.pruning_mixin)
LayerLayout (class in modelopt.torch.puzzletron.pruning.sorted_teacher)
LayerNorm (LayerNormType attribute)
layernorm_type (LayernormConfig attribute)
LayernormConfig (class in modelopt.torch.export.model_config)
LayerNormContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks)
LayerNormPositionType (class in modelopt.torch.export.tensorrt_llm_type)
LayerNormType (class in modelopt.torch.export.tensorrt_llm_type)
layers (ModelConfig attribute)
layerwise (QuantizeAlgorithmConfig attribute)
layerwise_calibrate() (in module modelopt.torch.quantization.model_calib)
layerwise_checkpoint_dir (QuantizeAlgorithmConfig attribute)
LayerwiseDistillationModel (class in modelopt.torch.distill.layerwise_distillation_model)
LayerwiseKDModeDescriptor (class in modelopt.torch.distill.mode)
layout (GenericDecoderContract attribute)
(PuzzletronBatch attribute)
(PuzzletronDataSpec attribute)
LEAF (RegionType attribute)
learn_amax (QuantizerAttributeConfig attribute)
LEASED (AttemptStatus attribute)
leased_at (AttemptRecord attribute)
legacy (VllmMeasurement attribute)
legacy_varlen (PuzzletronDataSpec property)
legal_widths (EmbeddingPruningSpec attribute)
library (StageCapabilities attribute)
Linear (in module modelopt.torch.quantization.nn.modules.quant_linear)
linear (LinearActConfig attribute)
linear_out (RecurrentConfig attribute)
linear_type (LinearConfig attribute)
linear_weight_names (FFNIntermediateLayerDescriptor attribute)
(LlamaFFNIntermediateLayerDescriptor attribute)
(MistralFFNIntermediateLayerDescriptor attribute)
(NemotronHFFNIntermediateLayerDescriptor attribute)
(NemotronHV2FFNIntermediateLayerDescriptor attribute)
(Qwen3FFNIntermediateLayerDescriptor attribute)
(Qwen3P5TextFFNIntermediateLayerDescriptor attribute)
(Qwen3P5VLFFNIntermediateLayerDescriptor attribute)
(Qwen3VLFFNIntermediateLayerDescriptor attribute)
linear_x (RecurrentConfig attribute)
linear_y (RecurrentConfig attribute)
LinearActConfig (class in modelopt.torch.export.model_config)
LinearConfig (class in modelopt.torch.export.model_config)
LinearInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils)
link_to() (ConcatSymbol method)
(ConcatSymbol.Input method)
(Symbol method)
(SymDepth method)
list_closest_to_median() (in module modelopt.torch.utils.list)
list_of_scale_tensors (RealQuantLinear attribute)
list_repo_files_cached() (in module modelopt.torch.utils.nemotron_vlm_dataset_utils)
llama4 (AttentionConfig attribute)
Llama4AttentionConfig (class in modelopt.torch.puzzletron.block_config)
LlamaConverter (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_converter)
LlamaFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor)
LlamaKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor)
LlamaModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor)
LLM (class in modelopt.deploy.llm.generate)
llm_to_onnx() (in module modelopt.onnx.llm_export_utils.export_utils)
lm_head (MedusaHeadConfig attribute)
(ModelConfig attribute)
LmmsEvalTimeoutError
ln_embed (ModelConfig attribute)
ln_f (ModelConfig attribute)
load() (PatternCache class method)
load_and_shard_model() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils)
load_block_configs_from_checkpoint() (in module modelopt.torch.puzzletron.candidates)
load_calib_amax() (TensorQuantizer method)
load_calib_bias() (TensorQuantizer method)
load_campaign() (in module modelopt.torch.puzzletron.campaigns)
load_candidate_set() (CandidateLedger method)
load_config() (in module modelopt.torch.fastgen.loader)
(in module modelopt.torch.opt.config_loader)
load_cpp_extension() (in module modelopt.torch.utils.cpp_extension)
load_dmd_config() (in module modelopt.torch.fastgen.loader)
load_json() (in module modelopt.torch.puzzletron.utils.misc)
load_materialized_conversation_dataset() (in module modelopt.torch.puzzletron.dataset)
load_materialized_conversation_subset() (in module modelopt.torch.puzzletron.dataset)
load_materialized_intersyn_subset() (in module modelopt.torch.puzzletron.dataset)
load_model() (ModelLoader method)
(ReplacementLibrary method)
load_model_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
(in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
load_model_with_shape_infer() (in module modelopt.onnx.quantization.ort_patching)
load_modelopt_state() (in module modelopt.torch.opt.conversion)
load_onnx_model() (in module modelopt.onnx.trt_utils)
load_passthrough_state_dict() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
load_puzzle_solutions() (in module modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements)
load_runtime_hydra_config() (in module modelopt.torch.puzzletron.pipeline_config)
load_scoring_parent() (in module modelopt.torch.puzzletron.scoring_parent)
load_search_checkpoint() (BaseSearcher method)
(BinarySearcher method)
load_search_space() (in module modelopt.torch.puzzletron.search_space)
load_sharded_state_dict() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils)
load_state_dict() (DistillationModel method)
(ExponentialMovingAverage method)
(ForwardHook method)
(in module modelopt.torch.puzzletron.tools.checkpoint_utils)
(IndependentChannelContributionHook method)
(IndependentKvHeadContributionHook method)
(IterativeChannelContributionHook method)
(L2NormHook method)
(LayerNormContributionHook method)
(ModeloptStateManager method)
(RankedChoiceVotingHook method)
(RemoveExpertsIndependentHook method)
load_state_dict_post_hook() (DummyModule static method)
load_stats_identity_cache() (in module modelopt.torch.puzzletron.candidates)
load_vlm_or_llm() (in module modelopt.torch.speculative.utils)
local() (EvaluationClient class method)
local_batch_size (GlobalKDConfig attribute)
local_cu_seqlens (PackedSequenceMetadata attribute)
local_gpu_ids (WorkItem attribute)
local_hessian_calibrate() (in module modelopt.torch.quantization.model_calib)
local_kd_subblock_module_paths() (GenericContractModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
local_vocab_size (EmbeddingConfig property)
log_batch_hashes() (in module modelopt.torch.puzzletron.utils.sample_hash)
log_path (CommandSpec attribute)
log_paths (JobStatus attribute)
logger (in module modelopt.torch.puzzletron.tools)
logits_soft_cap (DecoderLayerConfig attribute)
LogitsDistillationLoss (class in modelopt.torch.distill.losses)
longrope_long_mscale (DecoderLayerConfig attribute)
longrope_scaling_long_factors (DecoderLayerConfig attribute)
longrope_scaling_short_factors (DecoderLayerConfig attribute)
longrope_short_mscale (DecoderLayerConfig attribute)
lookup() (AsyncEvaluationClient method)
(EvaluationClient method)
lora_a_init (PEFTAttributeConfig attribute)
lora_b_init (PEFTAttributeConfig attribute)
LoRAModule (class in modelopt.torch.peft.lora.layer)
loss_balancer (DistillationModel property)
(KDLossConfig attribute)
loss_modules (DistillationModel property)
LossMaskRecovery (class in modelopt.torch.utils.loss_mask)
low_precision_nodes (InitializerConsumerTracker attribute)
LowMemorySparseTensor (class in modelopt.torch.puzzletron.utils.validation)
lowrank (SVDQuantConfig attribute)
lr (GlobalKDConfig attribute)
lstm_cell_with_proj() (in module modelopt.torch.quantization.nn.modules.quant_rnn)
M
m4n2_1d() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
magnitude_fallback (AxisCapabilities attribute)
MagnitudeFallbackSpec (class in modelopt.torch.puzzletron.anymodel.capabilities)
MagnitudeSearcher (class in modelopt.torch.sparsity.weight_sparsity.magnitude)
main() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm)
(in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
(in module modelopt.torch.puzzletron.artifact_inventory)
main_ce_weight (GlobalKDConfig attribute)
main_kd (GlobalKDConfig attribute)
main_kd_weight (GlobalKDConfig attribute)
make_causal_mask() (in module modelopt.torch.speculative.eagle.utils)
make_divisible() (in module modelopt.torch.utils.network)
make_gs_awq_scale() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_dequantize_node() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_dequantize_output() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_pre_quant_scale_node() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_pre_quant_scale_output() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_quantize_node() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_quantize_output() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_quantized_weight() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_scale() (in module modelopt.onnx.quantization.qdq_utils)
make_gs_zp() (in module modelopt.onnx.quantization.qdq_utils)
make_patched_init() (AutoModelDescriptor class method)
make_puzzletron_chat_dataset() (in module modelopt.torch.puzzletron.distillation.dataset)
make_puzzletron_llm_dataset() (in module modelopt.torch.puzzletron.distillation.dataset)
make_puzzletron_llm_overfit_dataset() (in module modelopt.torch.puzzletron.distillation.dataset)
make_synthetic_llm_dataset() (in module modelopt.torch.puzzletron.distillation.synthetic_vlm)
make_synthetic_vlm_dataset() (in module modelopt.torch.puzzletron.distillation.synthetic_vlm)
mamba2_projected_prefix_mask() (in module modelopt.torch.puzzletron.pruning.mamba2_surgery)
Mamba2TensorLayout (class in modelopt.torch.puzzletron.pruning.mamba2_surgery)
mamba_a_key (LayerLayout attribute)
mamba_cache (ExportCapabilities attribute)
mamba_conv_bias_key (LayerLayout attribute)
mamba_conv_key (LayerLayout attribute)
mamba_d_key (LayerLayout attribute)
mamba_dt_bias_key (LayerLayout attribute)
mamba_head_dim (LayerLayout attribute)
mamba_in_key (LayerLayout attribute)
mamba_norm_key (LayerLayout attribute)
mamba_num_groups (LayerLayout attribute)
mamba_num_heads (LayerLayout attribute)
mamba_out_key (LayerLayout attribute)
mamba_prefix (LayerLayout attribute)
mamba_prefix() (MambaLayerDescriptor method)
mamba_prefix_name (MambaLayerDescriptor attribute)
(NemotronHMambaLayerDescriptor attribute)
mamba_state_dim (LayerLayout attribute)
MambaConfig (class in modelopt.torch.puzzletron.block_config)
MambaLayerDescriptor (class in modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin)
MambaPruningMixIn (class in modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin)
managed_attrs (SharedQuantState attribute)
(SharedWeightGlobalAmaxState attribute)
manifest (EvaluationCacheSlot attribute)
manifest_path (EvaluationCacheSlot property)
(StageResult attribute)
ManualFilterNode (class in modelopt.torch.puzzletron.post_mip.builtin)
match() (in module modelopt.torch.utils.graph)
match_fp8_mha_pattern() (in module modelopt.onnx.quantization.graph_utils)
matches() (RegionPattern method)
(TensorAxisRule method)
matches_pattern() (in module modelopt.torch.utils.regex)
MatchingZeros (class in modelopt.torch.puzzletron.anymodel.puzzformer.no_op)
materialize (StageCapabilities attribute)
materialize_checkpoint() (ReplacementLibrary method)
materialize_checkpoint_from_sorted() (in module modelopt.torch.puzzletron.pruning.materialize)
materialize_hidden_width_checkpoint() (in module modelopt.torch.puzzletron.pruning.materialize)
materialize_impl (AxisCapabilities attribute)
materialize_intersyn_subset() (in module modelopt.torch.puzzletron.dataset)
materialize_model_from_sorted() (in module modelopt.torch.puzzletron.pruning.materialize)
materialize_nemotron_vlm_dataset() (in module modelopt.torch.puzzletron.dataset)
materialize_normalized_conversation_samples() (in module modelopt.torch.puzzletron.dataset)
materialize_normalized_intersyn_samples() (in module modelopt.torch.puzzletron.dataset)
materialize_puzzle_kd_dataset() (in module modelopt.torch.puzzletron.dataset)
materialize_solution_state_dict() (in module modelopt.torch.puzzletron.pruning.materialize)
MaterializeNode (class in modelopt.torch.puzzletron.post_mip.builtin)
max (Hparam property)
max_beam_width (LLM property)
max_calibrate() (in module modelopt.torch.quantization.model_calib)
max_co_batch_size (AWQClipCalibConfig attribute)
max_degrade (BinarySearcher attribute)
max_depth (SymDepth property)
max_entries_per_pattern (PatternCache attribute)
max_num_seqs (RuntimeConfig attribute)
(VllmMeasurement attribute)
max_pairwise_per_family (SparseSamplingPolicy attribute)
max_position_embeddings (DecoderLayerConfig attribute)
(ModelConfig property)
max_sample_length (PuzzletronDataSpec attribute)
max_seconds_per_solution (SolverOptions attribute)
max_seq_len (LLM property)
max_seqlen (CalibrationConfig attribute)
(PackedSequenceMetadata attribute)
max_shards_per_subset (VlmAcquisitionSpec attribute)
max_steps (GlobalKDConfig attribute)
max_t (SampleTimestepConfig attribute)
max_tokens_per_batch (AWQClipCalibConfig attribute)
max_val (TensorStats attribute)
max_value (AxisSearchConfig attribute)
maxbound (TensorQuantizer property)
MaxCalibrator (class in modelopt.torch.quantization.calib.max)
maximum (ProfileConstraint attribute)
maximum_generation_attempts (Config attribute)
maximum_mutations (Config attribute)
maximum_sequence_region_size (Config attribute)
MaxPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
MaxPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
MaxPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling)
maybe_cast_block_configs() (in module modelopt.torch.puzzletron.block_config)
maybe_transpose_expert_weight_dimensions() (in module modelopt.torch.export.quant_utils)
mean() (RuntimeMeasurement class method)
measurement_id (VllmMeasurement attribute)
measurement_workload() (in module modelopt.torch.puzzletron.subblock_stats.measurements)
media_counts (PackedSequenceMetadata attribute)
media_offsets (PackedSequenceMetadata attribute)
median_measurement() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
medusa_heads (ModelConfig attribute)
medusa_layers (MedusaHeadConfig attribute)
medusa_num_heads (MedusaConfig attribute)
medusa_num_layers (MedusaConfig attribute)
MedusaHeadConfig (class in modelopt.torch.export.model_config)
MedusaModeDescriptor (class in modelopt.torch.speculative.mode)
MedusaModel (class in modelopt.torch.speculative.medusa.medusa_model)
members (SharedQuantState property)
merge() (PatternCache method)
(Region method)
merge_diffusion_checkpoint() (in module modelopt.torch.export.diffusers_utils)
merge_gate_fc (MLPConfig attribute)
merge_gate_fc() (in module modelopt.torch.export.model_config_utils)
merge_qkv() (in module modelopt.torch.export.model_config_utils)
mesh_override (StageExecutionSpec attribute)
message (EvaluationError attribute)
(StageResult attribute)
metadata (AttemptRecord attribute)
(AttemptSpec attribute)
(AxisSearchConfig attribute)
(CampaignManifest attribute)
(Candidate attribute)
(CandidateLibrary attribute)
(EvaluationRequest attribute)
(EvaluationResult attribute)
(GlobalKDConfig attribute)
(JobHandle attribute)
(WorkItem attribute)
metadata() (SharedQuantState class method)
method (AWQClipCalibConfig attribute)
(AWQFullCalibConfig attribute)
(AWQLiteCalibConfig attribute)
(GPTQCalibConfig attribute)
(LocalHessianCalibConfig attribute)
(MaxCalibConfig attribute)
(MseCalibConfig attribute)
(QuantizeAlgorithmConfig attribute)
(SmoothQuantCalibConfig attribute)
(SparseAttentionAttributeConfig attribute)
(SVDQuantConfig attribute)
(VSAAttributeConfig attribute)
method_name (AutoQuantizeGradientSearcher attribute)
(AutoQuantizeKLDivSearcher attribute)
metric (DepthScenario attribute)
(KDLoss attribute)
(KDLossTermConfig attribute)
(ObjectiveSpec attribute)
(ProfileConstraint attribute)
(TVDLoss attribute)
metric_references (CompiledPostMIPNode attribute)
metric_references() (FilterNode class method)
(PostMIPNode class method)
metrics (BenchmarkResult attribute)
(CampaignManifest attribute)
(ComposedScoreRecord attribute)
(EvaluationRequest attribute)
(EvaluationResult attribute)
,
[1]
(GlobalKDResult attribute)
(NodeObservation attribute)
MFTLoss (class in modelopt.torch.distill.losses)
MGDLoss (class in modelopt.torch.distill.losses)
middle_value (BinarySearcher attribute)
min (Hparam property)
min_clip_ratio (AWQClipCalibConfig attribute)
min_degrade (BinarySearcher attribute)
min_depth (SymDepth property)
min_hamming_distance (SolverOptions attribute)
min_t (SampleTimestepConfig attribute)
min_val (TensorStats attribute)
min_value (AxisSearchConfig attribute)
minimum (ProfileConstraint attribute)
minimum_distance (PatternCache attribute)
minimum_schemes_to_mutate (Config attribute)
minimum_topdown_search_size (Config attribute)
mip (StageCapabilities attribute)
mip_execution_identity() (in module modelopt.torch.puzzletron.identity)
mip_identity() (in module modelopt.torch.puzzletron.identity)
mip_metrics (ArchitectureCandidate attribute)
mip_stage() (in module modelopt.torch.puzzletron.stages)
MIPProfile (class in modelopt.torch.puzzletron.mip.profiles)
missing (CoverageRow attribute)
MistralFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor)
MistralKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor)
MistralSmallConverter (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter)
MistralSmallModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor)
mla_kv_a_key (LayerLayout attribute)
mla_kv_b_key (LayerLayout attribute)
mla_kv_lora_rank (LayerLayout attribute)
mla_kv_norm_key (LayerLayout attribute)
mla_num_heads (LayerLayout attribute)
mla_o_key (LayerLayout attribute)
mla_prefix (LayerLayout attribute)
mla_q_a_key (LayerLayout attribute)
mla_q_b_key (LayerLayout attribute)
mla_q_lora_rank (LayerLayout attribute)
mla_q_norm_key (LayerLayout attribute)
MLAConfig (class in modelopt.torch.puzzletron.block_config)
mlp (DecoderLayerConfig attribute)
MLP (MLPType attribute)
mlp_layernorm (DecoderLayerConfig attribute)
mlp_no_op_post_init() (AutoModelDescriptor static method)
(GenericContractModelDescriptor static method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
mlp_no_op_supported() (ModelDescriptor class method)
mlp_replacing_linear (DecoderLayerConfig attribute)
MLPConfig (class in modelopt.torch.export.model_config)
MlpInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils)
MLPType (class in modelopt.torch.export.tensorrt_llm_type)
mn_1d_best() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
Modality (class in modelopt.torch.puzzletron.dataset)
modality (PuzzletronBatch attribute)
(PuzzletronDataSpec attribute)
mode (EMAConfig attribute)
(SparseSampleManifest attribute)
ModeDescriptor (class in modelopt.torch.opt.mode)
model (BaseSearcher attribute)
(CampaignManifest attribute)
(EvaluationRequest attribute)
model_config (ReplacementLibrary property)
model_config_fields (RuntimeConfig attribute)
model_config_from_dict() (in module modelopt.torch.export.model_config_utils)
model_config_to_dict() (in module modelopt.torch.export.model_config_utils)
model_config_value() (RuntimeConfig method)
model_dump() (KDLossConfig method)
(ModeloptBaseConfig method)
model_dump_json() (ModeloptBaseConfig method)
model_embedding_name (PLEContract attribute)
(PLEPruningSpec attribute)
model_family (GenericDecoderContract attribute)
(PuzzletronCapabilities attribute)
model_hidden_sizes (VllmMeasurement attribute)
model_id (CampaignModel attribute)
(CampaignStageIdentity attribute)
model_identity() (in module modelopt.torch.puzzletron.identity)
model_kind (CampaignModel attribute)
model_kwargs (PuzzletronBatch attribute)
model_norm_name (PLEContract attribute)
(PLEPruningSpec attribute)
model_projection_name (PLEContract attribute)
(PLEPruningSpec attribute)
model_source (CompiledPostMIPNode attribute)
model_to() (in module modelopt.torch.utils.network)
model_type_is_enc_dec() (in module modelopt.torch.export.layer_utils)
ModelConfig (class in modelopt.torch.export.model_config)
ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.model_descriptor.base)
ModelDescriptorFactory (class in modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory)
ModelKind (class in modelopt.torch.puzzletron.campaigns)
ModelLoader (class in modelopt.onnx.llm_export_utils.export_utils)
modelopt.deploy
module
modelopt.deploy.llm
module
modelopt.deploy.llm.generate
module
modelopt.onnx
module
modelopt.onnx.autocast
module
modelopt.onnx.autocast.convert
module
modelopt.onnx.autocast.graphsanitizer
module
modelopt.onnx.autocast.logging_config
module
modelopt.onnx.autocast.nodeclassifier
module
modelopt.onnx.autocast.precisionconverter
module
modelopt.onnx.autocast.referencerunner
module
modelopt.onnx.autocast.utils
module
modelopt.onnx.export
module
modelopt.onnx.graph_surgery
module
modelopt.onnx.llm_export_utils
module
modelopt.onnx.llm_export_utils.export_utils
module
modelopt.onnx.llm_export_utils.quantization_utils
module
modelopt.onnx.llm_export_utils.surgeon_utils
module
modelopt.onnx.logging_config
module
modelopt.onnx.op_types
module
modelopt.onnx.quantization
module
modelopt.onnx.quantization.autotune
module
modelopt.onnx.quantization.calib_utils
module
modelopt.onnx.quantization.extensions
module
modelopt.onnx.quantization.fp8
module
modelopt.onnx.quantization.graph_utils
module
modelopt.onnx.quantization.gs_patching
module
modelopt.onnx.quantization.int4
module
modelopt.onnx.quantization.int8
module
modelopt.onnx.quantization.operators
module
modelopt.onnx.quantization.ort_patching
module
modelopt.onnx.quantization.ort_utils
module
modelopt.onnx.quantization.partitioning
module
modelopt.onnx.quantization.qdq_utils
module
modelopt.onnx.quantization.quant_utils
module
modelopt.onnx.trt_utils
module
modelopt.onnx.utils
module
modelopt.torch
module
modelopt.torch.distill
module
modelopt.torch.distill.config
module
modelopt.torch.distill.distillation
module
modelopt.torch.distill.distillation_model
module
modelopt.torch.distill.layerwise_distillation_model
module
modelopt.torch.distill.loss_balancers
module
modelopt.torch.distill.losses
module
modelopt.torch.distill.mode
module
modelopt.torch.distill.plugins
module
modelopt.torch.distill.registry
module
modelopt.torch.export
module
modelopt.torch.export.convert_hf_config
module
modelopt.torch.export.diffusers_utils
module
modelopt.torch.export.distribute
module
modelopt.torch.export.hf_config_map
module
modelopt.torch.export.layer_utils
module
modelopt.torch.export.mcore_config_map
module
modelopt.torch.export.model_config
module
modelopt.torch.export.model_config_export
module
modelopt.torch.export.model_config_utils
module
modelopt.torch.export.model_utils
module
modelopt.torch.export.moe_utils
module
modelopt.torch.export.plugins
module
modelopt.torch.export.postprocess
module
modelopt.torch.export.quant_utils
module
modelopt.torch.export.tensorrt_llm_type
module
modelopt.torch.export.tensorrt_llm_utils
module
modelopt.torch.export.transformer_engine
module
modelopt.torch.export.unified_export_hf
module
modelopt.torch.export.unified_export_megatron
module
modelopt.torch.fastgen
module
modelopt.torch.fastgen.config
module
modelopt.torch.fastgen.discriminators
module
modelopt.torch.fastgen.ema
module
modelopt.torch.fastgen.factory
module
modelopt.torch.fastgen.flow_matching
module
modelopt.torch.fastgen.loader
module
modelopt.torch.fastgen.losses
module
modelopt.torch.fastgen.methods
module
modelopt.torch.fastgen.methods.dmd
module
modelopt.torch.fastgen.pipeline
module
modelopt.torch.fastgen.plugins
module
modelopt.torch.fastgen.utils
module
modelopt.torch.kernels
module
modelopt.torch.kernels.common
module
modelopt.torch.kernels.common.attention
module
modelopt.torch.kernels.quantization
module
modelopt.torch.kernels.quantization.attention
module
modelopt.torch.kernels.quantization.conv
module
modelopt.torch.kernels.quantization.conv.bench_implicit_gemm
module
modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda
module
modelopt.torch.kernels.quantization.gemm
module
modelopt.torch.kernels.quantization.gemm.fp4_kernel
module
modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper
module
modelopt.torch.kernels.quantization.gemm.fp8_kernel
module
modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel
module
modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep
module
modelopt.torch.kernels.quantization.gemm.nvfp4_quant
module
modelopt.torch.kernels.sparsity
module
modelopt.torch.kernels.sparsity.attention
module
modelopt.torch.kernels.sparsity.gemm
module
modelopt.torch.nas
module
modelopt.torch.nas.algorithms
module
modelopt.torch.nas.autonas
module
modelopt.torch.nas.conversion
module
modelopt.torch.nas.hparams
module
modelopt.torch.nas.hparams.concat
module
modelopt.torch.nas.hparams.container
module
modelopt.torch.nas.modules
module
modelopt.torch.nas.modules.container
module
modelopt.torch.nas.modules.conv
module
modelopt.torch.nas.modules.linear
module
modelopt.torch.nas.modules.norm
module
modelopt.torch.nas.modules.utils
module
modelopt.torch.nas.patch
module
modelopt.torch.nas.plugins
module
modelopt.torch.nas.registry
module
modelopt.torch.nas.search_space
module
modelopt.torch.nas.traced_hp
module
modelopt.torch.nas.utils
module
modelopt.torch.opt
module
modelopt.torch.opt.config
module
modelopt.torch.opt.config_loader
module
modelopt.torch.opt.conversion
module
modelopt.torch.opt.dynamic
module
modelopt.torch.opt.hparam
module
modelopt.torch.opt.mode
module
modelopt.torch.opt.plugins
module
modelopt.torch.opt.plugins.huggingface
module
modelopt.torch.opt.searcher
module
modelopt.torch.opt.utils
module
modelopt.torch.peft
module
modelopt.torch.peft.config
module
modelopt.torch.peft.conversion
module
modelopt.torch.peft.convert
module
modelopt.torch.peft.custom
module
modelopt.torch.peft.lora
module
modelopt.torch.peft.lora.layer
module
modelopt.torch.peft.lora.plugins
module
modelopt.torch.peft.mode
module
modelopt.torch.prune
module
modelopt.torch.prune.fastnas
module
modelopt.torch.prune.importance_hooks
module
modelopt.torch.prune.importance_hooks.base_hooks
module
modelopt.torch.prune.importance_hooks.base_hooks_analysis
module
modelopt.torch.prune.importance_hooks.compare_module_outputs
module
modelopt.torch.prune.importance_hooks.expert_removal_hooks
module
modelopt.torch.prune.importance_hooks.plugins
module
modelopt.torch.prune.plugins
module
modelopt.torch.prune.pruning
module
modelopt.torch.puzzletron
module
modelopt.torch.puzzletron.activation_scoring
module
modelopt.torch.puzzletron.activation_scoring.activation_hooks
module
modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils
module
modelopt.torch.puzzletron.activation_scoring.score_pruning_activations
module
modelopt.torch.puzzletron.anymodel
module
modelopt.torch.puzzletron.anymodel.automodel
module
modelopt.torch.puzzletron.anymodel.capabilities
module
modelopt.torch.puzzletron.anymodel.converter
module
modelopt.torch.puzzletron.anymodel.converter.base
module
modelopt.torch.puzzletron.anymodel.converter.convert_any_model
module
modelopt.torch.puzzletron.anymodel.converter.converter_factory
module
modelopt.torch.puzzletron.anymodel.converter.generic_decoder
module
modelopt.torch.puzzletron.anymodel.model_descriptor
module
modelopt.torch.puzzletron.anymodel.model_descriptor.base
module
modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory
module
modelopt.torch.puzzletron.anymodel.models
module
modelopt.torch.puzzletron.anymodel.models.generic_decoder
module
modelopt.torch.puzzletron.anymodel.models.gpt_oss
module
modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter
module
modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.llama
module
modelopt.torch.puzzletron.anymodel.models.llama.llama_converter
module
modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.mistral_small
module
modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter
module
modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter
module
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.qwen2
module
modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter
module
modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.qwen3
module
modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter
module
modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.qwen3_5
module
modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_converter
module
modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor
module
modelopt.torch.puzzletron.anymodel.models.qwen3_vl
module
modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter
module
modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor
module
modelopt.torch.puzzletron.anymodel.puzzformer
module
modelopt.torch.puzzletron.anymodel.puzzformer.no_op
module
modelopt.torch.puzzletron.anymodel.puzzformer.patcher
module
modelopt.torch.puzzletron.anymodel.registry
module
modelopt.torch.puzzletron.artifact_coverage
module
modelopt.torch.puzzletron.artifact_import
module
modelopt.torch.puzzletron.artifact_import_contract
module
modelopt.torch.puzzletron.artifact_inventory
module
modelopt.torch.puzzletron.benchmarks
module
modelopt.torch.puzzletron.block_config
module
modelopt.torch.puzzletron.bypass_distillation
module
modelopt.torch.puzzletron.campaigns
module
modelopt.torch.puzzletron.candidates
module
modelopt.torch.puzzletron.checkpoint_transactions
module
modelopt.torch.puzzletron.dataset
module
modelopt.torch.puzzletron.depth
module
modelopt.torch.puzzletron.diagnostics
module
modelopt.torch.puzzletron.distillation
module
modelopt.torch.puzzletron.distillation.dataset
module
modelopt.torch.puzzletron.distillation.flash_kld
module
modelopt.torch.puzzletron.distillation.global_automodel
module
modelopt.torch.puzzletron.distillation.global_kd_recipe
module
modelopt.torch.puzzletron.distillation.loss
module
modelopt.torch.puzzletron.distillation.synthetic_vlm
module
modelopt.torch.puzzletron.distillation.tournament
module
modelopt.torch.puzzletron.distributed_eval
module
modelopt.torch.puzzletron.evaluation
module
modelopt.torch.puzzletron.evaluation.lmms
module
modelopt.torch.puzzletron.execution_record
module
modelopt.torch.puzzletron.export
module
modelopt.torch.puzzletron.export.vllm
module
modelopt.torch.puzzletron.granularity
module
modelopt.torch.puzzletron.identity
module
modelopt.torch.puzzletron.manifest
module
modelopt.torch.puzzletron.mip
module
modelopt.torch.puzzletron.mip.grid_budgeting
module
modelopt.torch.puzzletron.mip.mip_and_realize_models
module
modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements
module
modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements_cuopt
module
modelopt.torch.puzzletron.mip.profiles
module
modelopt.torch.puzzletron.mip.run_puzzle
module
modelopt.torch.puzzletron.mip.search_space
module
modelopt.torch.puzzletron.mip.solver_backend
module
modelopt.torch.puzzletron.mip.sweep
module
modelopt.torch.puzzletron.mip.utils
module
modelopt.torch.puzzletron.orchestration
module
modelopt.torch.puzzletron.pipeline_config
module
modelopt.torch.puzzletron.plugins
module
modelopt.torch.puzzletron.post_mip
module
modelopt.torch.puzzletron.post_mip.base
module
modelopt.torch.puzzletron.post_mip.builtin
module
modelopt.torch.puzzletron.post_mip.filters
module
modelopt.torch.puzzletron.post_mip.identity
module
modelopt.torch.puzzletron.post_mip.records
module
modelopt.torch.puzzletron.post_mip.reporting
module
modelopt.torch.puzzletron.post_mip.runner
module
modelopt.torch.puzzletron.pruning
module
modelopt.torch.puzzletron.pruning.attention_ffn_surgery
module
modelopt.torch.puzzletron.pruning.compact_runtime
module
modelopt.torch.puzzletron.pruning.dynamic_block_prune
module
modelopt.torch.puzzletron.pruning.elastic_sampling
module
modelopt.torch.puzzletron.pruning.embedding_pruning
module
modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin
module
modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin
module
modelopt.torch.puzzletron.pruning.gated_delta_net
module
modelopt.torch.puzzletron.pruning.gated_delta_net_pruning_mixin
module
modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin
module
modelopt.torch.puzzletron.pruning.latent_moe_surgery
module
modelopt.torch.puzzletron.pruning.mamba2_surgery
module
modelopt.torch.puzzletron.pruning.materialize
module
modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin
module
modelopt.torch.puzzletron.pruning.ple_pruning
module
modelopt.torch.puzzletron.pruning.pruning_mixin
module
modelopt.torch.puzzletron.pruning.pruning_utils
module
modelopt.torch.puzzletron.pruning.runtime_candidate
module
modelopt.torch.puzzletron.pruning.runtime_hidden_width
module
modelopt.torch.puzzletron.pruning.runtime_ple
module
modelopt.torch.puzzletron.pruning.sorted_teacher
module
modelopt.torch.puzzletron.replacement_library
module
modelopt.torch.puzzletron.replacement_library.build_replacement_library
module
modelopt.torch.puzzletron.replacement_library.library
module
modelopt.torch.puzzletron.replacement_library.replacement_utils
module
modelopt.torch.puzzletron.replacement_library.score_composition
module
modelopt.torch.puzzletron.replacement_library.subblock_scoring
module
modelopt.torch.puzzletron.rpc_eval
module
modelopt.torch.puzzletron.rpc_eval.cache
module
modelopt.torch.puzzletron.rpc_eval.metadata
module
modelopt.torch.puzzletron.rpc_eval.service
module
modelopt.torch.puzzletron.sampling
module
modelopt.torch.puzzletron.scenarios
module
modelopt.torch.puzzletron.scoring
module
modelopt.torch.puzzletron.scoring_parent
module
modelopt.torch.puzzletron.search_space
module
modelopt.torch.puzzletron.security_policy
module
modelopt.torch.puzzletron.solution_registry
module
modelopt.torch.puzzletron.stage_runner
module
modelopt.torch.puzzletron.stages
module
modelopt.torch.puzzletron.subblock_stats
module
modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats
module
modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory
module
modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats
module
modelopt.torch.puzzletron.subblock_stats.measurements
module
modelopt.torch.puzzletron.subblock_stats.runtime_estimator
module
modelopt.torch.puzzletron.subblock_stats.runtime_utils
module
modelopt.torch.puzzletron.subblock_stats.runtime_vllm
module
modelopt.torch.puzzletron.subblock_stats.topology
module
modelopt.torch.puzzletron.tools
module
modelopt.torch.puzzletron.tools.bypassed_training
module
modelopt.torch.puzzletron.tools.bypassed_training.child_init
module
modelopt.torch.puzzletron.tools.checkpoint_utils
module
modelopt.torch.puzzletron.tools.checkpoint_utils_hf
module
modelopt.torch.puzzletron.tools.common
module
modelopt.torch.puzzletron.tools.hydra_utils
module
modelopt.torch.puzzletron.tools.kd_model
module
modelopt.torch.puzzletron.tools.sharded_checkpoint_utils
module
modelopt.torch.puzzletron.tools.validate_model
module
modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements
module
modelopt.torch.puzzletron.tools.validation_utils
module
modelopt.torch.puzzletron.utils
module
modelopt.torch.puzzletron.utils.data
module
modelopt.torch.puzzletron.utils.data.dataloaders
module
modelopt.torch.puzzletron.utils.data.dataset
module
modelopt.torch.puzzletron.utils.data.packed_memmap
module
modelopt.torch.puzzletron.utils.distributed_object
module
modelopt.torch.puzzletron.utils.dummy_modules
module
modelopt.torch.puzzletron.utils.flash_kd
module
modelopt.torch.puzzletron.utils.misc
module
modelopt.torch.puzzletron.utils.parsing
module
modelopt.torch.puzzletron.utils.sample_hash
module
modelopt.torch.puzzletron.utils.validation
module
modelopt.torch.puzzletron.utils.vllm_adapter
module
modelopt.torch.quantization
module
modelopt.torch.quantization.algorithms
module
modelopt.torch.quantization.backends
module
modelopt.torch.quantization.backends.utils
module
modelopt.torch.quantization.calib
module
modelopt.torch.quantization.calib.bias
module
modelopt.torch.quantization.calib.calibrator
module
modelopt.torch.quantization.calib.histogram
module
modelopt.torch.quantization.calib.max
module
modelopt.torch.quantization.calib.mse
module
modelopt.torch.quantization.config
module
modelopt.torch.quantization.conversion
module
modelopt.torch.quantization.export_onnx
module
modelopt.torch.quantization.extensions
module
modelopt.torch.quantization.mode
module
modelopt.torch.quantization.model_calib
module
modelopt.torch.quantization.model_quant
module
modelopt.torch.quantization.nn
module
modelopt.torch.quantization.nn.functional
module
modelopt.torch.quantization.nn.modules
module
modelopt.torch.quantization.nn.modules.quant_activations
module
modelopt.torch.quantization.nn.modules.quant_batchnorm
module
modelopt.torch.quantization.nn.modules.quant_conv
module
modelopt.torch.quantization.nn.modules.quant_embedding
module
modelopt.torch.quantization.nn.modules.quant_instancenorm
module
modelopt.torch.quantization.nn.modules.quant_layernorm
module
modelopt.torch.quantization.nn.modules.quant_linear
module
modelopt.torch.quantization.nn.modules.quant_module
module
modelopt.torch.quantization.nn.modules.quant_pooling
module
modelopt.torch.quantization.nn.modules.quant_rnn
module
modelopt.torch.quantization.nn.modules.tensor_quantizer
module
modelopt.torch.quantization.plugins
module
modelopt.torch.quantization.qtensor
module
modelopt.torch.quantization.qtensor.base_qtensor
module
modelopt.torch.quantization.qtensor.fp8_tensor
module
modelopt.torch.quantization.qtensor.int4_tensor
module
modelopt.torch.quantization.qtensor.int8_tensor
module
modelopt.torch.quantization.qtensor.mxfp4_tensor
module
modelopt.torch.quantization.qtensor.mxfp8_tensor
module
modelopt.torch.quantization.qtensor.nf4_tensor
module
modelopt.torch.quantization.qtensor.nvfp4_tensor
module
modelopt.torch.quantization.tensor_quant
module
modelopt.torch.quantization.utils
module
modelopt.torch.sparsity
module
modelopt.torch.sparsity.attention_sparsity
module
modelopt.torch.sparsity.attention_sparsity.calibration
module
modelopt.torch.sparsity.attention_sparsity.config
module
modelopt.torch.sparsity.attention_sparsity.conversion
module
modelopt.torch.sparsity.attention_sparsity.methods
module
modelopt.torch.sparsity.attention_sparsity.mode
module
modelopt.torch.sparsity.attention_sparsity.model_sparsify
module
modelopt.torch.sparsity.attention_sparsity.plugins
module
modelopt.torch.sparsity.attention_sparsity.sparse_attention
module
modelopt.torch.sparsity.attention_sparsity.stats_manager
module
modelopt.torch.sparsity.attention_sparsity.utils
module
modelopt.torch.sparsity.weight_sparsity
module
modelopt.torch.sparsity.weight_sparsity.config
module
modelopt.torch.sparsity.weight_sparsity.magnitude
module
modelopt.torch.sparsity.weight_sparsity.mode
module
modelopt.torch.sparsity.weight_sparsity.module
module
modelopt.torch.sparsity.weight_sparsity.plugins
module
modelopt.torch.sparsity.weight_sparsity.searcher
module
modelopt.torch.sparsity.weight_sparsity.sparsegpt
module
modelopt.torch.sparsity.weight_sparsity.sparsification
module
modelopt.torch.speculative
module
modelopt.torch.speculative.config
module
modelopt.torch.speculative.dflash
module
modelopt.torch.speculative.dflash.conversion
module
modelopt.torch.speculative.dflash.default_config
module
modelopt.torch.speculative.dflash.dflash_model
module
modelopt.torch.speculative.eagle
module
modelopt.torch.speculative.eagle.conversion
module
modelopt.torch.speculative.eagle.default_config
module
modelopt.torch.speculative.eagle.eagle_model
module
modelopt.torch.speculative.eagle.utils
module
modelopt.torch.speculative.medusa
module
modelopt.torch.speculative.medusa.conversion
module
modelopt.torch.speculative.medusa.medusa_model
module
modelopt.torch.speculative.mode
module
modelopt.torch.speculative.plugins
module
modelopt.torch.speculative.speculative_decoding
module
modelopt.torch.speculative.utils
module
modelopt.torch.trace
module
modelopt.torch.trace.analyzer
module
modelopt.torch.trace.modules
module
modelopt.torch.trace.modules.concat
module
modelopt.torch.trace.modules.nn
module
modelopt.torch.trace.symbols
module
modelopt.torch.trace.tracer
module
modelopt.torch.utils
module
modelopt.torch.utils.cpp_extension
module
modelopt.torch.utils.dataset_utils
module
modelopt.torch.utils.distributed
module
modelopt.torch.utils.graph
module
modelopt.torch.utils.import_utils
module
modelopt.torch.utils.list
module
modelopt.torch.utils.logging
module
modelopt.torch.utils.loss_mask
module
modelopt.torch.utils.memory_monitor
module
modelopt.torch.utils.nemotron_vlm_dataset_utils
module
modelopt.torch.utils.network
module
modelopt.torch.utils.perf
module
modelopt.torch.utils.plugins
module
modelopt.torch.utils.random
module
modelopt.torch.utils.regex
module
modelopt.torch.utils.robust_json
module
modelopt.torch.utils.serialization
module
modelopt.torch.utils.speech_dataset_utils
module
modelopt.torch.utils.tensor
module
modelopt.torch.utils.vlm_dataset_utils
module
modelopt_post_restore() (QuantModule method)
modelopt_state() (in module modelopt.torch.opt.conversion)
ModeloptField() (in module modelopt.torch.opt.config)
ModeloptStateManager (class in modelopt.torch.opt.conversion)
models (CrossModelCampaign attribute)
modes_with_states() (ModeloptStateManager method)
modify() (DFlashModel method)
(DistillationModel method)
(DynamicModule method)
(EagleModel method)
(LayerwiseDistillationModel method)
(MedusaModel method)
(SparseModule method)
module
modelopt.deploy
modelopt.deploy.llm
modelopt.deploy.llm.generate
modelopt.onnx
modelopt.onnx.autocast
modelopt.onnx.autocast.convert
modelopt.onnx.autocast.graphsanitizer
modelopt.onnx.autocast.logging_config
modelopt.onnx.autocast.nodeclassifier
modelopt.onnx.autocast.precisionconverter
modelopt.onnx.autocast.referencerunner
modelopt.onnx.autocast.utils
modelopt.onnx.export
modelopt.onnx.graph_surgery
modelopt.onnx.llm_export_utils
modelopt.onnx.llm_export_utils.export_utils
modelopt.onnx.llm_export_utils.quantization_utils
modelopt.onnx.llm_export_utils.surgeon_utils
modelopt.onnx.logging_config
modelopt.onnx.op_types
modelopt.onnx.quantization
modelopt.onnx.quantization.autotune
modelopt.onnx.quantization.calib_utils
modelopt.onnx.quantization.extensions
modelopt.onnx.quantization.fp8
modelopt.onnx.quantization.graph_utils
modelopt.onnx.quantization.gs_patching
modelopt.onnx.quantization.int4
modelopt.onnx.quantization.int8
modelopt.onnx.quantization.operators
modelopt.onnx.quantization.ort_patching
modelopt.onnx.quantization.ort_utils
modelopt.onnx.quantization.partitioning
modelopt.onnx.quantization.qdq_utils
modelopt.onnx.quantization.quant_utils
modelopt.onnx.trt_utils
modelopt.onnx.utils
modelopt.torch
modelopt.torch.distill
modelopt.torch.distill.config
modelopt.torch.distill.distillation
modelopt.torch.distill.distillation_model
modelopt.torch.distill.layerwise_distillation_model
modelopt.torch.distill.loss_balancers
modelopt.torch.distill.losses
modelopt.torch.distill.mode
modelopt.torch.distill.plugins
modelopt.torch.distill.registry
modelopt.torch.export
modelopt.torch.export.convert_hf_config
modelopt.torch.export.diffusers_utils
modelopt.torch.export.distribute
modelopt.torch.export.hf_config_map
modelopt.torch.export.layer_utils
modelopt.torch.export.mcore_config_map
modelopt.torch.export.model_config
modelopt.torch.export.model_config_export
modelopt.torch.export.model_config_utils
modelopt.torch.export.model_utils
modelopt.torch.export.moe_utils
modelopt.torch.export.plugins
modelopt.torch.export.postprocess
modelopt.torch.export.quant_utils
modelopt.torch.export.tensorrt_llm_type
modelopt.torch.export.tensorrt_llm_utils
modelopt.torch.export.transformer_engine
modelopt.torch.export.unified_export_hf
modelopt.torch.export.unified_export_megatron
modelopt.torch.fastgen
modelopt.torch.fastgen.config
modelopt.torch.fastgen.discriminators
modelopt.torch.fastgen.ema
modelopt.torch.fastgen.factory
modelopt.torch.fastgen.flow_matching
modelopt.torch.fastgen.loader
modelopt.torch.fastgen.losses
modelopt.torch.fastgen.methods
modelopt.torch.fastgen.methods.dmd
modelopt.torch.fastgen.pipeline
modelopt.torch.fastgen.plugins
modelopt.torch.fastgen.utils
modelopt.torch.kernels
modelopt.torch.kernels.common
modelopt.torch.kernels.common.attention
modelopt.torch.kernels.quantization
modelopt.torch.kernels.quantization.attention
modelopt.torch.kernels.quantization.conv
modelopt.torch.kernels.quantization.conv.bench_implicit_gemm
modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda
modelopt.torch.kernels.quantization.gemm
modelopt.torch.kernels.quantization.gemm.fp4_kernel
modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper
modelopt.torch.kernels.quantization.gemm.fp8_kernel
modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel
modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep
modelopt.torch.kernels.quantization.gemm.nvfp4_quant
modelopt.torch.kernels.sparsity
modelopt.torch.kernels.sparsity.attention
modelopt.torch.kernels.sparsity.gemm
modelopt.torch.nas
modelopt.torch.nas.algorithms
modelopt.torch.nas.autonas
modelopt.torch.nas.conversion
modelopt.torch.nas.hparams
modelopt.torch.nas.hparams.concat
modelopt.torch.nas.hparams.container
modelopt.torch.nas.modules
modelopt.torch.nas.modules.container
modelopt.torch.nas.modules.conv
modelopt.torch.nas.modules.linear
modelopt.torch.nas.modules.norm
modelopt.torch.nas.modules.utils
modelopt.torch.nas.patch
modelopt.torch.nas.plugins
modelopt.torch.nas.registry
modelopt.torch.nas.search_space
modelopt.torch.nas.traced_hp
modelopt.torch.nas.utils
modelopt.torch.opt
modelopt.torch.opt.config
modelopt.torch.opt.config_loader
modelopt.torch.opt.conversion
modelopt.torch.opt.dynamic
modelopt.torch.opt.hparam
modelopt.torch.opt.mode
modelopt.torch.opt.plugins
modelopt.torch.opt.plugins.huggingface
modelopt.torch.opt.searcher
modelopt.torch.opt.utils
modelopt.torch.peft
modelopt.torch.peft.config
modelopt.torch.peft.conversion
modelopt.torch.peft.convert
modelopt.torch.peft.custom
modelopt.torch.peft.lora
modelopt.torch.peft.lora.layer
modelopt.torch.peft.lora.plugins
modelopt.torch.peft.mode
modelopt.torch.prune
modelopt.torch.prune.fastnas
modelopt.torch.prune.importance_hooks
modelopt.torch.prune.importance_hooks.base_hooks
modelopt.torch.prune.importance_hooks.base_hooks_analysis
modelopt.torch.prune.importance_hooks.compare_module_outputs
modelopt.torch.prune.importance_hooks.expert_removal_hooks
modelopt.torch.prune.importance_hooks.plugins
modelopt.torch.prune.plugins
modelopt.torch.prune.pruning
modelopt.torch.puzzletron
modelopt.torch.puzzletron.activation_scoring
modelopt.torch.puzzletron.activation_scoring.activation_hooks
modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils
modelopt.torch.puzzletron.activation_scoring.score_pruning_activations
modelopt.torch.puzzletron.anymodel
modelopt.torch.puzzletron.anymodel.automodel
modelopt.torch.puzzletron.anymodel.capabilities
modelopt.torch.puzzletron.anymodel.converter
modelopt.torch.puzzletron.anymodel.converter.base
modelopt.torch.puzzletron.anymodel.converter.convert_any_model
modelopt.torch.puzzletron.anymodel.converter.converter_factory
modelopt.torch.puzzletron.anymodel.converter.generic_decoder
modelopt.torch.puzzletron.anymodel.model_descriptor
modelopt.torch.puzzletron.anymodel.model_descriptor.base
modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory
modelopt.torch.puzzletron.anymodel.models
modelopt.torch.puzzletron.anymodel.models.generic_decoder
modelopt.torch.puzzletron.anymodel.models.gpt_oss
modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter
modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor
modelopt.torch.puzzletron.anymodel.models.llama
modelopt.torch.puzzletron.anymodel.models.llama.llama_converter
modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor
modelopt.torch.puzzletron.anymodel.models.mistral_small
modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter
modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor
modelopt.torch.puzzletron.anymodel.models.nemotron_h
modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter
modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter
modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor
modelopt.torch.puzzletron.anymodel.models.qwen2
modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter
modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor
modelopt.torch.puzzletron.anymodel.models.qwen3
modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter
modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor
modelopt.torch.puzzletron.anymodel.models.qwen3_5
modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_converter
modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor
modelopt.torch.puzzletron.anymodel.models.qwen3_vl
modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter
modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor
modelopt.torch.puzzletron.anymodel.puzzformer
modelopt.torch.puzzletron.anymodel.puzzformer.no_op
modelopt.torch.puzzletron.anymodel.puzzformer.patcher
modelopt.torch.puzzletron.anymodel.registry
modelopt.torch.puzzletron.artifact_coverage
modelopt.torch.puzzletron.artifact_import
modelopt.torch.puzzletron.artifact_import_contract
modelopt.torch.puzzletron.artifact_inventory
modelopt.torch.puzzletron.benchmarks
modelopt.torch.puzzletron.block_config
modelopt.torch.puzzletron.bypass_distillation
modelopt.torch.puzzletron.campaigns
modelopt.torch.puzzletron.candidates
modelopt.torch.puzzletron.checkpoint_transactions
modelopt.torch.puzzletron.dataset
modelopt.torch.puzzletron.depth
modelopt.torch.puzzletron.diagnostics
modelopt.torch.puzzletron.distillation
modelopt.torch.puzzletron.distillation.dataset
modelopt.torch.puzzletron.distillation.flash_kld
modelopt.torch.puzzletron.distillation.global_automodel
modelopt.torch.puzzletron.distillation.global_kd_recipe
modelopt.torch.puzzletron.distillation.loss
modelopt.torch.puzzletron.distillation.synthetic_vlm
modelopt.torch.puzzletron.distillation.tournament
modelopt.torch.puzzletron.distributed_eval
modelopt.torch.puzzletron.evaluation
modelopt.torch.puzzletron.evaluation.lmms
modelopt.torch.puzzletron.execution_record
modelopt.torch.puzzletron.export
modelopt.torch.puzzletron.export.vllm
modelopt.torch.puzzletron.granularity
modelopt.torch.puzzletron.identity
modelopt.torch.puzzletron.manifest
modelopt.torch.puzzletron.mip
modelopt.torch.puzzletron.mip.grid_budgeting
modelopt.torch.puzzletron.mip.mip_and_realize_models
modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements
modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements_cuopt
modelopt.torch.puzzletron.mip.profiles
modelopt.torch.puzzletron.mip.run_puzzle
modelopt.torch.puzzletron.mip.search_space
modelopt.torch.puzzletron.mip.solver_backend
modelopt.torch.puzzletron.mip.sweep
modelopt.torch.puzzletron.mip.utils
modelopt.torch.puzzletron.orchestration
modelopt.torch.puzzletron.pipeline_config
modelopt.torch.puzzletron.plugins
modelopt.torch.puzzletron.post_mip
modelopt.torch.puzzletron.post_mip.base
modelopt.torch.puzzletron.post_mip.builtin
modelopt.torch.puzzletron.post_mip.filters
modelopt.torch.puzzletron.post_mip.identity
modelopt.torch.puzzletron.post_mip.records
modelopt.torch.puzzletron.post_mip.reporting
modelopt.torch.puzzletron.post_mip.runner
modelopt.torch.puzzletron.pruning
modelopt.torch.puzzletron.pruning.attention_ffn_surgery
modelopt.torch.puzzletron.pruning.compact_runtime
modelopt.torch.puzzletron.pruning.dynamic_block_prune
modelopt.torch.puzzletron.pruning.elastic_sampling
modelopt.torch.puzzletron.pruning.embedding_pruning
modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin
modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin
modelopt.torch.puzzletron.pruning.gated_delta_net
modelopt.torch.puzzletron.pruning.gated_delta_net_pruning_mixin
modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin
modelopt.torch.puzzletron.pruning.latent_moe_surgery
modelopt.torch.puzzletron.pruning.mamba2_surgery
modelopt.torch.puzzletron.pruning.materialize
modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin
modelopt.torch.puzzletron.pruning.ple_pruning
modelopt.torch.puzzletron.pruning.pruning_mixin
modelopt.torch.puzzletron.pruning.pruning_utils
modelopt.torch.puzzletron.pruning.runtime_candidate
modelopt.torch.puzzletron.pruning.runtime_hidden_width
modelopt.torch.puzzletron.pruning.runtime_ple
modelopt.torch.puzzletron.pruning.sorted_teacher
modelopt.torch.puzzletron.replacement_library
modelopt.torch.puzzletron.replacement_library.build_replacement_library
modelopt.torch.puzzletron.replacement_library.library
modelopt.torch.puzzletron.replacement_library.replacement_utils
modelopt.torch.puzzletron.replacement_library.score_composition
modelopt.torch.puzzletron.replacement_library.subblock_scoring
modelopt.torch.puzzletron.rpc_eval
modelopt.torch.puzzletron.rpc_eval.cache
modelopt.torch.puzzletron.rpc_eval.metadata
modelopt.torch.puzzletron.rpc_eval.service
modelopt.torch.puzzletron.sampling
modelopt.torch.puzzletron.scenarios
modelopt.torch.puzzletron.scoring
modelopt.torch.puzzletron.scoring_parent
modelopt.torch.puzzletron.search_space
modelopt.torch.puzzletron.security_policy
modelopt.torch.puzzletron.solution_registry
modelopt.torch.puzzletron.stage_runner
modelopt.torch.puzzletron.stages
modelopt.torch.puzzletron.subblock_stats
modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats
modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory
modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats
modelopt.torch.puzzletron.subblock_stats.measurements
modelopt.torch.puzzletron.subblock_stats.runtime_estimator
modelopt.torch.puzzletron.subblock_stats.runtime_utils
modelopt.torch.puzzletron.subblock_stats.runtime_vllm
modelopt.torch.puzzletron.subblock_stats.topology
modelopt.torch.puzzletron.tools
modelopt.torch.puzzletron.tools.bypassed_training
modelopt.torch.puzzletron.tools.bypassed_training.child_init
modelopt.torch.puzzletron.tools.checkpoint_utils
modelopt.torch.puzzletron.tools.checkpoint_utils_hf
modelopt.torch.puzzletron.tools.common
modelopt.torch.puzzletron.tools.hydra_utils
modelopt.torch.puzzletron.tools.kd_model
modelopt.torch.puzzletron.tools.sharded_checkpoint_utils
modelopt.torch.puzzletron.tools.validate_model
modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements
modelopt.torch.puzzletron.tools.validation_utils
modelopt.torch.puzzletron.utils
modelopt.torch.puzzletron.utils.data
modelopt.torch.puzzletron.utils.data.dataloaders
modelopt.torch.puzzletron.utils.data.dataset
modelopt.torch.puzzletron.utils.data.packed_memmap
modelopt.torch.puzzletron.utils.distributed_object
modelopt.torch.puzzletron.utils.dummy_modules
modelopt.torch.puzzletron.utils.flash_kd
modelopt.torch.puzzletron.utils.misc
modelopt.torch.puzzletron.utils.parsing
modelopt.torch.puzzletron.utils.sample_hash
modelopt.torch.puzzletron.utils.validation
modelopt.torch.puzzletron.utils.vllm_adapter
modelopt.torch.quantization
modelopt.torch.quantization.algorithms
modelopt.torch.quantization.backends
modelopt.torch.quantization.backends.utils
modelopt.torch.quantization.calib
modelopt.torch.quantization.calib.bias
modelopt.torch.quantization.calib.calibrator
modelopt.torch.quantization.calib.histogram
modelopt.torch.quantization.calib.max
modelopt.torch.quantization.calib.mse
modelopt.torch.quantization.config
modelopt.torch.quantization.conversion
modelopt.torch.quantization.export_onnx
modelopt.torch.quantization.extensions
modelopt.torch.quantization.mode
modelopt.torch.quantization.model_calib
modelopt.torch.quantization.model_quant
modelopt.torch.quantization.nn
modelopt.torch.quantization.nn.functional
modelopt.torch.quantization.nn.modules
modelopt.torch.quantization.nn.modules.quant_activations
modelopt.torch.quantization.nn.modules.quant_batchnorm
modelopt.torch.quantization.nn.modules.quant_conv
modelopt.torch.quantization.nn.modules.quant_embedding
modelopt.torch.quantization.nn.modules.quant_instancenorm
modelopt.torch.quantization.nn.modules.quant_layernorm
modelopt.torch.quantization.nn.modules.quant_linear
modelopt.torch.quantization.nn.modules.quant_module
modelopt.torch.quantization.nn.modules.quant_pooling
modelopt.torch.quantization.nn.modules.quant_rnn
modelopt.torch.quantization.nn.modules.tensor_quantizer
modelopt.torch.quantization.plugins
modelopt.torch.quantization.qtensor
modelopt.torch.quantization.qtensor.base_qtensor
modelopt.torch.quantization.qtensor.fp8_tensor
modelopt.torch.quantization.qtensor.int4_tensor
modelopt.torch.quantization.qtensor.int8_tensor
modelopt.torch.quantization.qtensor.mxfp4_tensor
modelopt.torch.quantization.qtensor.mxfp8_tensor
modelopt.torch.quantization.qtensor.nf4_tensor
modelopt.torch.quantization.qtensor.nvfp4_tensor
modelopt.torch.quantization.tensor_quant
modelopt.torch.quantization.utils
modelopt.torch.sparsity
modelopt.torch.sparsity.attention_sparsity
modelopt.torch.sparsity.attention_sparsity.calibration
modelopt.torch.sparsity.attention_sparsity.config
modelopt.torch.sparsity.attention_sparsity.conversion
modelopt.torch.sparsity.attention_sparsity.methods
modelopt.torch.sparsity.attention_sparsity.mode
modelopt.torch.sparsity.attention_sparsity.model_sparsify
modelopt.torch.sparsity.attention_sparsity.plugins
modelopt.torch.sparsity.attention_sparsity.sparse_attention
modelopt.torch.sparsity.attention_sparsity.stats_manager
modelopt.torch.sparsity.attention_sparsity.utils
modelopt.torch.sparsity.weight_sparsity
modelopt.torch.sparsity.weight_sparsity.config
modelopt.torch.sparsity.weight_sparsity.magnitude
modelopt.torch.sparsity.weight_sparsity.mode
modelopt.torch.sparsity.weight_sparsity.module
modelopt.torch.sparsity.weight_sparsity.plugins
modelopt.torch.sparsity.weight_sparsity.searcher
modelopt.torch.sparsity.weight_sparsity.sparsegpt
modelopt.torch.sparsity.weight_sparsity.sparsification
modelopt.torch.speculative
modelopt.torch.speculative.config
modelopt.torch.speculative.dflash
modelopt.torch.speculative.dflash.conversion
modelopt.torch.speculative.dflash.default_config
modelopt.torch.speculative.dflash.dflash_model
modelopt.torch.speculative.eagle
modelopt.torch.speculative.eagle.conversion
modelopt.torch.speculative.eagle.default_config
modelopt.torch.speculative.eagle.eagle_model
modelopt.torch.speculative.eagle.utils
modelopt.torch.speculative.medusa
modelopt.torch.speculative.medusa.conversion
modelopt.torch.speculative.medusa.medusa_model
modelopt.torch.speculative.mode
modelopt.torch.speculative.plugins
modelopt.torch.speculative.speculative_decoding
modelopt.torch.speculative.utils
modelopt.torch.trace
modelopt.torch.trace.analyzer
modelopt.torch.trace.modules
modelopt.torch.trace.modules.concat
modelopt.torch.trace.modules.nn
modelopt.torch.trace.symbols
modelopt.torch.trace.tracer
modelopt.torch.utils
modelopt.torch.utils.cpp_extension
modelopt.torch.utils.dataset_utils
modelopt.torch.utils.distributed
modelopt.torch.utils.graph
modelopt.torch.utils.import_utils
modelopt.torch.utils.list
modelopt.torch.utils.logging
modelopt.torch.utils.loss_mask
modelopt.torch.utils.memory_monitor
modelopt.torch.utils.nemotron_vlm_dataset_utils
modelopt.torch.utils.network
modelopt.torch.utils.perf
modelopt.torch.utils.plugins
modelopt.torch.utils.random
modelopt.torch.utils.regex
modelopt.torch.utils.robust_json
modelopt.torch.utils.serialization
modelopt.torch.utils.speech_dataset_utils
modelopt.torch.utils.tensor
modelopt.torch.utils.vlm_dataset_utils
module_name (AttnRemovalSpec attribute)
(FFNRemovalSpec attribute)
(GatedDenseFFNContract attribute)
(LatentAttentionContract attribute)
(RoutedMoEContract attribute)
(StandardGQAAttentionContract attribute)
module_name_regex() (ExpertRemovalLayerDescriptor method)
(FFNIntermediateLayerDescriptor method)
(GatedDeltaNetLayerDescriptor method)
(KVHeadsLayerDescriptor method)
(LayerDescriptor method)
(MambaLayerDescriptor method)
(MoELayerDescriptor method)
module_names (VisionLanguageContract attribute)
MOE (ModelKind attribute)
moe_calib_experts_ratio (QuantizeAlgorithmConfig attribute)
moe_expert_down_keys (LayerLayout attribute)
moe_expert_intermediate (LayerLayout attribute)
moe_expert_intermediate_group_size (LayerLayout attribute)
moe_expert_order_mode (LayerLayout attribute)
moe_expert_up_keys (LayerLayout attribute)
moe_experts_prefix (LayerLayout attribute)
moe_fc1_latent_key (LayerLayout attribute)
moe_fc2_latent_key (LayerLayout attribute)
moe_fused_down_keys (LayerLayout attribute)
moe_fused_expert_keys (LayerLayout attribute)
moe_fused_gate_layout (LayerLayout attribute)
moe_fused_gate_up_keys (LayerLayout attribute)
moe_gate_bias_key (LayerLayout attribute)
moe_gate_key (LayerLayout attribute)
moe_gate_prefix (LayerLayout attribute)
moe_latent_dim (LayerLayout attribute)
moe_num_experts (DecoderLayerConfig attribute)
(LayerLayout attribute)
moe_prefix (LayerLayout attribute)
moe_prefix() (ExpertRemovalLayerDescriptor method)
(MoELayerDescriptor method)
moe_prefix_name (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(MoELayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHMoELayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
moe_renorm_mode (DecoderLayerConfig attribute)
moe_router_aux_keys (LayerLayout attribute)
moe_shared_down_key (LayerLayout attribute)
moe_shared_gate_key (LayerLayout attribute)
moe_shared_intermediate (LayerLayout attribute)
moe_shared_up_key (LayerLayout attribute)
moe_top_k (DecoderLayerConfig attribute)
moe_tp_mode (DecoderLayerConfig attribute)
MoEChannelPruning (MlpInitMode attribute)
MOEConfig (class in modelopt.torch.export.model_config)
MoEConfig (class in modelopt.torch.puzzletron.block_config)
MoELayerDescriptor (class in modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin)
MoEPruningMixIn (class in modelopt.torch.puzzletron.pruning.moe_mamba_pruning_mixin)
monitor_interval (GPUMemoryMonitor attribute)
monitor_thread (GPUMemoryMonitor attribute)
mse_loss() (in module modelopt.torch.puzzletron.utils.validation)
MseCalibrator (class in modelopt.torch.quantization.calib.mse)
mtp (GenericDecoderContract attribute)
mtp_ce_weight (GlobalKDConfig attribute)
mtp_kd (GlobalKDConfig attribute)
mtp_kd_weight (GlobalKDConfig attribute)
mtp_policy (CampaignModel attribute)
MTPContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
MULTIMODAL (Modality attribute)
mup_attn_multiplier (DecoderLayerConfig attribute)
mup_embedding_multiplier (DecoderLayerConfig attribute)
mup_use_scaling (DecoderLayerConfig attribute)
mup_width_multiplier (DecoderLayerConfig attribute)
MXFP4QTensor (class in modelopt.torch.quantization.qtensor.mxfp4_tensor)
MXFP8QTensor (class in modelopt.torch.quantization.qtensor.mxfp8_tensor)
MXFP8QuantExporter (class in modelopt.onnx.export)
N
name (AttentionConfig attribute)
(AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(CampaignManifest attribute)
(DescriptorResolution attribute)
(DFlashModeDescriptor property)
(EagleModeDescriptor property)
(ExportNASModeDescriptor property)
(ExportPEFTModeDescriptor property)
(ExportSparseModeDescriptor property)
(ExportStudentModeDescriptor property)
(FastNASModeDescriptor property)
(FFNConfig attribute)
(KnowledgeDistillationModeDescriptor property)
(LayerwiseKDModeDescriptor property)
(LossMaskRecovery attribute)
(MambaConfig attribute)
(MedusaModeDescriptor property)
(MLAConfig attribute)
(ModeDescriptor property)
(MoEConfig attribute)
(PEFTModeDescriptor property)
(SharedQuantState attribute)
(SharedWeightGlobalAmaxState attribute)
(SparseAttentionMethod property)
(SparseAttentionModeDescriptor property)
(SparseGPTModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
(SubblockConfig attribute)
(SubblockRef attribute)
name_onnx_nodes() (in module modelopt.onnx.utils)
named_dynamic_modules() (DynamicSpace method)
(in module modelopt.torch.opt.utils)
named_hparams() (DynamicModule method)
(DynamicSpace method)
(in module modelopt.torch.opt.utils)
named_modules() (SymMap method)
named_sym_dicts() (SymMap method)
named_symbols() (SymMap method)
names (SubblockCapabilities attribute)
narrow_range (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
native_automodel_required (AxisCapabilities attribute)
native_automodel_supported (GenericDecoderContract attribute)
(PuzzletronCapabilities attribute)
native_state_dict_adapter_context() (AutoModelDescriptor class method)
need_calibration() (in module modelopt.torch.quantization.config)
needs_teacher (GlobalKDConfig property)
NemotronHConverter (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter)
NemotronHExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHMambaLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHMoELayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor)
NemotronHRemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks)
NemotronHV2Converter (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter)
NemotronHV2ExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor)
NemotronHV2FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor)
NemotronHV2KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor)
NemotronHV2ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor)
NemotronTarPlusJsonlIterable (class in modelopt.torch.utils.nemotron_vlm_dataset_utils)
new_decoder_architecture (DecoderLayerConfig attribute)
next_modes (AutoNASModeDescriptor property)
(FastNASModeDescriptor property)
(ModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
next_prohibited_modes (ModeDescriptor property)
(SparseAttentionModeDescriptor property)
NF4QTensor (class in modelopt.torch.quantization.qtensor.nf4_tensor)
NFSWorkspace (class in modelopt.torch.export.distribute)
nn_batchnorm1d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_batchnorm2d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_batchnorm3d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_conv1d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_conv2d (AutoNASConfig attribute)
(FastNASConfig attribute)
(SparseGPTConfig attribute)
(SparseMagnitudeConfig attribute)
nn_conv3d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_convtranspose1d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_convtranspose2d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_convtranspose3d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_groupnorm (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_instancenorm1d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_instancenorm2d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_instancenorm3d (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_layernorm (AutoNASConfig attribute)
(FastNASConfig attribute)
nn_linear (AutoNASConfig attribute)
(FastNASConfig attribute)
(SparseGPTConfig attribute)
(SparseMagnitudeConfig attribute)
nn_sequential (AutoNASConfig attribute)
nn_syncbatchnorm (AutoNASConfig attribute)
(FastNASConfig attribute)
no_modelopt_patches (class in modelopt.torch.nas.utils)
no_none_elements() (in module modelopt.onnx.llm_export_utils.surgeon_utils)
no_op (ExportCapabilities attribute)
(SparseSampleRecord attribute)
(SubblockCapabilities attribute)
(SubblockConfig attribute)
no_stdout() (in module modelopt.torch.utils.logging)
node (InputIndexTracker attribute)
node_id (CandidateSet attribute)
(CompiledPostMIPNode attribute)
(NodeObservation attribute)
node_index (ChildRegionOutputInsertionPoint attribute)
(InputIndexTracker attribute)
(NodeInputInsertionPoint attribute)
(ResolvedInsertionPoint attribute)
node_inputs (InsertionScheme attribute)
node_type (CompiledPostMIPNode attribute)
NodeCapabilities (class in modelopt.torch.puzzletron.post_mip.base)
NodeClassifier (class in modelopt.onnx.autocast.nodeclassifier)
NodeInputInsertionPoint (class in modelopt.onnx.quantization.autotune)
NodeKind (class in modelopt.torch.puzzletron.post_mip.base)
NodeObservation (class in modelopt.torch.puzzletron.post_mip.records)
NodeRuleBase (class in modelopt.onnx.autocast.nodeclassifier)
NONE (Symbol.CLType attribute)
norm_key (Mamba2TensorLayout attribute)
normalize_config() (in module modelopt.torch.puzzletron.stage_runner)
normalize_intersyn_multi() (in module modelopt.torch.puzzletron.dataset)
normalize_intersyn_single() (in module modelopt.torch.puzzletron.dataset)
normalize_mip_profiles() (in module modelopt.torch.puzzletron.mip.profiles)
normalize_nemotron_vlm_sample() (in module modelopt.torch.puzzletron.dataset)
normalize_pipeline_config() (in module modelopt.torch.puzzletron.pipeline_config)
normalize_quant_cfg_list() (in module modelopt.torch.quantization.config)
normalize_vllm_measurements() (in module modelopt.torch.puzzletron.subblock_stats.measurements)
normalize_vllm_topology() (in module modelopt.torch.puzzletron.orchestration)
normalized_hadamard_transform() (in module modelopt.torch.quantization.nn.functional)
normalized_mse_loss() (in module modelopt.torch.puzzletron.tools.kd_model)
(in module modelopt.torch.puzzletron.utils.validation)
notes (PuzzletronCapabilities attribute)
num2hrb() (in module modelopt.torch.utils.logging)
num_attention_heads (DecoderLayerConfig attribute)
(ModelConfig property)
(RuntimeConfig attribute)
num_bits (QuantizerAttributeConfig attribute)
(QuantRecipe property)
(TensorQuantizer property)
num_decode_tokens (CalibrationConfig attribute)
num_experts (MoEConfig attribute)
num_experts_field (RoutedMoEContract attribute)
num_groups (Mamba2TensorLayout attribute)
(MambaConfig attribute)
num_heads (Mamba2TensorLayout attribute)
(MambaConfig attribute)
(MLAConfig attribute)
num_homogeneous_solutions (MIPProfile property)
num_iters (RuntimeConfig attribute)
num_key_heads (GDNShape attribute)
num_key_value_heads (RuntimeConfig attribute)
num_kv_heads (AttentionConfig attribute)
(DecoderLayerConfig attribute)
(LayerLayout attribute)
(ModelConfig property)
num_layers (PLEPruningSpec attribute)
num_length_bins (CalibrationConfig attribute)
num_medusa_heads (ModelConfig attribute)
num_medusa_layers (ModelConfig attribute)
num_patterns (PatternCache property)
num_q_heads (LayerLayout attribute)
num_query_heads (AttentionConfig attribute)
num_samples (VlmAcquisitionSpec attribute)
num_satisfied (IterativeSearcher attribute)
num_schemes (PatternSchemes property)
num_solutions (HomogeneousPolicy property)
(SolverOptions attribute)
num_train_timesteps (DistillationConfig attribute)
num_value_heads (GDNShape attribute)
num_warmup_iters (RuntimeConfig attribute)
numpy_to_torch() (in module modelopt.torch.utils.tensor)
numpy_type (PrecisionTypes attribute)
nvfp4_fp8_scale_sweep() (in module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep)
nvfp4_gemm() (in module modelopt.torch.quantization.backends)
NVFP4MSECalibrator (class in modelopt.torch.quantization.calib.mse)
NVFP4QTensor (class in modelopt.torch.quantization.qtensor.nvfp4_tensor)
NVFP4QuantExporter (class in modelopt.onnx.export)
NVFP4StaticQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer)
O
o_key (LayerLayout attribute)
o_proj_name (GptOssKVHeadsLayerDescriptor attribute)
(KVHeadsLayerDescriptor attribute)
(LlamaKVHeadsLayerDescriptor attribute)
(MistralKVHeadsLayerDescriptor attribute)
(NemotronHKVHeadsLayerDescriptor attribute)
(NemotronHV2KVHeadsLayerDescriptor attribute)
(Qwen3KVHeadsLayerDescriptor attribute)
(Qwen3P5TextKVHeadsLayerDescriptor attribute)
(Qwen3P5VLKVHeadsLayerDescriptor attribute)
(Qwen3VLKVHeadsLayerDescriptor attribute)
(StandardGQAAttentionContract attribute)
objective (MIPProfile attribute)
objective_weights (GlobalKDConfig property)
ObjectiveSpec (class in modelopt.torch.puzzletron.mip.profiles)
observation_module (MagnitudeFallbackSpec attribute)
OfflineSupervisedDataset (class in modelopt.torch.speculative.eagle.utils)
only_student_forward() (DistillationModel method)
only_teacher_forward() (DistillationModel method)
onnx_type (PrecisionTypes attribute)
onnx_type_str_to_enum() (in module modelopt.onnx.utils)
ONNXQuantExporter (class in modelopt.onnx.export)
OOM (FailureClass attribute)
open() (Campaign class method)
order_from_score_logs() (PLEPruningSpec method)
order_from_scores() (EmbeddingPruningSpec method)
origin_revision_id (ArchitectureCandidate attribute)
original (Hparam property)
original() (in module modelopt.torch.utils.random)
original_cls (DynamicModule property)
original_max_position_embeddings (DecoderLayerConfig attribute)
original_meta_tensor (BaseQuantizedTensor attribute)
original_score (BinarySearcher attribute)
origins (ArchitectureCandidate attribute)
out_proj_key (Mamba2TensorLayout attribute)
out_proj_name (MambaLayerDescriptor attribute)
OUTGOING (Symbol.CLType attribute)
output (NodeCapabilities attribute)
output_artifact (CompiledPostMIPNode attribute)
output_basis (LatentMoETransform attribute)
output_compressor (LatentMoETransform attribute)
output_dir (GlobalKDConfig attribute)
(GlobalKDResult attribute)
(TextAcquisitionSpec attribute)
(VlmAcquisitionSpec attribute)
output_embedding (DecoderLayout attribute)
output_embedding_name() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor static method)
(LlamaModelDescriptor static method)
(MistralSmallModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen2ModelDescriptor static method)
(Qwen3ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
output_field (MagnitudeFallbackSpec attribute)
output_index (ChildRegionOutputInsertionPoint attribute)
output_quantizer (QuantInputBase attribute)
output_revision_id (NodeObservation attribute)
outputs (StageManifest attribute)
OutputSaveHook (class in modelopt.torch.prune.importance_hooks.compare_module_outputs)
override_config_with_block_configs() (in module modelopt.torch.puzzletron.anymodel.puzzformer.patcher)
overrides (CampaignPlan attribute)
P
p_mean (SampleTimestepConfig attribute)
p_std (SampleTimestepConfig attribute)
pack_float32_to_4bit_cpp_based() (in module modelopt.onnx.quantization.quant_utils)
pack_float32_to_4bit_optimized() (in module modelopt.onnx.quantization.quant_utils)
pack_gpu_allocation() (in module modelopt.torch.puzzletron.orchestration)
pack_int4_in_uint8() (in module modelopt.torch.export.quant_utils)
pack_linear_weights() (in module modelopt.torch.export.model_config_utils)
pack_real_quantize_weight() (in module modelopt.torch.quantization.qtensor.base_qtensor)
pack_size (PackingSpec attribute)
pack_weights_to_int4() (in module modelopt.onnx.quantization.quant_utils)
packed_sequence_size (GlobalKDConfig attribute)
PACKED_VARLEN (DataLayout attribute)
PackedMinitronImportance (class in modelopt.torch.puzzletron.pruning.embedding_pruning)
PackedSequenceMetadata (class in modelopt.torch.puzzletron.dataset)
PackedTokenMemmapDataset (class in modelopt.torch.puzzletron.utils.data.packed_memmap)
packing (PuzzletronDataSpec attribute)
packing_ratio (PackingSpec attribute)
PackingSpec (class in modelopt.torch.puzzletron.dataset)
pad_batch_to_multiple() (PuzzletronBatch method)
pad_embedding_lm_head() (in module modelopt.torch.export.postprocess)
pad_nvfp4_weights() (in module modelopt.torch.export.diffusers_utils)
pad_token_id (ModelConfig attribute)
pad_weights() (in module modelopt.torch.export.model_config_utils)
PADDED_VARLEN (DataLayout attribute)
parallel_attention (DecoderLayerConfig attribute)
parallel_axis (PrunableAxis attribute)
parallel_state (QuantModule property)
ParallelCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
parallelism (CampaignManifest attribute)
(PuzzletronCapabilities attribute)
(WorkerRecord attribute)
ParallelMesh (class in modelopt.torch.puzzletron.orchestration)
ParallelMeshOverride (class in modelopt.torch.puzzletron.orchestration)
ParallelState (class in modelopt.torch.utils.distributed)
ParallelTopology (class in modelopt.torch.puzzletron.campaigns)
param_num_from_forward() (in module modelopt.torch.utils.network)
parameter_count() (EmbeddingPruningSpec method)
parent (ArtifactChoice attribute)
(Symbol property)
parent_checkpoint_identity (Candidate attribute)
(CandidateLibrary attribute)
(DepthScenario attribute)
parent_class (QuantizerCfgEntry attribute)
parent_revision_id (CandidateRevision attribute)
parent_stage_id (CompiledPostMIPNode attribute)
parents (StageSpec attribute)
parse_json() (in module modelopt.torch.puzzletron.utils.parsing)
parse_layer_replacement() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
parse_path() (in module modelopt.torch.puzzletron.utils.parsing)
parse_shapes_spec() (in module modelopt.onnx.utils)
partial_rotary_factor (DecoderLayerConfig attribute)
partition (StageExecutionSpec attribute)
pass_through_bwd (QuantizerAttributeConfig attribute)
passthrough_weight_name_predicates() (GenericContractModelDescriptor static method)
(ModelDescriptor static method)
patch() (PatchManager method)
patch_constructor_arguments() (AutoModelDescriptor class method)
patch_data (PatchManager property)
patch_data_or_empty (PatchManager property)
patch_gs_modules() (in module modelopt.onnx.quantization.gs_patching)
patch_hf_model_checkpoint_mapping() (AutoModelDescriptor static method)
patch_layer_config() (AutoModelDescriptor class method)
(ContractAutoModelDescriptor class method)
(GenericContractModelDescriptor class method)
(GptOssModelDescriptor class method)
(ModelDescriptor class method)
patch_ort_modules() (in module modelopt.onnx.quantization.ort_patching)
patch_pipeline_model_part() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
patch_state_dict_adapter() (AutoModelDescriptor static method)
patch_transformers5_params_loading() (in module modelopt.torch.speculative.utils)
PatchManager (class in modelopt.torch.nas.patch)
path (EvaluationCacheSlot attribute)
(ScoringParent attribute)
path_for() (EvaluationCache method)
path_under() (ScenarioKey method)
Pattern
pattern (PatternSchemes attribute)
(TensorAxisRule attribute)
Pattern Cache
pattern_cache_max_entries_per_pattern (Config attribute)
pattern_cache_minimum_distance (Config attribute)
pattern_schemes (PatternCache attribute)
pattern_signature (PatternSchemes property)
pattern_size (PatternSchemes property)
PatternCache (class in modelopt.onnx.quantization.autotune)
PatternSchemes (class in modelopt.onnx.quantization.autotune)
payload (EvaluationRequest attribute)
,
[1]
(Identity attribute)
peak_memory (GPUMemoryMonitor attribute)
PEFTModeDescriptor (class in modelopt.torch.peft.mode)
per_channel_scale (LinearConfig attribute)
per_layer_config (ExportCapabilities attribute)
perc_damp (GPTQCalibConfig attribute)
performance_threshold (Config attribute)
permutation_group_size (EmbeddingPruningSpec attribute)
permute() (in module modelopt.torch.puzzletron.utils.data.dataset)
permute_attention_weights() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
permute_ffn_weights() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
permute_gated_delta_net_state_dict() (in module modelopt.torch.puzzletron.pruning.gated_delta_net)
permute_query_rows_by_head() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
permute_state_dict() (EmbeddingPruningSpec method)
(PLEPruningSpec method)
PERSISTENT_POOL (ExecutionStrategy attribute)
PINNED_INTERSYN (DatasetKind attribute)
pipeline_config_from_path() (in module modelopt.torch.puzzletron.pipeline_config)
pipeline_module_fqns_per_model_part() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
pipeline_parallel (ModelConfig attribute)
pipeline_parallel_size (RuntimeTopology attribute)
placement (TaskTopology attribute)
plan_to_dict() (in module modelopt.torch.puzzletron.orchestration)
ple (GenericDecoderContract attribute)
ple_layer_context() (in module modelopt.torch.puzzletron.pruning.runtime_ple)
ple_pruning_spec() (GenericContractModelDescriptor class method)
(ModelDescriptor class method)
PLEContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
PLEPruningSpec (class in modelopt.torch.puzzletron.pruning.ple_pruning)
policy (SparseSampleManifest attribute)
poll_quit() (TerminalControls method)
pop() (SymMap method)
populate() (SharedQuantState class method)
population (EvolveSearcher attribute)
port (WorkerRecord attribute)
position_embedding (ModelConfig attribute)
position_embedding_type (DecoderLayerConfig attribute)
position_id_axes() (ModelDescriptor static method)
post_distillation_evaluation_stage() (in module modelopt.torch.puzzletron.stages)
post_feedforward_layernorm (DecoderLayerConfig attribute)
post_layernorm (DecoderLayerConfig attribute)
(LayerNormPositionType attribute)
post_mip_execution_contract() (in module modelopt.torch.puzzletron.post_mip.identity)
post_mip_execution_contract_identity() (in module modelopt.torch.puzzletron.post_mip.identity)
post_mip_execution_identity() (in module modelopt.torch.puzzletron.post_mip.identity)
post_mip_node() (in module modelopt.torch.puzzletron.post_mip.base)
post_process() (ConcatNodeProcessor method)
(FP8QuantExporter static method)
(INT4QuantExporter static method)
(INT8QuantExporter static method)
(MXFP8QuantExporter static method)
(NVFP4QuantExporter static method)
(ONNXQuantExporter static method)
PostMIPExecutionContractUnavailable
PostMIPNode (class in modelopt.torch.puzzletron.post_mip.base)
postprocess_amax() (in module modelopt.torch.quantization.model_quant)
postprocess_model_config() (in module modelopt.torch.export.postprocess)
postprocess_runtime_benchmark_checkpoint() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
postprocess_state_dict() (in module modelopt.torch.export.quant_utils)
postprocess_tensors() (in module modelopt.torch.export.postprocess)
pp (GlobalKDConfig attribute)
(ParallelCapabilities attribute)
(ParallelMesh attribute)
(ParallelMeshOverride attribute)
(ParallelTopology attribute)
pp_microbatches() (PuzzletronBatch method)
pp_schedule (GlobalKDConfig attribute)
pp_size (ParallelismSpec attribute)
pre_feedforward_layernorm (DecoderLayerConfig attribute)
pre_layernorm (LayerNormPositionType attribute)
pre_process() (FP8QuantExporter static method)
(INT4QuantExporter static method)
(INT8QuantExporter static method)
(MXFP8QuantExporter static method)
(NVFP4QuantExporter static method)
(ONNXQuantExporter static method)
pre_quant_scale (TensorQuantizer property)
precision (CampaignManifest attribute)
(EvaluationRequest attribute)
PrecisionConverter (class in modelopt.onnx.autocast.precisionconverter)
PrecisionTypes (class in modelopt.onnx.autocast.precisionconverter)
precompile() (in module modelopt.torch.quantization.extensions)
pred_noise_to_pred_x0() (in module modelopt.torch.fastgen.flow_matching)
pred_type (DistillationConfig attribute)
pred_x0_from_flow() (in module modelopt.torch.fastgen.flow_matching)
prefill_context_parallel_size (RuntimeTopology attribute)
prefill_ms (RuntimeMeasurement attribute)
prefill_seq_len (RuntimeConfig attribute)
(VllmMeasurement attribute)
prefix_cache_id() (in module modelopt.torch.puzzletron.distributed_eval)
prep_for_eval() (in module modelopt.torch.nas.patch)
prepare() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt)
prepare_automodel_text_validation_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
prepare_cu_seqlens() (ConstantLengthDataset method)
prepare_enc_dec_export_dir() (in module modelopt.torch.export.tensorrt_llm_utils)
prepare_messages_for_chat_template() (in module modelopt.torch.utils.dataset_utils)
prepare_multimodal_validation_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
prepare_post_mip_candidate_ledger() (in module modelopt.torch.puzzletron.post_mip.identity)
prepare_prefix() (EvaluationMetadataCache method)
prepare_prefix_cache() (EvaluationService method)
prepare_realization_retry() (in module modelopt.torch.puzzletron.checkpoint_transactions)
prepare_t5_decoder_layer() (in module modelopt.torch.export.tensorrt_llm_utils)
prepare_teacher_hidden() (EvaluationMetadataCache method)
prepare_teacher_hidden_cache() (EvaluationService method)
prepare_validation_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders)
prepare_vllm_config() (in module modelopt.torch.puzzletron.export.vllm)
prepare_vllm_deploy_copy() (in module modelopt.torch.puzzletron.export.vllm)
preprocess_linear_fusion() (in module modelopt.torch.export.quant_utils)
prequant_scaling_factor (LinearConfig attribute)
(QKVConfig property)
present (CoverageRow attribute)
print_args() (in module modelopt.torch.utils.logging)
print_quant_summary() (in module modelopt.torch.quantization.model_quant)
print_rank_0() (in module modelopt.torch.utils.logging)
print_search_space_summary() (in module modelopt.torch.nas.utils)
print_sparse_attention_summary() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
print_stat() (in module modelopt.onnx.quantization.graph_utils)
print_summary() (SearchSpace method)
process() (ConcatNodeProcessor method)
PROCESS_GROUP (ErrorKind attribute)
process_layer_quant_config() (in module modelopt.torch.export.quant_utils)
process_model() (ONNXQuantExporter class method)
produced_artifacts (StageTerminalState property)
producer_execution_identity (CandidateSet attribute)
producer_node (CandidateRevision attribute)
profile() (in module modelopt.torch.nas.algorithms)
profile_id (BenchmarkResult attribute)
(MIPProfile attribute)
profile_timestamp (InsertionScheme attribute)
ProfileConstraint (class in modelopt.torch.puzzletron.mip.profiles)
proj (ExpertConfig attribute)
(MLPConfig attribute)
projector_output_config_paths (VisionLanguageContract attribute)
projector_rules (VisionLanguageContract attribute)
provenance (ComposedScoreRecord attribute)
(EvaluationResult attribute)
prunable_axes() (BlockConfig method)
PrunableAxis (class in modelopt.torch.puzzletron.block_config)
prune() (in module modelopt.torch.prune.pruning)
(SymMap method)
prune_single_layer() (ExpertRemovalPruningMixIn method)
(FFNIntermediatePruningMixIn method)
(KVHeadsPruningMixIn method)
(Qwen3P5KVHeadsPruningMixIn method)
PruneAttentionHeads (GQAInitMode attribute)
PruneByActivationsLog (MlpInitMode attribute)
PruneByChannelRanking (HiddenSizeInitMode attribute)
PruneKVHeads (GQAInitMode attribute)
pruning_mixins() (GptOssModelDescriptor static method)
(ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
(Qwen3P5TextModelDescriptor static method)
(Qwen3P5VLModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
PruningMixIn (class in modelopt.torch.puzzletron.pruning.pruning_mixin)
PTQNode (class in modelopt.torch.puzzletron.post_mip.builtin)
publish() (CandidateLedger method)
publish_node() (CandidateLedger method)
put() (EvaluationCache method)
puzzle_dir (CampaignPlan attribute)
PUZZLE_KD_TEXT (DatasetKind attribute)
puzzletron_capabilities() (GenericContractModelDescriptor class method)
(GptOssModelDescriptor class method)
(LlamaModelDescriptor class method)
(NemotronHModelDescriptor static method)
PuzzletronBatch (class in modelopt.torch.puzzletron.dataset)
PuzzletronCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
PuzzletronDataSpec (class in modelopt.torch.puzzletron.dataset)
Q
q (QKVConfig attribute)
Q/DQ Nodes
q_gate_row_group (LayerLayout attribute)
q_head_aux_keys (LayerLayout attribute)
q_key (LayerLayout attribute)
q_layernorm (AttentionConfig attribute)
q_lora_rank (MLAConfig attribute)
q_lora_rank_field (LatentAttentionContract attribute)
q_proj_name (StandardGQAAttentionContract attribute)
qdq_to_dq() (in module modelopt.onnx.quantization.qdq_utils)
QDQAutotuner (class in modelopt.onnx.quantization.autotune)
QDQConvTranspose (class in modelopt.onnx.quantization.operators)
QDQCustomOp (class in modelopt.onnx.quantization.operators)
QDQNormalization (class in modelopt.onnx.quantization.operators)
qk_head_dim (AttentionConfig attribute)
qkv (AttentionConfig attribute)
QKVConfig (class in modelopt.torch.export.model_config)
qkvo_weight_names (GptOssKVHeadsLayerDescriptor attribute)
(KVHeadsLayerDescriptor attribute)
(LlamaKVHeadsLayerDescriptor attribute)
(MistralKVHeadsLayerDescriptor attribute)
(NemotronHKVHeadsLayerDescriptor attribute)
(NemotronHV2KVHeadsLayerDescriptor attribute)
(Qwen3KVHeadsLayerDescriptor attribute)
(Qwen3P5TextKVHeadsLayerDescriptor attribute)
(Qwen3P5VLKVHeadsLayerDescriptor attribute)
(Qwen3VLKVHeadsLayerDescriptor attribute)
QTensorWrapper (class in modelopt.torch.quantization.qtensor.base_qtensor)
quant_cfg (QuantizeConfig attribute)
quant_gemm (CompressConfig attribute)
quant_tensor() (in module modelopt.onnx.quantization.quant_utils)
QuantAdaptiveAvgPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantAdaptiveAvgPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantAdaptiveAvgPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantAvgPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantAvgPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantAvgPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantConv1d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantConv2d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantConv3d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantConvTranspose1d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantConvTranspose2d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantConvTranspose3d (class in modelopt.torch.quantization.nn.modules.quant_conv)
QuantEmbedding (in module modelopt.torch.quantization.nn.modules.quant_embedding)
QuantInputBase (class in modelopt.torch.quantization.nn.modules.quant_module)
QuantInstanceNorm1d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm)
QuantInstanceNorm2d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm)
QuantInstanceNorm3d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm)
quantization (ConvConfig attribute)
(LinearConfig attribute)
(ModelConfig attribute)
quantize() (BaseQuantizedTensor class method)
(FP8QTensor class method)
(in module modelopt.onnx.llm_export_utils.quantization_utils)
(in module modelopt.onnx.quantization)
(in module modelopt.onnx.quantization.fp8)
(in module modelopt.onnx.quantization.int4)
(in module modelopt.onnx.quantization.int8)
(in module modelopt.onnx.quantization.quant_utils)
(in module modelopt.torch.quantization.model_quant)
(INT4QTensor class method)
(INT8QTensor class method)
(MXFP4QTensor class method)
(MXFP8QTensor class method)
(NF4QTensor class method)
(NVFP4QTensor class method)
(QDQConvTranspose method)
(QDQCustomOp method)
(QDQNormalization method)
quantize_weight() (QuantLinearConvBase method)
(QuantRNNBase method)
quantize_weights_to_int4() (in module modelopt.onnx.quantization.qdq_utils)
quantize_weights_to_mxfp8() (in module modelopt.onnx.quantization.qdq_utils)
quantize_with_scale() (MXFP8QTensor class method)
quantized_cell_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn)
quantized_data (BaseQuantizedTensor attribute)
(FP8QTensor attribute)
(INT4QTensor attribute)
(INT8QTensor attribute)
(MXFP4QTensor attribute)
(MXFP8QTensor attribute)
(NF4QTensor attribute)
(NVFP4QTensor attribute)
quantizer_name (QuantizerCfgEntry attribute)
QuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear)
QuantLinearConvBase (class in modelopt.torch.quantization.nn.modules.quant_module)
QuantMaxPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantMaxPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantMaxPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling)
QuantModule (class in modelopt.torch.quantization.nn.modules.quant_module)
QuantRecipe (class in modelopt.torch.quantization.algorithms)
QuantRecipeHparam (class in modelopt.torch.quantization.algorithms)
QuantRNNBase (class in modelopt.torch.quantization.nn.modules.quant_rnn)
QuantRNNFullBase (class in modelopt.torch.quantization.nn.modules.quant_rnn)
quarantine_incomplete_realization() (in module modelopt.torch.puzzletron.checkpoint_transactions)
query_heads_field (StandardGQAAttentionContract attribute)
query_pre_attn_scalar (DecoderLayerConfig attribute)
Qwen2Converter (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter)
Qwen2FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor)
Qwen2ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor)
Qwen3Converter (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter)
Qwen3FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor)
Qwen3KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor)
Qwen3ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor)
Qwen3P5Converter (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_converter)
Qwen3P5KVHeadsPruningMixIn (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5MoeTextModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5MoeVLModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5TextFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5TextGatedDeltaNetLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5TextKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5TextModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5VLFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5VLGatedDeltaNetLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5VLKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3P5VLModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_5.qwen3_5_model_descriptor)
Qwen3VLConverter (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter)
Qwen3VLExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor)
Qwen3VLFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor)
Qwen3VLKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor)
Qwen3VLModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor)
Qwen3VLRemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks)
qwen_type (DecoderLayerConfig attribute)
R
r1_loss() (in module modelopt.torch.fastgen.losses)
raise_unknown_subblock_config_error() (in module modelopt.torch.puzzletron.utils.misc)
rampup_ratio (EMAConfig attribute)
Random (HiddenSizeInitMode attribute)
(LinearInitMode attribute)
(MlpInitMode attribute)
random() (in module modelopt.torch.utils.random)
RandomBlock (GQAInitMode attribute)
RandomDataProvider (class in modelopt.onnx.quantization.calib_utils)
randomize_weights() (in module modelopt.onnx.utils)
randomize_weights_onnx_bytes() (in module modelopt.onnx.utils)
RandomKV (GQAInitMode attribute)
RandomSearcher (class in modelopt.torch.nas.autonas)
rank (ModelConfig attribute)
(PEFTAttributeConfig attribute)
rank() (DistributedProcessGroup method)
(in module modelopt.torch.utils.distributed)
rank_by (HomogeneousPolicy attribute)
rank_homogeneous_solutions() (in module modelopt.torch.puzzletron.mip.search_space)
RankedChoiceVotingHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks)
RankedChoiceVotingHookNemotronH (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks)
raw_artifacts (BenchmarkResult attribute)
read_candidate_library() (in module modelopt.torch.puzzletron.candidates)
read_configs_and_weights_from_rank() (NFSWorkspace method)
read_f16_tensor_as_fp32() (in module modelopt.onnx.utils)
read_stage_manifest() (in module modelopt.torch.puzzletron.manifest)
realization_is_complete() (in module modelopt.torch.puzzletron.checkpoint_transactions)
RealQuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear)
reason (DescriptorResolution attribute)
(JobStatus attribute)
(SparseSampleRecord attribute)
rebase_authored_pipeline_config() (in module modelopt.torch.puzzletron.pipeline_config)
record_call_module() (RobustTracer method)
records (ComposedScoreTable attribute)
recurrent (DecoderLayerConfig attribute)
recurrent_gate (RgLruConfig attribute)
recurrent_param (RgLruConfig attribute)
RecurrentConfig (class in modelopt.torch.export.model_config)
recursive_trace() (GraphCollection method)
(in module modelopt.torch.trace.tracer)
reduce_amax() (in module modelopt.torch.quantization.utils)
reduce_sum() (in module modelopt.torch.quantization.utils)
reduced_axis_values() (GenericDecoderContract method)
reduction_state (EvaluationResult attribute)
ReferenceRunner (class in modelopt.onnx.autocast.referencerunner)
refresh_realized_checkpoint_config() (in module modelopt.torch.puzzletron.utils.vllm_adapter)
Region
(class in modelopt.onnx.quantization.autotune)
region_index (ChildRegionInputInsertionPoint attribute)
(ChildRegionOutputInsertionPoint attribute)
region_outputs (InsertionScheme attribute)
RegionPattern (class in modelopt.onnx.quantization.autotune)
RegionType (class in modelopt.onnx.quantization.autotune)
register() (AutoModelDescriptorFactory class method)
(ConverterFactory class method)
(EvaluationService method)
(in module modelopt.torch.quantization.conversion)
(ModelDescriptorFactory class method)
(SymMap class method)
(TracedHpRegistry class method)
register_activation_hooks() (in module modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils)
register_custom_model_plugins_on_the_fly() (in module modelopt.torch.peft.custom)
(in module modelopt.torch.sparsity.attention_sparsity.plugins)
register_custom_support() (AutoQuantizeGradientSearcher class method)
register_decorator() (AutoModelDescriptorFactory class method)
(ConverterFactory class method)
(ModelDescriptorFactory class method)
register_default() (ModeloptBaseRuleConfig class method)
register_diffusers_triton_attention() (in module modelopt.torch.kernels.sparsity.attention)
register_hydra_resolvers() (in module modelopt.torch.puzzletron.tools.hydra_utils)
register_importance() (Hparam method)
register_leaf() (RobustTracer class method)
register_loss_mask_recovery() (in module modelopt.torch.utils.loss_mask)
register_ltx_triton_attention() (in module modelopt.torch.kernels.sparsity.attention)
register_mask_hook() (in module modelopt.torch.puzzletron.pruning.dynamic_block_prune)
register_native_config_aliases() (in module modelopt.torch.puzzletron.anymodel.registry)
register_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer)
register_sparse_method() (in module modelopt.torch.sparsity.attention_sparsity.methods)
registered_names() (AutoModelDescriptorFactory class method)
rel_attn_max_distance (DecoderLayerConfig attribute)
rel_attn_num_buckets (DecoderLayerConfig attribute)
rel_attn_table (AttentionConfig attribute)
relative (BoundValue attribute)
relative_path (ScenarioKey property)
relative_stats_path (VllmMeasurement property)
RelativeAttentionTableConfig (class in modelopt.torch.export.model_config)
RemoteEvaluationUnsupportedError
RemovableCandidateHandle (class in modelopt.torch.puzzletron.pruning.runtime_candidate)
removals (DepthScenario attribute)
remove() (RemovableCandidateHandle method)
remove_attention (BlockTarget attribute)
remove_bn() (in module modelopt.torch.utils.network)
remove_child() (Region method)
remove_disconnected_outputs() (GraphSanitizer method)
remove_ffn (BlockTarget attribute)
remove_graph_input_q() (in module modelopt.onnx.quantization.qdq_utils)
remove_hooks() (SharedQuantState method)
remove_input_dq_and_output_q() (in module modelopt.onnx.quantization.qdq_utils)
remove_mamba (BlockTarget attribute)
remove_moe (BlockTarget attribute)
remove_node_training_mode() (in module modelopt.onnx.utils)
remove_output_initializers() (in module modelopt.onnx.quantization.graph_utils)
remove_partial_input_qdq() (in module modelopt.onnx.quantization.graph_utils)
remove_realization_temp_dir() (in module modelopt.torch.puzzletron.checkpoint_transactions)
remove_redundant_cast_nodes() (in module modelopt.onnx.quantization.graph_utils)
remove_redundant_casts() (in module modelopt.onnx.utils)
remove_state() (ModeloptStateManager class method)
remove_weights_data() (in module modelopt.onnx.utils)
removed_sublayers (ScenarioKey attribute)
RemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks)
render_aiperf_report() (in module modelopt.torch.puzzletron.post_mip.reporting)
render_downstream_evaluation_report() (in module modelopt.torch.puzzletron.post_mip.reporting)
render_evaluation_report() (in module modelopt.torch.puzzletron.post_mip.reporting)
render_global_kd_report() (in module modelopt.torch.puzzletron.post_mip.reporting)
render_messages_to_text() (in module modelopt.torch.puzzletron.utils.data.dataset)
render_post_mip_node_report() (in module modelopt.torch.puzzletron.post_mip.base)
render_report() (AIPerfNode class method)
(DownstreamEvaluationNode class method)
(EvaluationNode class method)
(GlobalKDNode class method)
(PostMIPNode class method)
repeat_block_n_times (RuntimeConfig attribute)
replace_attention_with_gqa() (in module modelopt.onnx.graph_surgery)
replace_custom_domain_nodes() (GraphSanitizer method)
replace_forward() (in module modelopt.torch.nas.utils)
replace_function() (in module modelopt.torch.quantization.utils)
replace_layernorm_pattern() (GraphSanitizer method)
replace_lora_module() (in module modelopt.torch.peft.conversion)
replace_model_kwargs() (PuzzletronBatch method)
replace_quant_module() (in module modelopt.torch.quantization.conversion)
replace_scale_values() (in module modelopt.onnx.quantization.qdq_utils)
replace_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
replace_zero_scale_with_smallest_nonzero() (in module modelopt.onnx.quantization.qdq_utils)
replacement (SubblockCapabilities attribute)
replacement_cap (SparseSamplingPolicy attribute)
replacement_is_teacher() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
ReplacementLibrary (class in modelopt.torch.puzzletron.replacement_library.library)
replaces_dense_ffn (RoutedMoEContract attribute)
report() (AccumulatingTimer class method)
report_memory() (in module modelopt.torch.utils.perf)
report_order (StageSpec attribute)
representative_weight_quantizer() (in module modelopt.torch.quantization.utils)
request_id (AttemptRecord attribute)
(EvaluationHandle attribute)
(EvaluationRequest property)
(EvaluationResult attribute)
,
[1]
require_attrs (MoELayerDescriptor attribute)
require_boolean_policy() (in module modelopt.torch.puzzletron.security_policy)
require_complete() (CoverageReport method)
require_model_like (ModeDescriptor property)
require_subblock() (BlockConfig method)
required (StageSpec attribute)
required_stage_ids() (in module modelopt.torch.puzzletron.stages)
required_workloads (MIPProfile property)
requires (ArtifactChoice attribute)
requires_rpc (VariantAxis attribute)
requires_trust_remote_code() (ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
requires_vllm (VariantAxis attribute)
ResBlock (class in modelopt.torch.speculative.utils)
reset() (AccumulatingTimer class method)
(BiasCalibrator method)
(ConcatNodeProcessor method)
(HistogramCalibrator method)
(MaxCalibrator method)
(MseCalibrator method)
(NVFP4MSECalibrator method)
(SparseAttentionStatsManager method)
reset_amax() (TensorQuantizer method)
reset_before_sample() (PatchManager method)
reset_bias() (TensorQuantizer method)
reset_choices() (ConcatTracedHp method)
(Hparam method)
reset_dynamic_attributes() (DynamicModule method)
reset_parameters() (MatchingZeros method)
(Same method)
reset_search() (BaseSearcher method)
reshape_1d() (in module modelopt.torch.sparsity.weight_sparsity.magnitude)
reshape_scales_for_per_channel_nodes() (in module modelopt.onnx.quantization.quant_utils)
residual_layernorm (DecoderLayerConfig attribute)
residual_mlp (DecoderLayerConfig attribute)
residual_norm_patterns (EmbeddingPruningSpec attribute)
resmooth_and_get_scale() (in module modelopt.torch.export.quant_utils)
resolve() (ChildRegionInputInsertionPoint method)
(ChildRegionOutputInsertionPoint method)
(NodeInputInsertionPoint method)
resolve_compact_grouped_attention_target() (in module modelopt.torch.puzzletron.pruning.compact_runtime)
resolve_concurrency_metrics() (CandidateLedger method)
resolve_dependencies() (TracedHp method)
resolve_descriptor() (in module modelopt.torch.puzzletron.anymodel.registry)
resolve_descriptor_by_name() (in module modelopt.torch.puzzletron.anymodel.registry)
resolve_descriptor_from_pretrained() (in module modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory)
(in module modelopt.torch.puzzletron.anymodel.registry)
resolve_granularity() (in module modelopt.torch.puzzletron.granularity)
resolve_metric() (CandidateLedger method)
resolve_patterns() (SharedQuantState class method)
resolve_pruning_mixin() (in module modelopt.torch.puzzletron.pruning.pruning_utils)
resolve_score_method() (in module modelopt.torch.puzzletron.anymodel.capabilities)
resolve_scoring_output_dir() (in module modelopt.torch.puzzletron.scoring)
resolve_scoring_parent() (in module modelopt.torch.puzzletron.scoring_parent)
resolve_scoring_paths() (in module modelopt.torch.puzzletron.scoring)
resolve_torch_dtype() (in module modelopt.torch.puzzletron.tools.common)
resolved_student_descriptor (GlobalKDConfig property)
resolved_student_force_hf (GlobalKDConfig property)
resolved_teacher_descriptor (GlobalKDConfig property)
resolved_teacher_force_hf (GlobalKDConfig property)
ResolvedInsertionPoint (class in modelopt.onnx.quantization.autotune)
resource (StageExecutionSpec attribute)
RESOURCE_EXHAUSTED (ErrorKind attribute)
restore (AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(DFlashModeDescriptor property)
(EagleModeDescriptor property)
(ExportNASModeDescriptor property)
(ExportPEFTModeDescriptor property)
(ExportSparseModeDescriptor property)
(ExportStudentModeDescriptor property)
(FastNASModeDescriptor property)
(KnowledgeDistillationModeDescriptor property)
(MedusaModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
restore() (in module modelopt.torch.opt.conversion)
(SharedQuantState class method)
restore_autonas_searchspace() (in module modelopt.torch.nas.autonas)
restore_dflash_model() (in module modelopt.torch.speculative.dflash.conversion)
restore_eagle_model() (in module modelopt.torch.speculative.eagle.conversion)
restore_export_sparse() (in module modelopt.torch.sparsity.weight_sparsity.mode)
restore_fastnas_searchspace() (in module modelopt.torch.prune.fastnas)
restore_from_members() (SharedQuantState method)
restore_from_modelopt_state() (in module modelopt.torch.opt.conversion)
restore_medusa_model() (in module modelopt.torch.speculative.medusa.conversion)
restore_model_config() (in module modelopt.torch.export.model_config_utils)
restore_searchspace() (in module modelopt.torch.nas.autonas)
restore_sparse_attention_model() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
restore_sparse_attention_state() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
restore_sparse_model() (in module modelopt.torch.sparsity.weight_sparsity.mode)
result_atol (CampaignManifest attribute)
result_rtol (CampaignManifest attribute)
RESUME (FailurePolicy attribute)
resume (GlobalKDConfig attribute)
retained_hidden_prefix() (in module modelopt.torch.puzzletron.pruning.runtime_hidden_width)
RETRY (AttemptStatus attribute)
retryable (EvaluationError attribute)
return_tuple_of_size() (in module modelopt.torch.puzzletron.anymodel.puzzformer.no_op)
reverse_latent_moe_transform() (in module modelopt.torch.puzzletron.pruning.latent_moe_surgery)
revision (TextAcquisitionSpec attribute)
(VlmAcquisitionSpec attribute)
revision_id (CandidateRevision attribute)
revision_ids (CandidateSet attribute)
rewind() (CalibrationDataProvider method)
(RandomDataProvider method)
rewrite_checkpoint_key() (in module modelopt.torch.puzzletron.anymodel.converter.generic_decoder)
rewrite_safetensor_checkpoint_keys() (in module modelopt.torch.puzzletron.anymodel.converter.generic_decoder)
rf_alpha() (in module modelopt.torch.fastgen.flow_matching)
rf_sigma() (in module modelopt.torch.fastgen.flow_matching)
rg_lru (RecurrentConfig attribute)
RgLruConfig (class in modelopt.torch.export.model_config)
RmsNorm (LayerNormType attribute)
rnn_hidden_size (DecoderLayerConfig attribute)
RNNLayerForward (class in modelopt.torch.quantization.nn.modules.quant_rnn)
RobustTracer (class in modelopt.torch.trace.tracer)
role (ScoringParent attribute)
root (Campaign property)
ROOT (RegionType attribute)
root_set() (CandidateLedger method)
rope_ratio (DecoderLayerConfig attribute)
rope_scaling (DecoderLayerConfig attribute)
RopeType (class in modelopt.onnx.llm_export_utils.export_utils)
rotary_base (DecoderLayerConfig attribute)
rotary_dim (AttentionConfig attribute)
rotary_pct (DecoderLayerConfig attribute)
rotate (QuantizerAttributeConfig attribute)
rotate_block_size (TensorQuantizer property)
rotate_fp32 (RotateConfig attribute)
rotate_is_enabled (TensorQuantizer property)
rotate_is_fp32 (TensorQuantizer property)
routed_moe (GenericDecoderContract attribute)
RoutedMoEContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
router (MOEConfig attribute)
router_biases (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
router_name (RoutedMoEContract attribute)
router_weights (ExpertRemovalLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
rows (CoverageReport attribute)
rpc (StageCapabilities attribute)
rtn() (in module modelopt.onnx.quantization.quant_utils)
rule_for() (EmbeddingPruningSpec method)
RulerDatasetBuilder (class in modelopt.torch.sparsity.attention_sparsity.calibration)
run() (CampaignController method)
(NodeClassifier method)
(ReferenceRunner method)
(TensorRTPyBenchmark method)
(TrtExecBenchmark method)
run_aiperf_benchmark() (in module modelopt.torch.puzzletron.benchmarks)
run_aiperf_sweep() (in module modelopt.torch.puzzletron.benchmarks)
run_automodel_global_kd() (in module modelopt.torch.puzzletron.distillation.global_automodel)
run_benchmark() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm)
run_depth_mip_scenarios() (in module modelopt.torch.puzzletron.depth)
run_forward_loop() (in module modelopt.torch.utils.network)
run_global_kd() (in module modelopt.torch.puzzletron.distillation.global_automodel)
run_global_kd_tournament() (in module modelopt.torch.puzzletron.distillation.tournament)
run_graph_surgery() (in module modelopt.onnx.graph_surgery)
run_grid_budgeted_mip() (in module modelopt.torch.puzzletron.mip.grid_budgeting)
run_id (MIPProfile attribute)
run_lmms_eval_checkpoint() (in module modelopt.torch.puzzletron.evaluation.lmms)
run_mip() (in module modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements)
(in module modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements_cuopt)
run_mip_sweep() (in module modelopt.torch.puzzletron.mip.sweep)
run_mip_with_backend() (in module modelopt.torch.puzzletron.mip.solver_backend)
run_post_mip_node_shard() (in module modelopt.torch.puzzletron.post_mip.runner)
run_puzzle() (in module modelopt.torch.puzzletron.mip.run_puzzle)
run_search() (BaseSearcher method)
(BaseSparseSearcher method)
(IterativeSearcher method)
run_search_with_stats() (AutoQuantizeGradientSearcher method)
(AutoQuantizeKLDivSearcher method)
run_stage() (in module modelopt.torch.puzzletron.stage_runner)
run_step() (IterativeSearcher method)
run_train_validation_loop() (KnowledgeDistillationRecipeForNextTokenPrediction method)
run_vllm_latency_benchmark() (in module modelopt.torch.puzzletron.subblock_stats.runtime_vllm)
runner (CampaignPlan attribute)
RunnerEnvironment (class in modelopt.torch.puzzletron.orchestration)
runtime_benchmark_base_block_config() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
runtime_benchmark_config_fields() (GptOssModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(Qwen3P5TextModelDescriptor class method)
runtime_benchmark_export_descriptor() (ModelDescriptor class method)
(Qwen3P5MoeVLModelDescriptor class method)
(Qwen3P5VLModelDescriptor class method)
runtime_benchmark_scaffold_policy() (LlamaModelDescriptor class method)
(ModelDescriptor class method)
(NemotronHModelDescriptor class method)
runtime_benchmark_sublayers_are_exclusive() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
runtime_benchmark_supported() (ModelDescriptor class method)
runtime_slice_impl (AxisCapabilities attribute)
runtime_stats (VllmMeasurement attribute)
runtime_vllm_benchmark_args() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
(Qwen3P5TextModelDescriptor class method)
RuntimeConfig (class in modelopt.torch.puzzletron.subblock_stats.runtime_utils)
RuntimeMeasurement (class in modelopt.torch.puzzletron.subblock_stats.runtime_vllm)
RuntimeTopology (class in modelopt.torch.puzzletron.subblock_stats.topology)
S
safe_load() (in module modelopt.torch.utils.serialization)
safe_save() (in module modelopt.torch.utils.serialization)
Same (class in modelopt.torch.puzzletron.anymodel.puzzformer.no_op)
same_device_as() (in module modelopt.torch.utils.tensor)
sample() (BinarySearcher method)
(ElasticSizeSampler method)
(EvolveSearcher method)
(in module modelopt.torch.nas.utils)
(in module modelopt.torch.utils.random)
(IterativeSearcher method)
(RandomSearcher method)
(SearchSpace method)
sample_count (PackedMinitronImportance property)
sample_during_training (AutoNASPatchManager property)
(FastNASPatchManager property)
sample_from_t_list() (in module modelopt.torch.fastgen.flow_matching)
sample_id (SparseSampleRecord attribute)
sample_ids (PuzzletronBatch attribute)
sample_offsets (PackedSequenceMetadata attribute)
sample_replacement_candidates() (in module modelopt.torch.puzzletron.sampling)
sample_subblock_configs() (in module modelopt.torch.puzzletron.sampling)
sample_t_cfg (DistillationConfig attribute)
sample_timesteps() (DistillationPipeline method)
(in module modelopt.torch.fastgen.flow_matching)
samples (CalibrationConfig attribute)
(IterativeSearcher attribute)
samples_hashing_enabled() (in module modelopt.torch.puzzletron.utils.sample_hash)
sanitize() (GraphSanitizer method)
sanitize_io_casts() (GraphSanitizer method)
sanitize_search_config() (AutoQuantizeGradientSearcher method)
(AutoQuantizeKLDivSearcher method)
(BaseSearcher method)
(BaseSparseSearcher method)
(IterativeSearcher method)
save() (in module modelopt.torch.opt.conversion)
(PatternCache method)
save_checkpoint() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
save_checkpoint_from_shards() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
save_consolidated (GlobalKDConfig attribute)
save_expert_token_count_table() (in module modelopt.torch.export.moe_utils)
save_hook_states() (ForwardHook class method)
save_mode_in_state (ExportStudentModeDescriptor property)
(KnowledgeDistillationModeDescriptor property)
(ModeDescriptor property)
save_model() (in module modelopt.torch.puzzletron.subblock_stats.runtime_utils)
save_model_as_anymodel() (in module modelopt.torch.puzzletron.subblock_stats.runtime_utils)
save_model_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
save_multi_layer_outputs() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs)
save_onnx() (in module modelopt.onnx.utils)
save_onnx_bytes_to_dir() (in module modelopt.onnx.utils)
save_search_checkpoint() (BaseSearcher method)
save_subblocks() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf)
scaffold_policy (RuntimeConfig attribute)
scaffolded_layout() (in module modelopt.torch.puzzletron.subblock_stats.runtime_estimator)
scale (PEFTAttributeConfig attribute)
SCALE_DTYPE (MXFP8QTensor attribute)
scaled_dot_product_attention() (in module modelopt.torch.quantization.export_onnx)
scaled_e4m3_impl() (in module modelopt.torch.quantization.tensor_quant)
ScaledE4M3Function (class in modelopt.torch.quantization.tensor_quant)
scenario_id (DepthScenario property)
ScenarioKey (class in modelopt.torch.puzzletron.scenarios)
schema_version (AttemptRecord attribute)
(CampaignManifest attribute)
(EvaluationRequest attribute)
(EvaluationResult attribute)
(WorkerRecord attribute)
schemes (PatternSchemes attribute)
score_hooks (AxisCapabilities attribute)
score_identity (Candidate attribute)
score_identity() (in module modelopt.torch.puzzletron.identity)
score_module_rules (AutoQuantizeGradientSearcher attribute)
scored_dim (MagnitudeFallbackSpec attribute)
scores() (PackedMinitronImportance method)
scoring (StageCapabilities attribute)
scoring_stage() (in module modelopt.torch.puzzletron.stages)
ScoringParent (class in modelopt.torch.puzzletron.scoring_parent)
search() (BaseSearcher method)
(in module modelopt.torch.nas.algorithms)
search_algorithm (AutoNASModeDescriptor property)
(FastNASModeDescriptor property)
(ModeDescriptor property)
(SparseGPTModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
search_regions() (CombinedRegionSearch method)
search_space_size() (in module modelopt.torch.opt.utils)
SearchSpace (class in modelopt.torch.nas.search_space)
(class in modelopt.torch.puzzletron.search_space)
seed (GlobalKDConfig attribute)
(SparseSamplingPolicy attribute)
(TextAcquisitionSpec attribute)
(VlmAcquisitionSpec attribute)
select() (DynamicSpace method)
(in module modelopt.torch.nas.utils)
selected (SparseSampleManifest attribute)
selected_parent_stage_ids() (in module modelopt.torch.puzzletron.stages)
SELECTOR (NodeKind attribute)
self_attention (DecoderLayerConfig attribute)
self_attention_layernorm (DecoderLayerConfig attribute)
semantic_config (StageManifest attribute)
semantic_config_identity (StageManifest property)
semantic_config_sections (StageSpec attribute)
semantic_identity (StageManifest property)
semantic_stage_config() (in module modelopt.torch.puzzletron.manifest)
(in module modelopt.torch.puzzletron.stages)
sensitivity_map (BinarySearcher attribute)
seq_ids (PackedSequenceMetadata attribute)
seq_length (DecoderLayerConfig attribute)
sequence (PuzzletronBatch attribute)
sequence_length (CrossModelCampaign attribute)
(PuzzletronBatch property)
(PuzzletronDataSpec property)
sequence_parallel (GlobalKDConfig attribute)
(ParallelCapabilities attribute)
(ParallelismSpec attribute)
sequence_parallel_supported (GenericDecoderContract attribute)
SequentialQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer)
set_block_configs() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
set_calibration_mode() (SparseAttentionMethod method)
(SparseAttentionStatsManager method)
set_expert_quantizer_amax() (in module modelopt.torch.export.layer_utils)
set_from_attribute_config() (HardDisabledTensorQuantizer method)
(SequentialQuantizer method)
(SparseAttentionModule method)
(TensorQuantizer method)
set_from_modelopt_state() (TensorQuantizer method)
set_ir_version() (GraphSanitizer method)
set_mask() (SparseModule method)
set_members() (SharedQuantState method)
set_modelopt_patches_enabled (class in modelopt.torch.nas.utils)
set_quantizer_attribute() (in module modelopt.torch.quantization.conversion)
set_quantizer_attributes_full() (in module modelopt.torch.quantization.conversion)
set_quantizer_attributes_partial() (in module modelopt.torch.quantization.conversion)
set_quantizer_by_cfg() (in module modelopt.torch.quantization.conversion)
set_quantizer_by_cfg_context() (in module modelopt.torch.quantization.conversion)
set_shapes() (TensorRTPyBenchmark method)
set_skip_softmax_context() (in module modelopt.torch.kernels.sparsity.attention)
set_skippable() (SymDepth method)
set_sparse_attention_attribute() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
set_sparse_attention_by_cfg() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
set_student_loss_reduction_fn() (DistillationLossBalancer method)
set_submodule() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils)
(in module modelopt.torch.utils.network)
set_symbol() (SymMap method)
set_trt_plugin_domain() (in module modelopt.onnx.trt_utils)
settings (EvaluationRequest attribute)
settings_identity (CandidateLibrary attribute)
setup() (KnowledgeDistillationRecipeForNextTokenPrediction method)
(KnowledgeDistillationRecipeForVLM method)
setup_mappings() (in module modelopt.onnx.autocast.utils)
shape (TensorStats attribute)
shard_count (WorkItem attribute)
shard_index (WorkItem attribute)
SHARDED (ExecutionStrategy attribute)
share_embedding_table (ModelConfig attribute)
shared_expert (MOEConfig attribute)
shared_expert_gate (MOEConfig attribute)
shared_expert_intermediate_size (MoEConfig attribute)
shared_expert_name (RoutedMoEContract attribute)
shared_experts_name (MoELayerDescriptor attribute)
shared_experts_prefix() (MoELayerDescriptor method)
shared_intermediate_field (RoutedMoEContract attribute)
shared_kv_layers_field (GatedDenseFFNContract attribute)
(StandardGQAAttentionContract attribute)
SharedQuantState (class in modelopt.torch.quantization.utils)
SharedWeightGlobalAmaxState (class in modelopt.torch.quantization.utils)
shell (CommandSpec attribute)
shift (SampleTimestepConfig attribute)
should_quantize_to_8bit() (in module modelopt.onnx.quantization.graph_utils)
shrink_step (AWQClipCalibConfig attribute)
shuffle() (in module modelopt.torch.utils.random)
shutdown() (CampaignController method)
ShutdownAction (class in modelopt.torch.puzzletron.orchestration)
silence_matched_warnings() (in module modelopt.torch.utils.logging)
simple_parse_args_string() (in module modelopt.torch.puzzletron.utils.parsing)
SINGLE (ExecutionStrategy attribute)
site_names (PackedMinitronImportance property)
size (PrunableAxis attribute)
(TensorStats property)
size() (DynamicSpace method)
(in module modelopt.torch.utils.distributed)
sizeof_dtype() (in module modelopt.torch.puzzletron.utils.misc)
skip_init() (in module modelopt.torch.puzzletron.tools.checkpoint_utils)
skip_reason (StageManifest attribute)
(StageResult attribute)
(StageTerminalState attribute)
skip_softmax_threshold (SparseAttentionAttributeConfig attribute)
skippable_idxs (SymDepth property)
SKIPPED (StageStatus attribute)
slice_attention_weights() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
slice_ffn_weights() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
slice_gated_delta_net_state_dict() (in module modelopt.torch.puzzletron.pruning.gated_delta_net)
slice_mamba2_state_dict() (in module modelopt.torch.puzzletron.pruning.mamba2_surgery)
slice_query_rows_by_head() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
slice_state_dict() (EmbeddingPruningSpec method)
(PLEPruningSpec method)
sliced_shape() (EmbeddingPruningSpec method)
sliding_window_size (AttentionConfig attribute)
slug (DepthSelection property)
slurm (RunnerEnvironment attribute)
smoothquant() (in module modelopt.torch.quantization.model_calib)
solution_id (BenchmarkResult attribute)
solution_identity() (in module modelopt.torch.puzzletron.identity)
solution_index (ComposedScoreRecord attribute)
solution_to_str() (in module modelopt.torch.puzzletron.utils.misc)
solver (MIPProfile attribute)
SolverOptions (class in modelopt.torch.puzzletron.mip.profiles)
sort (StageCapabilities attribute)
sort_equivalence_stage() (in module modelopt.torch.puzzletron.stages)
sort_impl (AxisCapabilities attribute)
sort_kind (PrunableAxis attribute)
sort_mamba2_state_dict() (in module modelopt.torch.puzzletron.pruning.mamba2_surgery)
sort_parameters() (SearchSpace method)
sort_replacements() (in module modelopt.torch.puzzletron.mip.utils)
sort_stage() (in module modelopt.torch.puzzletron.stages)
sort_state_dict() (in module modelopt.torch.puzzletron.pruning.sorted_teacher)
sortable (AxisCapabilities attribute)
sorted_attention_keep_indices() (in module modelopt.torch.puzzletron.pruning.attention_ffn_surgery)
sorted_teacher_fingerprint (ScoringParent attribute)
sorted_teacher_layout_kwargs() (GptOssModelDescriptor static method)
(NemotronHModelDescriptor static method)
sorted_teacher_path (ScoringParent attribute)
source (TextAcquisitionSpec attribute)
(VlmAcquisitionSpec attribute)
source_identity (Candidate attribute)
source_kind (Candidate attribute)
source_metadata (PuzzletronBatch attribute)
source_result_ids (ComposedScoreRecord attribute)
source_revision() (CandidateLedger method)
source_revision_id (NodeObservation attribute)
sparse_cfg (FlashSkipSoftmaxConfig attribute)
(SparseAttentionConfig attribute)
(VSAConfig attribute)
sparse_mixer_epsilon (DecoderLayerConfig attribute)
SparseAttentionMethod (class in modelopt.torch.sparsity.attention_sparsity.methods)
SparseAttentionModeDescriptor (class in modelopt.torch.sparsity.attention_sparsity.mode)
SparseAttentionModule (class in modelopt.torch.sparsity.attention_sparsity.sparse_attention)
SparseAttentionStatsManager (class in modelopt.torch.sparsity.attention_sparsity.stats_manager)
SparseGPTModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode)
SparseGPTSearcher (class in modelopt.torch.sparsity.weight_sparsity.sparsegpt)
SparseMagnitudeModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode)
SparseModule (class in modelopt.torch.sparsity.weight_sparsity.module)
SparseSampleManifest (class in modelopt.torch.puzzletron.sampling)
SparseSampleRecord (class in modelopt.torch.puzzletron.sampling)
SparseSamplingPolicy (class in modelopt.torch.puzzletron.sampling)
sparsify() (in module modelopt.torch.sparsity.attention_sparsity.model_sparsify)
(in module modelopt.torch.sparsity.weight_sparsity.sparsification)
sparsity_m (SparseAttentionAttributeConfig attribute)
sparsity_n (SparseAttentionAttributeConfig attribute)
split_config_and_weights() (in module modelopt.torch.export.model_config_utils)
split_passthrough_state_dict() (ModelDescriptor class method)
split_replacements_to_teacher_and_student() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
squared_sums() (PackedMinitronImportance method)
stable_hash() (in module modelopt.torch.puzzletron.identity)
stage (CampaignStageIdentity attribute)
(StageManifest attribute)
(StageResult attribute)
stage_display_name() (in module modelopt.torch.puzzletron.stages)
stage_execution_policy() (ModelDescriptor class method)
stage_id (AttemptSpec attribute)
(CompiledPostMIPNode attribute)
(StageExecutionSpec attribute)
(StageSpec attribute)
(WorkItem attribute)
(WorkPlan attribute)
stage_identity() (in module modelopt.torch.puzzletron.identity)
stage_ids() (in module modelopt.torch.puzzletron.stages)
stage_is_enabled() (in module modelopt.torch.puzzletron.stages)
stage_manifest_from_config() (in module modelopt.torch.puzzletron.manifest)
stage_manifest_uses_execution_record() (in module modelopt.torch.puzzletron.execution_record)
stage_spec() (in module modelopt.torch.puzzletron.stages)
stage_terminal_state() (in module modelopt.torch.puzzletron.stages)
StageCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
StageExecutionSpec (class in modelopt.torch.puzzletron.orchestration)
StageManifest (class in modelopt.torch.puzzletron.manifest)
StageResult (class in modelopt.torch.puzzletron.stage_runner)
stages (CampaignPlan attribute)
(PuzzletronCapabilities attribute)
StageSkipReason (class in modelopt.torch.puzzletron.stages)
StageSpec (class in modelopt.torch.puzzletron.stages)
StageStatus (class in modelopt.torch.puzzletron.stages)
StageTerminalState (class in modelopt.torch.puzzletron.stages)
stale_reason (StageManifest attribute)
StandardGQAAttentionContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
standardize_constructor_args() (in module modelopt.torch.utils.network)
standardize_model_args() (in module modelopt.torch.utils.network)
standardize_model_like_tuple() (in module modelopt.torch.utils.network)
standardize_named_model_args() (in module modelopt.torch.utils.network)
start() (AccumulatingTimer method)
(GPUMemoryMonitor method)
(TerminalControls method)
(Timer method)
start_iter (EMAConfig attribute)
start_multiplier (LocalHessianCalibConfig attribute)
(MseCalibConfig attribute)
started_at (BenchmarkResult attribute)
(StageManifest attribute)
(WorkerRecord attribute)
STARTING (WorkerState attribute)
stat_name (ProfileConstraint attribute)
state (JobStatus attribute)
(WorkerRecord attribute)
state_dict() (BaseSearcher method)
(DistillationModel method)
(ExponentialMovingAverage method)
(ForwardHook method)
(IndependentChannelContributionHook method)
(IndependentKvHeadContributionHook method)
(IterativeChannelContributionHook method)
(L2NormHook method)
(LayerNormContributionHook method)
(ModeloptStateManager method)
(RankedChoiceVotingHook method)
(RemoveExpertsIndependentHook method)
state_dim (Mamba2TensorLayout attribute)
(MambaConfig attribute)
state_version (ModeloptStateManager property)
static_blockwise_fp4_fake_quant() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel)
StaticBlockwiseFP4FakeQuantFunction (class in modelopt.torch.quantization.tensor_quant)
StaticLossBalancer (class in modelopt.torch.distill.loss_balancers)
stats() (in module modelopt.torch.utils.list)
stats_identity (Candidate attribute)
status (AttemptRecord attribute)
(NodeObservation attribute)
(StageManifest attribute)
(StageResult attribute)
(StageTerminalState attribute)
status() (AsyncEvaluationClient method)
(EvaluationClient method)
step (AxisSearchConfig attribute)
step_size (LocalHessianCalibConfig attribute)
(MseCalibConfig attribute)
(TensorQuantizer property)
stop() (AccumulatingTimer method)
(GPUMemoryMonitor method)
(TerminalControls method)
(Timer method)
stop_multiplier (LocalHessianCalibConfig attribute)
(MseCalibConfig attribute)
StoreWithExplicitFlag (class in modelopt.onnx.quantization.autotune)
str_full (PrecisionTypes attribute)
str_short (PrecisionTypes attribute)
strategy (StageExecutionSpec attribute)
(WorkPlan attribute)
strict (ExportConfig attribute)
STRICT (FailurePolicy attribute)
STRUCTURAL_DESCRIPTOR (ContractAutoModelDescriptor attribute)
student_descriptor (GlobalKDConfig attribute)
student_dir (GlobalKDConfig attribute)
student_force_hf (GlobalKDConfig attribute)
student_model_kwargs (GlobalKDConfig attribute)
student_sample_steps (DistillationConfig attribute)
student_sample_type (DistillationConfig attribute)
student_update_freq (DMDConfig attribute)
subblock (PrunableAxis attribute)
(VariantAxis attribute)
subblock_config (SparseSampleRecord attribute)
subblock_config_to_str() (in module modelopt.torch.puzzletron.utils.misc)
subblock_configs (BlockConfig attribute)
subblock_filter (SearchSpace attribute)
subblock_kind (AxisCapabilities attribute)
(SparseSampleRecord attribute)
subblock_name (SparseSampleRecord attribute)
SubblockCapabilities (class in modelopt.torch.puzzletron.anymodel.capabilities)
SubblockConfig (class in modelopt.torch.puzzletron.block_config)
SubblockRef (class in modelopt.torch.puzzletron.block_config)
subblocks (PuzzletronCapabilities attribute)
subblocks() (BlockConfig method)
submit() (AsyncEvaluationClient method)
(EvaluationClient method)
submit_many() (AsyncEvaluationClient method)
subset_rows (VlmAcquisitionSpec attribute)
subsets (VlmAcquisitionSpec attribute)
SUCCEEDED (AttemptStatus attribute)
SUCCESS (FailureClass attribute)
(StageStatus attribute)
supported_hooks() (ExpertRemovalPruningMixIn method)
(FFNIntermediatePruningMixIn method)
(GatedDeltaNetPruningMixIn method)
(KVHeadsPruningMixIn method)
(MambaPruningMixIn method)
(MoEPruningMixIn method)
(PruningMixIn method)
supports_compact_gated_delta_net() (in module modelopt.torch.puzzletron.pruning.compact_runtime)
supports_compact_grouped_attention() (in module modelopt.torch.puzzletron.pruning.compact_runtime)
svdquant() (in module modelopt.torch.quantization.model_calib)
SVDQuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear)
swizzle_nvfp4_scales() (in module modelopt.torch.export.diffusers_utils)
Symbol (class in modelopt.torch.trace.symbols)
Symbol.CLType (class in modelopt.torch.trace.symbols)
symbolic() (DynamicBlockQuantizationFunction static method)
(FakeTensorQuantFunction static method)
(ScaledE4M3Function static method)
SymDepth (class in modelopt.torch.trace.modules.nn)
SymDict (SymInfo attribute)
SymInfo (class in modelopt.torch.trace.symbols)
SymMap (class in modelopt.torch.trace.symbols)
SymRegisterFunc (SymMap attribute)
sync() (SharedQuantState method)
(SharedWeightGlobalAmaxState method)
sync_amax_across_distributed_group() (TensorQuantizer method)
sync_expert_weight_amax (MaxCalibConfig attribute)
sync_moe_gate_up_amax() (in module modelopt.torch.export.layer_utils)
T
t_list (SampleTimestepConfig attribute)
target_expert_intermediate (BlockTarget attribute)
target_intermediate (BlockTarget attribute)
target_kv_lora_rank (BlockTarget attribute)
target_latent_dim (BlockTarget attribute)
target_mamba_groups (BlockTarget attribute)
target_mamba_head_dim (BlockTarget attribute)
target_mamba_heads (BlockTarget attribute)
target_mamba_state_dim (BlockTarget attribute)
target_mla_heads (BlockTarget attribute)
target_name (ExpertRemovalLayerDescriptor attribute)
(GatedDeltaNetLayerDescriptor attribute)
(GptOssExpertRemovalLayerDescriptor attribute)
(MambaLayerDescriptor attribute)
(MoELayerDescriptor attribute)
(NemotronHExpertRemovalLayerDescriptor attribute)
(NemotronHV2ExpertRemovalLayerDescriptor attribute)
(Qwen3P5TextGatedDeltaNetLayerDescriptor attribute)
(Qwen3P5VLGatedDeltaNetLayerDescriptor attribute)
(Qwen3VLExpertRemovalLayerDescriptor attribute)
target_num_experts (BlockTarget attribute)
target_num_kv (BlockTarget attribute)
target_num_q (BlockTarget attribute)
target_q_lora_rank (BlockTarget attribute)
target_quantizer_kind (SharedQuantState attribute)
(SharedWeightGlobalAmaxState attribute)
target_shared_expert_intermediate (BlockTarget attribute)
target_sparse_ratio (CalibrationConfig attribute)
task_count (TaskTopology attribute)
task_topology (AttemptSpec attribute)
TaskLauncher (class in modelopt.torch.puzzletron.orchestration)
tasks_per_group (TaskTopology attribute)
TaskTopology (class in modelopt.torch.puzzletron.orchestration)
teacher_descriptor (GlobalKDConfig attribute)
teacher_dir (GlobalKDConfig attribute)
teacher_force_hf (GlobalKDConfig attribute)
teacher_model (DistillationModel property)
(KDLossConfig attribute)
teacher_model_kwargs (GlobalKDConfig attribute)
temperature (GlobalKDConfig attribute)
(KDLossTermConfig attribute)
temporary_set_config_value() (in module modelopt.torch.speculative.utils)
tensor_bindings (PrunableAxis attribute)
(SubblockCapabilities attribute)
tensor_name (ResolvedInsertionPoint attribute)
tensor_parallel (ModelConfig attribute)
tensor_parallel_size (RuntimeTopology attribute)
tensor_rules (EmbeddingPruningSpec attribute)
(MTPContract attribute)
tensor_selector (MagnitudeFallbackSpec attribute)
TensorAxisRule (class in modelopt.torch.puzzletron.pruning.embedding_pruning)
TensorQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer)
TensorQuantizerCache (class in modelopt.torch.quantization.nn.modules.tensor_quantizer)
TensorRT Timing Cache
TensorRTPyBenchmark (class in modelopt.onnx.quantization.autotune)
TensorStats (class in modelopt.onnx.autocast.referencerunner)
TerminalControls (class in modelopt.torch.puzzletron.orchestration)
TEXT (Modality attribute)
TextAcquisitionSpec (class in modelopt.torch.puzzletron.dataset)
threshold_trials (CalibrationConfig attribute)
thresholds (SparseAttentionAttributeConfig attribute)
tie_groups (EmbeddingPruningSpec attribute)
tie_member_quantizer() (SharedQuantState method)
(SharedWeightGlobalAmaxState method)
tie_member_quantizers() (SharedQuantState method)
time_dist_type (SampleTimestepConfig attribute)
TIMEOUT (ErrorKind attribute)
TIMEOUT_FATAL (FailureClass attribute)
TIMEOUT_RESUMABLE (FailureClass attribute)
Timer (class in modelopt.torch.utils.perf)
timing (EvaluationResult attribute)
to() (LowMemorySparseTensor method)
(PuzzletronBatch method)
(QTensorWrapper method)
to_blockconfig() (AttentionConfig method)
(FFNConfig method)
to_dense() (LowMemorySparseTensor method)
to_dict() (AxisSearchConfig method)
(BaseDataclass method)
(BlockConfig method)
(CampaignModel method)
(Candidate method)
(CandidateLibrary method)
(ChildRegionInputInsertionPoint method)
(ChildRegionOutputInsertionPoint method)
(DescriptorResolution method)
(EvaluationCacheSlot method)
(EvaluationRequest method)
(EvaluationResult method)
(ForwardHook method)
(GlobalKDConfig method)
(GlobalKDResult method)
(Identity method)
(IndependentChannelContributionHook method)
(IndependentKvHeadContributionHook method)
(InsertionScheme method)
(IterativeChannelContributionHook method)
(L2NormHook method)
(LayerNormContributionHook method)
(NodeInputInsertionPoint method)
(PatternCache method)
(PatternSchemes method)
(PuzzletronCapabilities method)
(RankedChoiceVotingHook method)
(RemoveExpertsIndependentHook method)
(ResolvedInsertionPoint method)
(RuntimeMeasurement method)
(RuntimeTopology method)
(ScoringParent method)
(SearchSpace method)
(SparseSampleManifest method)
(SparseSampleRecord method)
(StageManifest method)
(VllmMeasurement method)
to_empty_if_meta_device() (in module modelopt.torch.utils.tensor)
to_quantized_weight() (in module modelopt.torch.export.quant_utils)
to_wire() (EvaluationRequest method)
tokenize() (AcceptanceRateValidation method)
tokenizer_path (RuntimeConfig attribute)
top_k (MoEConfig attribute)
top_k_field (RoutedMoEContract attribute)
top_k_ratio (VSAAttributeConfig attribute)
top_percent_to_mutate (Config attribute)
topological_mapping_items() (in module modelopt.torch.puzzletron.stages)
topological_stage_ids() (in module modelopt.torch.puzzletron.stages)
topology (BenchmarkResult attribute)
(CampaignModel attribute)
(RuntimeConfig attribute)
(VllmMeasurement property)
topology_exception (CampaignModel attribute)
topology_id (BenchmarkResult attribute)
topology_order (StageSpec attribute)
torch_detach() (in module modelopt.torch.utils.tensor)
torch_dtype (GlobalKDConfig attribute)
torch_to() (in module modelopt.torch.utils.tensor)
torch_to_numpy() (in module modelopt.torch.utils.tensor)
torch_to_onnx() (in module modelopt.onnx.llm_export_utils.export_utils)
torch_to_tensorrt_llm_checkpoint() (in module modelopt.torch.export.model_config_export)
TORCHRUN (TaskLauncher attribute)
total (DepthSelection property)
total_ms (RuntimeMeasurement attribute)
total_prefix() (DepthSelection class method)
total_schemes (PatternCache property)
tp (GlobalKDConfig attribute)
(LinearConfig attribute)
(ParallelCapabilities attribute)
(ParallelMesh attribute)
(ParallelMeshOverride attribute)
(ParallelTopology attribute)
tp_size (ParallelismSpec attribute)
trace() (RobustTracer method)
traceback (EvaluationError attribute)
TracedHp (class in modelopt.torch.nas.traced_hp)
TracedHpRegistry (class in modelopt.torch.nas.traced_hp)
train() (DistillationModel method)
train_samples (TextAcquisitionSpec attribute)
TrainingFlashKLD (class in modelopt.torch.puzzletron.distillation.flash_kld)
transfer_state_dict() (ModeloptStateManager class method)
transformed_fc2 (LatentMoETransform attribute)
TRANSFORMER (NodeKind attribute)
TRANSIENT (FailureClass attribute)
TRANSPORT (ErrorKind attribute)
transpose_dequantize_linear_weights() (in module modelopt.onnx.graph_surgery)
Tree (class in modelopt.torch.speculative.utils)
TreeNode (class in modelopt.torch.speculative.utils)
trt_high_precision_dtype (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
TrtExecBenchmark (class in modelopt.onnx.quantization.autotune)
Truncate (HiddenSizeInitMode attribute)
(MlpInitMode attribute)
truncate_pattern_for_subblock() (ModelDescriptor static method)
(NemotronHModelDescriptor static method)
(NemotronHV2ModelDescriptor static method)
trust_remote_code (GlobalKDConfig attribute)
TVDLoss (class in modelopt.torch.puzzletron.distillation.loss)
type (EMAConfig attribute)
(QuantizerAttributeConfig attribute)
type_name (AIPerfNode attribute)
(DownstreamEvaluationNode attribute)
(EvaluationNode attribute)
(FilterNode attribute)
(GlobalKDNode attribute)
(ManualFilterNode attribute)
(MaterializeNode attribute)
(PostMIPNode attribute)
(PTQNode attribute)
U
UNKNOWN (FailureClass attribute)
unpatch() (PatchManager method)
unregister() (in module modelopt.torch.quantization.conversion)
(SymMap class method)
(TracedHpRegistry class method)
unregister_default() (ModeloptBaseRuleConfig class method)
unregister_leaf() (RobustTracer class method)
unregister_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer)
unsigned (QuantizerAttributeConfig attribute)
(TensorQuantizer property)
UNSUPPORTED (ErrorKind attribute)
unwrap_model() (in module modelopt.torch.utils.network)
up_key (LayerLayout attribute)
up_proj_name (GatedDenseFFNContract attribute)
(RoutedMoEContract attribute)
update() (ExponentialMovingAverage method)
(ModeloptBaseConfig method)
(PackedMinitronImportance method)
update_attributes_for_per_channel_nodes() (in module modelopt.onnx.quantization.qdq_utils)
update_autonas_metadata() (in module modelopt.torch.nas.autonas)
update_block_size() (in module modelopt.onnx.quantization.quant_utils)
update_config() (EmbeddingPruningSpec method)
update_config_object() (EmbeddingPruningSpec method)
update_domain() (in module modelopt.onnx.utils)
update_ema() (DMDPipeline method)
update_experts_avg_prequant_scale() (in module modelopt.torch.export.layer_utils)
update_for_new_mode (AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(FastNASModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
update_for_save (AutoNASModeDescriptor property)
(BaseCalibrateModeDescriptor property)
(FastNASModeDescriptor property)
(ModeDescriptor property)
(PEFTModeDescriptor property)
(SparseAttentionModeDescriptor property)
(SparseMagnitudeModeDescriptor property)
update_last_state_before_new_mode() (ModeloptStateManager method)
update_last_state_before_save() (ModeloptStateManager method)
update_layer_lora() (LoRAModule method)
update_lm_head_quantization() (in module modelopt.torch.export.postprocess)
update_model() (in module modelopt.torch.peft.convert)
update_model_config() (in module modelopt.torch.puzzletron.tools.bypassed_training.child_init)
update_quant_cfg_with_kv_cache_quant() (in module modelopt.torch.quantization.utils)
update_runtime_benchmark_config() (ModelDescriptor class method)
(NemotronHModelDescriptor class method)
update_sparse_attention_metadata() (in module modelopt.torch.sparsity.attention_sparsity.conversion)
update_sparse_metadata() (in module modelopt.torch.sparsity.weight_sparsity.mode)
update_trt_ep_support() (in module modelopt.onnx.quantization.ort_utils)
upgrade_opset_21() (in module modelopt.onnx.quantization.fp8)
upstream_identities (CampaignStageIdentity attribute)
use_alibi (DecoderLayerConfig attribute)
use_cache (DecoderLayerConfig attribute)
use_constant_amax (QuantizerAttributeConfig attribute)
use_qk_norm (Llama4AttentionConfig attribute)
use_rope (Llama4AttentionConfig attribute)
use_trt_qdq_ops() (in module modelopt.onnx.quantization.qdq_utils)
uses_autocast() (ModelDescriptor static method)
(Qwen3VLModelDescriptor static method)
V
v (QKVConfig attribute)
v_cache_bias (AttentionConfig attribute)
v_cache_scaling_factor (AttentionConfig attribute)
v_head_dim (AttentionConfig attribute)
v_key (LayerLayout attribute)
v_proj_name (StandardGQAAttentionContract attribute)
val2list() (in module modelopt.torch.utils.list)
val2tuple() (in module modelopt.torch.utils.list)
validate() (AcceptanceRateValidation method)
(CampaignModel method)
(CrossModelCampaign method)
(LatentMoETensorLayout method)
(Mamba2TensorLayout method)
(ParallelTopology method)
(StandardGQAAttentionContract method)
validate_8bit_layers() (in module modelopt.onnx.quantization.graph_utils)
validate_attr() (TensorQuantizer method)
validate_batch_size() (in module modelopt.onnx.utils)
validate_capabilities() (in module modelopt.torch.puzzletron.anymodel.capabilities)
validate_config() (FilterNode class method)
(PostMIPNode class method)
validate_filter_config() (in module modelopt.torch.puzzletron.post_mip.filters)
validate_model() (in module modelopt.torch.puzzletron.tools.validate_model)
validate_model_dimensions() (RuntimeTopology method)
validate_online() (AcceptanceRateValidation method)
validate_onnx() (in module modelopt.onnx.utils)
validate_op_types_spelling() (in module modelopt.onnx.quantization.graph_utils)
validate_puzzle_solutions() (in module modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements)
validate_request() (Campaign method)
validate_rule() (ModeloptBaseRule class method)
validate_scale_shape_for_per_channel_nodes() (in module modelopt.onnx.quantization.qdq_utils)
validate_stage_execution_record() (in module modelopt.torch.puzzletron.execution_record)
(in module modelopt.torch.puzzletron.manifest)
validate_width() (EmbeddingPruningSpec method)
validation_enabled (GlobalKDConfig attribute)
validation_samples (TextAcquisitionSpec attribute)
validation_split (GlobalKDConfig attribute)
value (BoundValue attribute)
(Identity attribute)
value_dim (GDNPermutation attribute)
value_head_dim (GDNShape attribute)
value_heads_per_group (GDNShape property)
value_lanes (GDNPermutation attribute)
values (AxisCapabilities attribute)
(AxisSearchConfig attribute)
(VariantAxis attribute)
values() (ModeloptBaseConfig method)
variant_axes() (BlockConfig method)
variant_id (MIPProfile attribute)
variant_only (AxisCapabilities attribute)
VariantAxis (class in modelopt.torch.puzzletron.block_config)
verbose (Config attribute)
verify_campaign_artifacts() (in module modelopt.torch.puzzletron.artifact_coverage)
verify_real_campaign_artifacts() (in module modelopt.torch.puzzletron.artifact_coverage)
VERSION (CandidateLedger attribute)
version (StageManifest attribute)
VFRNNForward (class in modelopt.torch.quantization.nn.modules.quant_rnn)
video_shape (VSAAttributeConfig attribute)
view_as_float8_e4m3fn_if_needed() (in module modelopt.torch.export.postprocess)
view_as_uint8_if_needed() (in module modelopt.torch.export.postprocess)
vision (GenericDecoderContract attribute)
vision_module_names() (GenericContractModelDescriptor class method)
(ModelDescriptor class method)
(Qwen3P5VLModelDescriptor class method)
vision_output_dim (DecoderLayerConfig attribute)
VisionLanguageContract (class in modelopt.torch.puzzletron.anymodel.models.generic_decoder)
vllm (ExportCapabilities attribute)
vllm_env (RuntimeConfig attribute)
vllm_export (AxisCapabilities attribute)
vllm_settings_identity() (in module modelopt.torch.puzzletron.identity)
vllm_stats_stage() (in module modelopt.torch.puzzletron.stages)
VllmMeasurement (class in modelopt.torch.puzzletron.subblock_stats.measurements)
VlmAcquisitionSpec (class in modelopt.torch.puzzletron.dataset)
vocab_embedding (ModelConfig attribute)
vocab_size (ModelConfig attribute)
(RuntimeConfig attribute)
vocab_size_padded (ModelConfig property)
vsd_loss() (in module modelopt.torch.fastgen.losses)
W
wait() (AsyncEvaluationClient method)
walk_subgraphs_recursive() (in module modelopt.onnx.autocast.utils)
warn_rank_0() (in module modelopt.torch.utils.logging)
warnings (NodeObservation attribute)
weight (ConvConfig attribute)
(EmbeddingConfig attribute)
(LayernormConfig attribute)
(LinearConfig attribute)
(QKVConfig property)
(RelativeAttentionTableConfig attribute)
(Same property)
weight_attr_names() (in module modelopt.torch.quantization.utils)
weight_decay (GlobalKDConfig attribute)
weight_dequant() (in module modelopt.torch.kernels.quantization.gemm.fp8_kernel)
weight_quantizer (QuantLinearConvBase attribute)
(QuantRNNBase attribute)
weights_path_to_checkpoint_dir() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils)
weights_scaling_factor (LinearConfig attribute)
(QKVConfig property)
weights_scaling_factor_2 (LinearConfig attribute)
(QKVConfig property)
when (ArtifactChoice attribute)
width (PLEPruningSpec attribute)
width_field (PLEContract attribute)
width_slice_equivalence_operations() (ModelDescriptor class method)
width_slice_equivalence_stage() (in module modelopt.torch.puzzletron.stages)
width_slice_equivalence_tolerances() (ModelDescriptor class method)
with_settings() (EvaluationRequest method)
with_subblock() (BlockConfig method)
without_subblocks() (BlockConfig method)
work_id (AttemptSpec attribute)
(WorkItem attribute)
worker_boot_id (AttemptRecord attribute)
worker_id (AttemptRecord attribute)
(WorkerRecord attribute)
WORKER_LOST (ErrorKind attribute)
WorkerState (class in modelopt.torch.puzzletron.distributed_eval)
WorkItem (class in modelopt.torch.puzzletron.orchestration)
workload (BenchmarkResult attribute)
(ProfileConstraint attribute)
workload_id (BenchmarkResult attribute)
workloads (MIPProfile attribute)
WorkPlan (class in modelopt.torch.puzzletron.orchestration)
world_size (ParallelismSpec attribute)
(ParallelTopology property)
(RuntimeTopology property)
world_size() (DistributedProcessGroup method)
WrapperModelForCausalLM (class in modelopt.onnx.llm_export_utils.export_utils)
write_aiperf_report() (in module modelopt.torch.puzzletron.benchmarks)
write_candidate_library() (in module modelopt.torch.puzzletron.candidates)
write_configs_and_weights() (NFSWorkspace method)
write_inventory() (in module modelopt.torch.puzzletron.artifact_inventory)
write_results() (in module modelopt.torch.puzzletron.tools.validation_utils)
write_results_to_csv() (in module modelopt.torch.puzzletron.mip.sweep)
write_scoring_parent() (in module modelopt.torch.puzzletron.scoring_parent)
write_solution_registry() (in module modelopt.torch.puzzletron.solution_registry)
write_stage_execution_record() (in module modelopt.torch.puzzletron.manifest)
write_stage_manifest() (in module modelopt.torch.puzzletron.manifest)
X
x0_to_eps() (in module modelopt.torch.fastgen.flow_matching)
x0_to_flow() (in module modelopt.torch.fastgen.flow_matching)
Y
y_bias (RecurrentConfig attribute)
Z
zero() (RuntimeMeasurement class method)
zero_grad() (in module modelopt.torch.utils.network)