Index _ | A | B | C | D | E | F | G | H | I | J | K | L | M | N | O | P | Q | R | S | T | U | V | W | X | Y | Z _ __init__() (AcceptanceRateValidation method) (AccumulatingTimer method) (ActivityContext method) (AttentionConfig method), [1] (BaseCalibrateModeDescriptor method) (BaseDataclass method) (BaseQuantizedTensor method) (BaseSearcher method) (BiasCalibrator method) (BlockConfig method) (CalibrationDataProvider method) (ChildRegionInputInsertionPoint method) (ChildRegionOutputInsertionPoint method) (CombinedRegionSearch method) (ConcatNodeProcessor method) (ConcatSymbol method) (ConcatSymbol.Input method) (Config method) (ConstantLengthDataset method) (ConvConfig method) (DecoderLayerConfig method) (DepthOfReductionRule method) (DisabledNodeNameRegexRule method) (DisabledOpTypes method) (Discriminator method) (Discriminator_ImageDiT method) (DistillationLossBalancer method) (DistillationPipeline method) (DistributedProcessGroup method) (DMDPipeline method) (DummyBlock method) (DummyLMHead method) (DummyModule method) (DummyWTE method) (DynamicModule method) (DynamicSpace method) (DynamicThresholdCalibrator method) (EagleOfflineDataCollator method) (EmbeddingConfig method) (EmptyInitOnDevice method) (enable_modelopt_patches method) (ExpertConfig method) (ExpertRemovalLayerDescriptor method) (ExpertRemovalPruningMixIn method) (ExponentialMovingAverage method) (ExportContext method) (ExternalTarget method) (FFNConfig method) (FFNIntermediateLayerDescriptor method) (FFNIntermediatePruningMixIn method) (FunctionTarget method) (GptOssExpertRemovalLayerDescriptor method) (GptOssKVHeadsLayerDescriptor method) (GPUMemoryMonitor method) (GraphCollection method) (GraphSanitizer method) (GroupedQuantizer method) (HiddenStatesAndLMHead method) (HistogramCalibrator method) (Hparam method) (IndependentChannelContributionHook method) (IndependentKvHeadContributionHook method) (InitializerConsumerTracker method) (InitializerRangeRule method) (InputArgs method) (InputIndexTracker method) (InputReducer method) (InsertionScheme method) (IORangeRule method) (IterativeChannelContributionHook method) (KVHeadsLayerDescriptor method) (KVHeadsPruningMixIn method) (L2NormHook method) (LayernormConfig method) (LayerNormContributionHook method) (LinearActConfig method) (LinearConfig method) (Llama4AttentionConfig method) (LlamaFFNIntermediateLayerDescriptor method) (LlamaKVHeadsLayerDescriptor method) (LLM method) (LogitsDistillationLoss method) (LossMaskRecovery method) (LowMemorySparseTensor method) (MambaConfig method) (MaxCalibrator method) (MedusaHeadConfig method) (MFTLoss method) (MGDLoss method) (MistralFFNIntermediateLayerDescriptor method) (MistralKVHeadsLayerDescriptor method) (MlflowRunLogger method) (MLPConfig method) (ModelConfig method) (ModelLoader method) (ModeloptStateManager method) (ModuleTarget method) (MOEConfig method) (MoEConfig method) (MseCalibrator method) (Needle method) (NemotronHExpertRemovalLayerDescriptor method) (NemotronHKVHeadsLayerDescriptor method) (NemotronHV2ExpertRemovalLayerDescriptor method) (NemotronHV2FFNIntermediateLayerDescriptor method) (NemotronHV2KVHeadsLayerDescriptor method) (NemotronTarPlusJsonlIterable method) (NFSWorkspace method) (no_modelopt_patches method) (NodeClassifier method) (NodeInputInsertionPoint method) (NVFP4ActHeadroomCalibrator method) (NVFP4MSECalibrator method) (OfflineSupervisedDataset method) (OutputSaveHook method) (ParallelState method) (Passage method) (PassageInputAdapter method) (PassageInputOverrides method) (PassageOutput method) (PassageOutputAdapter method) (PassageOutputOverrides method) (PatchManager method) (PatternCache method) (PatternSchemes method) (PrecisionConverter method) (PruningMixIn method) (QDQConvTranspose method) (QDQCustomOp method) (QDQNormalization method) (QKVConfig method) (QuantRecipe method) (QuantRecipeHparam method) (Qwen2FFNIntermediateLayerDescriptor method) (Qwen3FFNIntermediateLayerDescriptor method) (Qwen3KVHeadsLayerDescriptor method) (Qwen3VLExpertRemovalLayerDescriptor method) (Qwen3VLFFNIntermediateLayerDescriptor method) (Qwen3VLKVHeadsLayerDescriptor method) (RandomDataProvider method) (RankedChoiceVotingHook method) (RecurrentConfig method) (ReferenceRunner method) (Region method) (RegionPattern method) (RelativeAttentionTableConfig method) (RemoteTarget method) (RemoveExpertsIndependentHook method) (RenameRule method) (ReplacementLibrary method) (ResBlock method) (ResolvedInsertionPoint method) (RgLruConfig method) (RNNLayerForward method) (RobustTracer method) (RulerDatasetBuilder method) (RuntimeConfig method) (ScoringCheckpointManager method) (SearchSpace method) (SequentialQuantizer method) (set_modelopt_patches_enabled method) (SharedQuantState method) (SharedWeightGlobalAmaxState method) (SparseAttentionMethod method) (SparseAttentionStatsManager method) (SplitRule method) (StaticLossBalancer method) (StitchedModule method) (StoreWithExplicitFlag method) (SubblockConfig method) (Symbol method) (SymDepth method) (SymInfo method) (SymMap method) (TeeStream method) (TensorQuantizer method) (TensorQuantizerCache method) (TensorRTPyBenchmark method) (TensorStats method) (TiedWeightMap method) (Timer method) (Tree method) (TreeNode method) (TrtExecBenchmark method) (VFRNNForward method) (WrapperModelForCausalLM method) __new__() (LayerNormPositionType method) (LayerNormType method) (MLPType method) (PrecisionTypes static method) (QTensorWrapper static method) _lora_adapters (LoRAModule attribute) A absmax (TensorStats attribute) AcceptanceRateValidation (class in modelopt.torch.speculative.utils) accumulate() (ForwardHook method) (IndependentChannelContributionHook method) (IndependentKvHeadContributionHook method) (IterativeChannelContributionHook method) (L2NormHook method) (LayerNormContributionHook method) (RankedChoiceVotingHook method) (RemoveExpertsIndependentHook method) AccumulatingTimer (class in modelopt.torch.utils.perf) activation_scaling_factor (LinearConfig attribute) (QKVConfig property) active (ConcatTracedHp property) (Hparam property) (QuantRecipeHparam property) active_context_manager (Passage attribute) active_passages_context (Passage attribute) active_slice (ConcatTracedHp property) (Hparam property) ActiveSlice (Hparam attribute) ActivityContext (class in modelopt.torch.puzzletron.sewing_kit.utils) ActivityContextDuplicateException adapter_cfg (PEFTConfig attribute) adapter_fn (PassageInputAdapter attribute) (PassageOutputAdapter attribute) adapter_name (PEFTConfig attribute) adapter_names (LoRAModule property) adapter_type (PEFTConfig attribute) AdaptiveAvgPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling) AdaptiveAvgPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling) AdaptiveAvgPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling) add_child() (Region method) add_cross_kv_to_encoder() (in module modelopt.onnx.graph_surgery) add_mode() (ModeloptStateManager method) add_noise() (in module modelopt.torch.fastgen.flow_matching) add_pattern_from_region() (PatternCache method) add_pattern_schemes() (PatternCache method) add_sym_info() (SymMap method) adjust_attn_amax_values() (in module modelopt.torch.export.quant_utils) after_search() (BaseSearcher method) (IterativeSearcher method) (SparseGPTSearcher method) after_step() (BinarySearcher method) (EvolveSearcher method) (IterativeSearcher method) algorithm (QuantizeConfig attribute) alibi_bias_max (DecoderLayerConfig attribute) all_input_quantizers_disabled (QuantRNNBase property) all_items_same() (in module modelopt.torch.export.quant_utils) allow_real_quant_gemm (RealQuantLinear attribute) alpha (SmoothQuantCalibConfig attribute) alpha_step (AWQLiteCalibConfig attribute) always_false_predicate() (in module modelopt.torch.puzzletron.sewing_kit.passage) always_true_predicate() (in module modelopt.torch.puzzletron.sewing_kit.passage) amax (StaticBlockScaleQuantizer property) (TensorQuantizer property) amax_post (StaticBlockScaleQuantizer property) amax_pre (StaticBlockScaleQuantizer property) amaxs (MaxCalibrator property) analyze_symbols() (in module modelopt.torch.trace.analyzer) anchor_percentile (NVFP4ActHeadroomCalibConfig attribute) apply_column_major_transformation() (in module modelopt.onnx.quantization.qdq_utils) apply_mode() (in module modelopt.torch.opt.conversion) apply_residual_connection_post_layernorm (DecoderLayerConfig attribute) apply_reverse_rules() (in module modelopt.torch.export.quant_aware_conversion) apply_sparsity() (SparseAttentionMethod method) architecture (ModelConfig attribute) args (InputArgs attribute) assert_compatibility_as_next_mode_of() (ModeDescriptor method) atomic_print() (in module modelopt.torch.utils.logging) attach() (SharedQuantState class method) attention (BlockConfig attribute) (DecoderLayerConfig attribute) attention_chunk_size (Llama4AttentionConfig attribute) attention_dropout (Llama4AttentionConfig attribute) attention_head_size (DecoderLayerConfig attribute) attention_layernorm (DecoderLayerConfig attribute) AttentionConfig (class in modelopt.torch.export.model_config) (class in modelopt.torch.puzzletron.block_config) attn_logit_softcapping (DecoderLayerConfig attribute) attn_no_op_post_init() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) attn_no_op_supported() (ModelDescriptor class method) attn_prefix() (KVHeadsLayerDescriptor method) attn_prefix_name (GptOssKVHeadsLayerDescriptor attribute) (KVHeadsLayerDescriptor attribute) (LlamaKVHeadsLayerDescriptor attribute) (MistralKVHeadsLayerDescriptor attribute) (NemotronHKVHeadsLayerDescriptor attribute) (NemotronHV2KVHeadsLayerDescriptor attribute) (Qwen3KVHeadsLayerDescriptor attribute) (Qwen3VLKVHeadsLayerDescriptor attribute) attn_replacing_linear (DecoderLayerConfig attribute) attn_scale (Llama4AttentionConfig attribute) attn_temperature_tuning (Llama4AttentionConfig attribute) attrs (Hparam property) (QuantRecipeHparam property) auto_quantize() (in module modelopt.torch.quantization.model_quant) AutoNASConfig (class in modelopt.torch.nas.autonas) AutoNASModeDescriptor (class in modelopt.torch.nas.autonas) AutoNASPatchManager (class in modelopt.torch.nas.autonas) AutoQuantizeGradientSearcher (class in modelopt.torch.quantization.algorithms) AutoQuantizeKLDivSearcher (class in modelopt.torch.quantization.algorithms) AutoQuantizeSearcher (in module modelopt.torch.quantization.algorithms) AutotunerError AutotunerNotInitializedError AverageKV (GQAInitMode attribute) AvgPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling) AvgPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling) AvgPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling) awq() (in module modelopt.torch.quantization.model_calib) awq_block_size (LinearConfig attribute) (QKVConfig property) AWQClipCalibConfig (class in modelopt.torch.quantization.config) AWQFullCalibConfig (class in modelopt.torch.quantization.config) AWQLiteCalibConfig (class in modelopt.torch.quantization.config) axis (QuantizerAttributeConfig attribute) (TensorQuantizer property) B backend (QuantizerAttributeConfig attribute) (SparseAttentionAttributeConfig attribute) backend() (in module modelopt.torch.utils.distributed) backend_extra_args (QuantizerAttributeConfig attribute) backward() (ClipFunction static method) (DynamicBlockQuantizationFunction static method) (FakeTensorQuantFunction static method) (FP4CastSTEFunction static method) (IntCastSTEFunction static method) (ScaledE4M3Function static method) (StaticBlockwiseFP4FakeQuantFunction static method) backward_simulation (DMDConfig attribute) barrier() (in module modelopt.torch.utils.distributed) BaseCalibrateModeDescriptor (class in modelopt.torch.quantization.mode) BaseDataclass (class in modelopt.torch.puzzletron.block_config) Baseline Latency BaseQuantizedTensor (class in modelopt.torch.quantization.qtensor.base_qtensor) BaseSearcher (class in modelopt.torch.opt.searcher) BaseSparseSearcher (class in modelopt.torch.sparsity.weight_sparsity.searcher) batch_size (EMAConfig attribute) (RuntimeConfig attribute) bc (SparseAttentionAttributeConfig attribute) before_search() (BaseSearcher method) (BinarySearcher method) (EvolveSearcher method) (IterativeSearcher method) (SparseGPTSearcher method) before_step() (BinarySearcher method) (EvolveSearcher method) (IterativeSearcher method) bench_fn() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm) best (IterativeSearcher attribute) best_history (IterativeSearcher attribute) best_scheme (PatternSchemes property) bfloat16_to_float32() (in module modelopt.onnx.utils) bias (ConvConfig attribute) (LayernormConfig attribute) (LinearConfig attribute) (QKVConfig property) (QuantizerAttributeConfig attribute) (TensorQuantizer property) bias_axis (TensorQuantizer property) bias_calibrator (TensorQuantizer property) bias_method (TensorQuantizer property) bias_type (TensorQuantizer property) bias_value (TensorQuantizer property) BiasCalibrator (class in modelopt.torch.quantization.calib.bias) BinarySearcher (class in modelopt.torch.prune.fastnas) block_config (DecoderLayerConfig attribute) block_config_to_layer_overrides() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) block_config_to_str() (in module modelopt.torch.puzzletron.utils.misc) block_embedding (ModelConfig attribute) block_idx_from_module_name() (LayerDescriptor method) block_size (GPTQCalibConfig attribute) (LocalHessianCalibConfig attribute) BLOCK_SIZE (MXFP8QTensor attribute) block_size (RotateConfig attribute) block_size_3d (VSAAttributeConfig attribute) block_sizes (QuantizerAttributeConfig attribute) (TensorQuantizer property) BlockConfig (class in modelopt.torch.puzzletron.block_config) blocking (RemoteTarget attribute) blocksparse_block_size (DecoderLayerConfig attribute) blocksparse_homo_head_pattern (DecoderLayerConfig attribute) blocksparse_num_local_blocks (DecoderLayerConfig attribute) blocksparse_vertical_stride (DecoderLayerConfig attribute) bos_token_id (ModelConfig attribute) br (SparseAttentionAttributeConfig attribute) build_attention_config() (in module modelopt.torch.export.layer_utils) build_calibration_dataset() (RulerDatasetBuilder method) build_conv_config() (in module modelopt.torch.export.layer_utils) build_decoder_config() (in module modelopt.torch.export.layer_utils) build_embedding_config() (in module modelopt.torch.export.layer_utils) build_fused_linear_config() (in module modelopt.torch.export.layer_utils) build_layernorm_config() (in module modelopt.torch.export.layer_utils) build_layerwise_quant_metadata() (in module modelopt.torch.export.diffusers_utils) build_linear_config() (in module modelopt.torch.export.layer_utils) build_medusa_heads_config() (in module modelopt.torch.export.layer_utils) build_mlp_config() (in module modelopt.torch.export.layer_utils) build_moe_config() (in module modelopt.torch.export.layer_utils) build_non_residual_input_map() (in module modelopt.onnx.quantization.graph_utils) build_qkv() (in module modelopt.torch.export.layer_utils) build_recurrent_config() (in module modelopt.torch.export.layer_utils) build_replacement_library() (in module modelopt.torch.puzzletron.replacement_library.build_replacement_library) build_reverse_name_mapper() (in module modelopt.torch.export.quant_aware_conversion) build_stacked_experts() (in module modelopt.torch.export.layer_utils) C cache_dir (CalibrationConfig attribute) calc_base_runtime() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) calc_model_runtime() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) calc_no_block_runtime() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) calc_runtime_for_subblocks() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) calc_subblock_active_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calc_subblock_runtime() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) calculate_batch_outputs() (in module modelopt.torch.puzzletron.utils.validation) calculate_ffn_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_kv_dim() (in module modelopt.torch.puzzletron.utils.misc) calculate_losses() (in module modelopt.torch.puzzletron.utils.validation) calculate_losses_pipeline() (in module modelopt.torch.puzzletron.utils.validate_runtime_pipeline) calculate_mamba_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_mamba_state_size() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_non_block_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_non_block_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_sparsity() (SparseAttentionMethod method) calculate_subblock_memory() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_subblock_params() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) calculate_subblock_stats() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats) calib (ExportConfig attribute) calib_mutates_weights (LayerwiseConfig attribute) calibrate() (DynamicThresholdCalibrator method) (in module modelopt.torch.quantization.model_quant) (in module modelopt.torch.sparsity.attention_sparsity.model_sparsify) calibrate_frequent_vocab() (in module modelopt.torch.speculative.utils) calibrate_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.calibration) calibrate_weights() (in module modelopt.torch.quantization.calib.histogram) CalibrationConfig (class in modelopt.torch.sparsity.attention_sparsity.config) CalibrationDataProvider (class in modelopt.onnx.quantization.calib_utils) calibrator (QuantizerAttributeConfig attribute) call_post_eval() (PatchManager method) candidate (IterativeSearcher attribute) candidates (EvolveSearcher attribute) CantResolveNodeDependenciesException capture_io() (in module modelopt.torch.utils.logging) captured_fake_outputs (PassageOutput attribute) captured_inputs (PassageOutput attribute) captured_outputs (PassageOutput attribute) cast_custom_ops() (in module modelopt.onnx.quantization.graph_utils) cast_initializer_to_dtype() (in module modelopt.onnx.quantization.qdq_utils) centroid() (in module modelopt.torch.utils.random) cfg (QuantizerCfgEntry attribute) change_casts_to_fp16() (in module modelopt.onnx.utils) chatglm_version (DecoderLayerConfig attribute) check() (NodeRuleBase method) check_data_consistency_across_ranks() (AcceptanceRateValidation method) check_draft() (AcceptanceRateValidation method) check_mode() (ModeloptStateManager method) check_model() (in module modelopt.onnx.utils) check_model_compatibility() (in module modelopt.torch.export.layer_utils) check_model_uses_external_data() (in module modelopt.onnx.utils) check_weight_shape_valid() (in module modelopt.torch.export.postprocess) checkpoint_dir (LayerwiseConfig attribute) checkpoint_signature (QuantRecipe property) child_region_inputs (InsertionScheme attribute) ChildRegionInputInsertionPoint (class in modelopt.onnx.quantization.autotune) ChildRegionOutputInsertionPoint (class in modelopt.onnx.quantization.autotune) children (Region attribute) choice() (in module modelopt.torch.utils.random) choices (Hparam property) chunk_size (CalibrationConfig attribute) cl_type (Symbol property) CLASS_MAPPING (ConverterFactory attribute) (ModelDescriptorFactory attribute) classifier_free_guidance() (in module modelopt.torch.fastgen.utils) classify_partially_quantized_weighted_ops() (in module modelopt.onnx.quantization.graph_utils) classify_partition_nodes() (in module modelopt.onnx.quantization.graph_utils) cleanup_model() (GraphSanitizer method) clear_cuda_cache() (in module modelopt.torch.utils.perf) clear_inputs() (in module modelopt.onnx.llm_export_utils.surgeon_utils) clear_outputs() (in module modelopt.onnx.llm_export_utils.surgeon_utils) clear_stale_value_info() (in module modelopt.onnx.utils) clear_types_and_shapes_recursive() (in module modelopt.onnx.autocast.utils) clip_qkv (AttentionConfig attribute) (DecoderLayerConfig attribute) ClipFunction (class in modelopt.torch.quantization.nn.functional) clone() (set_modelopt_patches_enabled method) collect() (BiasCalibrator method) (HistogramCalibrator method) (MaxCalibrator method) (MseCalibrator method) (NVFP4ActHeadroomCalibrator method) (NVFP4MSECalibrator method) (SparseAttentionStatsManager method) (TensorQuantizer method) collect_from_region() (ChildRegionInputInsertionPoint static method) (ChildRegionOutputInsertionPoint static method) (NodeInputInsertionPoint static method) collect_stats (SparseAttentionAttributeConfig attribute) (VSAAttributeConfig attribute) CombinedRegionSearch (class in modelopt.onnx.quantization.autotune) command_text() (in module modelopt.torch.utils.mlflow) compare_dict() (in module modelopt.torch.utils.network) compare_multi_layer() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) COMPOSITE (RegionType attribute) compress (CompressConfig attribute) compress() (in module modelopt.torch.quantization) compress_weights() (FP8QuantExporter static method) (INT4QuantExporter static method) (INT8QuantExporter static method) (MXFP8QuantExporter static method) (NVFP4QuantExporter static method) (ONNXQuantExporter static method) CompressConfig (class in modelopt.torch.quantization.config) compute (LossMaskRecovery attribute) compute_amax() (HistogramCalibrator method) (MaxCalibrator method) (MseCalibrator method) (NVFP4ActHeadroomCalibrator method) (NVFP4MSECalibrator method) compute_bias() (BiasCalibrator method) compute_cosine_similarity() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) compute_discriminator_loss() (DMDPipeline method) compute_dynamic_bias() (BiasCalibrator method) compute_e8m0() (in module modelopt.onnx.quantization.quant_utils) compute_fake_score_loss() (DMDPipeline method) compute_fp4_scales() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel) compute_kd_loss() (DistillationModel method) compute_layer_metrics() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) compute_quantization_mse() (in module modelopt.torch.quantization.model_quant) compute_rmse() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) compute_scales() (FP8QuantExporter static method) (INT4QuantExporter static method) (INT8QuantExporter static method) (MXFP8QuantExporter static method) (NVFP4QuantExporter static method) (ONNXQuantExporter static method) compute_student_loss() (DMDPipeline method) compute_valid_1d_patterns() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) concat_sym (ConcatSymbol.Input property) ConcatExpertsIntoDenseFFN (MlpInitMode attribute) ConcatNodeProcessor (class in modelopt.torch.trace.modules.concat) ConcatSymbol (class in modelopt.torch.trace.modules.concat) ConcatSymbol.Input (class in modelopt.torch.trace.modules.concat) ConcatTracedHp (class in modelopt.torch.nas.hparams.concat) config (BaseSearcher attribute) Config (class in modelopt.onnx.quantization.autotune) config (DMDPipeline attribute) config() (DynamicSpace method) config_class (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (DFlashModeDescriptor property) (EagleModeDescriptor property) (ExportNASModeDescriptor property) (ExportPEFTModeDescriptor property) (ExportSparseModeDescriptor property) (ExportStudentModeDescriptor property) (FastNASModeDescriptor property) (KnowledgeDistillationModeDescriptor property) (LayerwiseKDModeDescriptor property) (MedusaModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (PuzzletronDescriptor property) (SparseAttentionModeDescriptor property) (SparseGPTModeDescriptor property) (SparseMagnitudeModeDescriptor property) configure_linear_module_onnx_quantizers() (in module modelopt.torch.quantization.export_onnx) configure_logging() (in module modelopt.onnx.autocast.logging_config) (in module modelopt.onnx.logging_config) configure_ort() (in module modelopt.onnx.quantization.ort_utils) consecutive_ngrams() (in module modelopt.torch.puzzletron.mip.utils) constant_amax (QuantizerAttributeConfig attribute) ConstantLengthDataset (class in modelopt.torch.puzzletron.utils.data.dataset) constraints (BaseSearcher attribute) constraints_func (IterativeSearcher attribute) construct_forward_loop() (BaseSearcher method) container_group_key() (TiedWeightMap method) contains_node() (Region method) contains_node_within_region_and_descendants() (Region method) conv1 (ModelConfig attribute) Conv1d (in module modelopt.torch.quantization.nn.modules.quant_conv) conv1d (RecurrentConfig attribute) conv2 (ModelConfig attribute) Conv2d (in module modelopt.torch.quantization.nn.modules.quant_conv) Conv3d (in module modelopt.torch.quantization.nn.modules.quant_conv) conv3d_implicit_gemm_cuda() (in module modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda) ConvConfig (class in modelopt.torch.export.model_config) convert (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (DFlashModeDescriptor property) (EagleModeDescriptor property) (ExportNASModeDescriptor property) (ExportPEFTModeDescriptor property) (ExportSparseModeDescriptor property) (ExportStudentModeDescriptor property) (FastNASModeDescriptor property) (KnowledgeDistillationModeDescriptor property) (LayerwiseKDModeDescriptor property) (MedusaModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (PuzzletronDescriptor property) (SparseAttentionModeDescriptor property) (SparseMagnitudeModeDescriptor property) convert() (ConcatSymbol.Input static method) (Converter class method) (DynamicModule class method) (in module modelopt.torch.distill.distillation) (in module modelopt.torch.nas.conversion) (in module modelopt.torch.speculative.speculative_decoding) (PrecisionConverter method) (QuantModule class method) convert_autonas_searchspace() (in module modelopt.torch.nas.autonas) convert_block_configs_to_per_layer_config() (in module modelopt.torch.puzzletron.utils.vllm_adapter) convert_config_to_vllm_anymodel() (in module modelopt.torch.puzzletron.subblock_stats.runtime_utils) convert_configs_in_dirs() (Converter class method) convert_fastnas_searchspace() (in module modelopt.torch.prune.fastnas) convert_fp16_io() (in module modelopt.onnx.quantization.graph_utils) convert_fp16_to_bf16() (in module modelopt.onnx.graph_surgery) convert_fp64_to_fp32() (GraphSanitizer method) convert_hf_quant_config_format() (in module modelopt.torch.export.convert_hf_config) convert_model() (in module modelopt.torch.puzzletron.anymodel.converter.convert_any_model) convert_model_weights() (Converter class method) convert_opset() (GraphSanitizer method) convert_puzzletron_model() (in module modelopt.torch.puzzletron.puzzletron_nas_plugin) convert_quantization_axis_to_reduce_axis() (in module modelopt.torch.quantization.utils) convert_searchspace() (in module modelopt.torch.nas.autonas) convert_sparse_model() (in module modelopt.torch.sparsity.weight_sparsity.mode) convert_to_dflash_model() (in module modelopt.torch.speculative.dflash.conversion) convert_to_dynamic() (DynamicSpace method) convert_to_eagle_model() (in module modelopt.torch.speculative.eagle.conversion) convert_to_f16() (in module modelopt.onnx.autocast.convert) convert_to_medusa_model() (in module modelopt.torch.speculative.medusa.conversion) convert_to_mixed_precision() (in module modelopt.onnx.autocast.convert) convert_to_single_quantizer() (SequentialQuantizer static method) convert_to_sparse_attention_model() (in module modelopt.torch.sparsity.attention_sparsity.conversion) convert_to_tensorrt_llm_config() (in module modelopt.torch.export.tensorrt_llm_utils) convert_to_transformer_engine() (in module modelopt.torch.export.transformer_engine) convert_weight_name() (Converter static method) Converter (class in modelopt.torch.puzzletron.anymodel.converter.base) ConverterFactory (class in modelopt.torch.puzzletron.anymodel.converter.converter_factory) ConvTranspose1d (in module modelopt.torch.quantization.nn.modules.quant_conv) ConvTranspose2d (in module modelopt.torch.quantization.nn.modules.quant_conv) ConvTranspose3d (in module modelopt.torch.quantization.nn.modules.quant_conv) copy_checkpoint_files() (Converter static method) copy_to() (ExponentialMovingAverage method) copy_tokenizer() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) CopyAsIs (GQAInitMode attribute) (HiddenSizeInitMode attribute) (MlpInitMode attribute) cosine_embedding_loss() (in module modelopt.torch.puzzletron.utils.validation) cosine_embedding_loss_batched() (in module modelopt.torch.puzzletron.tools.kd_model) create() (Passage class method) create_asp_mask() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) create_attention_mask() (Tree method) create_benchmark_model() (in module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats) create_block_configs_from_main_config() (Converter static method) (GptOssConverter static method) (LlamaConverter static method) (MistralSmallConverter static method) (NemotronHConverter static method) (NemotronHV2Converter static method) (Qwen2Converter static method) (Qwen3Converter static method) (Qwen3VLConverter static method) create_child_state_dict() (in module modelopt.torch.puzzletron.tools.bypassed_training.child_init) create_dummy_block() (GptOssModelDescriptor class method) (ModelDescriptor class method) (NemotronHModelDescriptor class method) (NemotronHV2ModelDescriptor class method) (Qwen2ModelDescriptor class method) (Qwen3ModelDescriptor class method) create_fake_score() (in module modelopt.torch.fastgen.factory) create_fn_context (Passage attribute) create_forward_loop() (in module modelopt.torch.utils.dataset_utils) create_index_file_from_weights() (ReplacementLibrary method) create_inference_session() (in module modelopt.onnx.quantization.ort_utils) create_input_overrides() (StitchedModule method) create_input_shapes_profile() (in module modelopt.onnx.quantization.ort_utils) create_linked_copy() (ConcatSymbol.Input method) create_model_config() (ReplacementLibrary method) create_output_overrides() (StitchedModule method) create_padded_tensor() (in module modelopt.torch.puzzletron.utils.data.dataloaders) create_param_grad_clear_hook() (in module modelopt.torch.utils.network) create_sgpt_mask() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt) create_sharded_model() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils) create_train_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders) create_tree() (Tree method) create_validation_dataloader() (in module modelopt.torch.puzzletron.utils.data.dataloaders) criterion (KDLossConfig attribute) cross_attention (DecoderLayerConfig attribute) cross_attention_layernorm (DecoderLayerConfig attribute) cross_attention_layers (DecoderLayerConfig attribute) current_user() (in module modelopt.torch.utils.mlflow) customize_rule() (ModeloptBaseRule class method) D data_dir (CalibrationConfig attribute) dataset_path (PuzzletronConfig attribute) debug (AWQClipCalibConfig attribute) (AWQFullCalibConfig attribute) (AWQLiteCalibConfig attribute) (LocalHessianCalibConfig attribute) decay (EMAConfig attribute) deci_x_patcher() (in module modelopt.torch.puzzletron.anymodel.puzzformer.patcher) decoder_layer_cls() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) decoder_start_token_id (ModelConfig attribute) decoder_type (DecoderLayerConfig attribute) DecoderLayerConfig (class in modelopt.torch.export.model_config) default() (InputReducer class method) default_dq_dtype (Config attribute) default_experiment_name() (in module modelopt.torch.utils.mlflow) default_patterns (SharedQuantState attribute) (SharedWeightGlobalAmaxState attribute) default_q_scale (Config attribute) default_q_zero_point (Config attribute) default_quant_desc_input (QuantInputBase attribute) (QuantRNNBase attribute) default_quant_desc_output (QuantInputBase attribute) default_quant_desc_weight (QuantConv1d attribute) (QuantConv2d attribute) (QuantConv3d attribute) (QuantConvTranspose1d attribute) (QuantConvTranspose2d attribute) (QuantConvTranspose3d attribute) (QuantLinear attribute) (QuantLinearConvBase attribute) (QuantRNNBase attribute) default_quant_type (Config attribute) default_search_config (AutoQuantizeGradientSearcher property) (AutoQuantizeKLDivSearcher property) (BaseSearcher property) (BaseSparseSearcher property) (EvolveSearcher property) (IterativeSearcher property) (SparseGPTSearcher property) default_state_dict (BaseSearcher property) (BaseSparseSearcher property) (BinarySearcher property) (EvolveSearcher property) (IterativeSearcher property) (PuzzletronSearcher property) Degrouping (GQAInitMode attribute) dense (AttentionConfig attribute) dense_attention_every_n_layers (DecoderLayerConfig attribute) dense_recent_tokens (SparseAttentionAttributeConfig attribute) dense_sink_tokens (SparseAttentionAttributeConfig attribute) deployment (BaseSearcher attribute) DeprecatedError DepthHparam (class in modelopt.torch.nas.hparams.container) DepthOfReductionRule (class in modelopt.onnx.autocast.nodeclassifier) dequantize() (BaseQuantizedTensor method) (FP8QTensor method) (INT4QTensor method) (INT8QTensor method) (MXFP4QTensor method) (MXFP8QTensor method) (NF4QTensor method) (NVFP4QTensor method) (TensorQuantizer method) detect (LossMaskRecovery attribute) device (DistillationPipeline property) device_count (GPUMemoryMonitor attribute) dflash_architecture_config (DFlashConfig attribute) dflash_attention_sink (DFlashConfig attribute) dflash_block_size (DFlashConfig attribute) dflash_ce_loss_alpha (DFlashConfig attribute) dflash_confidence_head_alpha (DFlashConfig attribute) dflash_dpace_alpha (DFlashConfig attribute) dflash_draft_attention (DFlashConfig attribute) dflash_export_rope_scaling (DFlashConfig attribute) dflash_freeze_base_model (DFlashConfig attribute) dflash_init_checkpoint (DFlashConfig attribute) dflash_l1_loss_alpha (DFlashConfig attribute) dflash_lambda_base_decay_ratio (DFlashConfig attribute) dflash_lambda_base_start (DFlashConfig attribute) dflash_loss_decay_factor (DFlashConfig attribute) dflash_loss_objective (DFlashConfig attribute) dflash_mask_token_id (DFlashConfig attribute) dflash_num_anchors (DFlashConfig attribute) dflash_offline (DFlashConfig attribute) dflash_report_acc (DFlashConfig attribute) dflash_self_logit_distillation (DFlashConfig attribute) dflash_swa_window_size (DFlashConfig attribute) dflash_use_torch_compile (DFlashConfig attribute) DFlashConfig (class in modelopt.torch.speculative.config) DFlashModeDescriptor (class in modelopt.torch.speculative.mode) DFlashModel (class in modelopt.torch.speculative.dflash.dflash_model) dim (SplitRule attribute) dim() (QTensorWrapper method) disable() (ConcatSymbol method) (SparseAttentionModule method) (Symbol method) (SymDepth method) (TensorQuantizer method) disable_adapters() (in module modelopt.torch.peft.convert) disable_calib() (TensorQuantizer method) disable_folding_pqs_to_weights() (QuantRecipe static method) disable_pre_quant_scale() (TensorQuantizer method) disable_quant() (TensorQuantizer method) disable_quantizer() (in module modelopt.torch.quantization.model_quant) disable_rotate() (TensorQuantizer method) disable_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.conversion) DisabledNodeNameRegexRule (class in modelopt.onnx.autocast.nodeclassifier) DisabledOpTypes (class in modelopt.onnx.autocast.nodeclassifier) Discriminator (class in modelopt.torch.fastgen.discriminators) Discriminator_ImageDiT (class in modelopt.torch.fastgen.discriminators) distance() (InsertionScheme method) DistillationConfig (class in modelopt.torch.fastgen.config) DistillationLossBalancer (class in modelopt.torch.distill.loss_balancers) DistillationModel (class in modelopt.torch.distill.distillation_model) DistillationPipeline (class in modelopt.torch.fastgen.pipeline) distributed_isend_obj() (in module modelopt.torch.puzzletron.sewing_kit.utils) distributed_recv_obj() (in module modelopt.torch.puzzletron.sewing_kit.utils) distributed_send_obj() (in module modelopt.torch.puzzletron.sewing_kit.utils) distributed_sync (LocalHessianCalibConfig attribute) (MaxCalibConfig attribute) (MseCalibConfig attribute) DistributedProcessGroup (class in modelopt.torch.utils.distributed) DMDConfig (class in modelopt.torch.fastgen.config) DMDPipeline (class in modelopt.torch.fastgen.methods.dmd) double_quantization() (NF4QTensor class method) down_proj_name (FFNIntermediateLayerDescriptor attribute) (LlamaFFNIntermediateLayerDescriptor attribute) (MistralFFNIntermediateLayerDescriptor attribute) (NemotronHV2FFNIntermediateLayerDescriptor attribute) (Qwen3FFNIntermediateLayerDescriptor attribute) (Qwen3VLFFNIntermediateLayerDescriptor attribute) download_hf_dataset_as_jsonl() (in module modelopt.torch.utils.dataset_utils) dq_tensor() (in module modelopt.onnx.quantization.quant_utils) drop_args() (InputArgs method) drop_kwargs() (InputArgs method) dsm_loss() (in module modelopt.torch.fastgen.losses) dtype (DistillationPipeline property) (EMAConfig attribute) (ExportContext attribute) (ModelConfig attribute) dummy_input (BaseSearcher attribute) DummyBlock (class in modelopt.torch.puzzletron.utils.dummy_modules) DummyLMHead (class in modelopt.torch.puzzletron.utils.dummy_modules) DummyModule (class in modelopt.torch.puzzletron.utils.dummy_modules) DummyWTE (class in modelopt.torch.puzzletron.utils.dummy_modules) dump_activations_logs() (ForwardHook class method) (LayerNormContributionHook class method) dup_kv_weight() (in module modelopt.torch.export.layer_utils) duplicate_shared_constants() (GraphSanitizer method) (in module modelopt.onnx.utils) DynamicBlockQuantizationFunction (class in modelopt.torch.quantization.tensor_quant) DynamicModule (class in modelopt.torch.opt.dynamic) DynamicModuleList (class in modelopt.torch.nas.modules.container) DynamicSpace (class in modelopt.torch.opt.dynamic) DynamicThresholdCalibrator (class in modelopt.torch.sparsity.attention_sparsity.calibration) dynamo_disable() (in module modelopt.torch.puzzletron.sewing_kit.utils) dynamo_skip() (in module modelopt.torch.puzzletron.sewing_kit.utils) E E2M1_bounds (MXFP4QTensor attribute) e2m1_bounds_on_device (NVFP4QTensor attribute) E2M1_max (MXFP4QTensor attribute) E2M1_values (MXFP4QTensor attribute) e2m1_values_on_device (NVFP4QTensor attribute) E4M3_MAX (MXFP8QTensor attribute) eagle_architecture_config (EagleConfig attribute) eagle_base_lora (EagleConfig attribute) eagle_base_lora_alpha (EagleConfig attribute) eagle_base_lora_logits_detach_prob (EagleConfig attribute) eagle_base_lora_preservation_loss_weight (EagleConfig attribute) eagle_base_lora_rank (EagleConfig attribute) eagle_base_lora_start_layer (EagleConfig attribute) eagle_base_lora_target_modules (EagleConfig attribute) eagle_base_lora_warmup_steps (EagleConfig attribute) eagle_decoder_type (EagleConfig attribute) eagle_enable_nvtx (EagleConfig attribute) eagle_export_rope_scaling (EagleConfig attribute) eagle_freeze_base_model (EagleConfig attribute) eagle_hidden_state_distillation (EagleConfig attribute) eagle_loss_decay_factor (EagleConfig attribute) eagle_mix_hidden_states (EagleConfig attribute) eagle_offline (EagleConfig attribute) eagle_report_acc (EagleConfig attribute) eagle_reuse_base_decoder (EagleConfig attribute) eagle_self_logit_distillation (EagleConfig attribute) eagle_ttt_steps (EagleConfig attribute) eagle_use_torch_compile (EagleConfig attribute) EagleConfig (class in modelopt.torch.speculative.config) EagleModeDescriptor (class in modelopt.torch.speculative.mode) EagleModel (class in modelopt.torch.speculative.eagle.eagle_model) EagleOfflineDataCollator (class in modelopt.torch.speculative.eagle.utils) early_stop() (BinarySearcher method) (IterativeSearcher method) effective_bits (QuantizeConfig attribute) (QuantizerAttributeConfig attribute) elastic_dims (Symbol property) ema (DMDConfig attribute) (DMDPipeline property) EMAConfig (class in modelopt.torch.fastgen.config) emb_scale_by_sqrt_dim (DecoderLayerConfig attribute) EmbeddingConfig (class in modelopt.torch.export.model_config) EmptyInitOnDevice (class in modelopt.torch.puzzletron.utils.misc) enable (LayerwiseConfig attribute) (PEFTAttributeConfig attribute) (QuantizerAttributeConfig attribute) (QuantizerCfgEntry attribute) (RotateConfig attribute) (SparseAttentionAttributeConfig attribute) (VSAAttributeConfig attribute) enable() (HardDisabledTensorQuantizer method) (SparseAttentionModule method) (TensorQuantizer method) enable_adapters() (in module modelopt.torch.peft.convert) enable_calib() (HardDisabledTensorQuantizer method) (TensorQuantizer method) enable_cp_ttt_patch() (in module modelopt.torch.speculative.utils) enable_huggingface_checkpointing() (in module modelopt.torch.opt.plugins.huggingface) enable_lsq() (StaticBlockScaleQuantizer method) enable_modelopt_patches (class in modelopt.torch.nas.utils) enable_quant() (HardDisabledTensorQuantizer method) (TensorQuantizer method) enable_quantizer() (in module modelopt.torch.quantization.model_quant) enable_sparse_attention() (in module modelopt.torch.sparsity.attention_sparsity.conversion) enc_dec (ModelConfig attribute) encoder_head_size (ModelConfig attribute) encoder_hidden_size (ModelConfig attribute) encoder_num_heads (ModelConfig attribute) enforce_order() (Hparam method) ensure_custom_ops_precision() (GraphSanitizer method) ensure_graph_name_exists() (GraphSanitizer method) eos_token_id (ModelConfig attribute) eps (LayernormConfig attribute) error (InsertionScheme attribute) estimate_num_active_experts() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) estimate_quant_compression() (in module modelopt.torch.quantization.algorithms) estimate_sensitivity_scores() (AutoQuantizeGradientSearcher method) (AutoQuantizeKLDivSearcher method) eval_score() (BaseSearcher method) evaluate_importance_scores() (in module modelopt.torch.prune.importance_hooks.base_hooks_analysis) EvolveSearcher (class in modelopt.torch.nas.autonas) expand_like() (in module modelopt.torch.fastgen.utils) expand_mask() (in module modelopt.torch.speculative.eagle.utils) expand_node_names_from_patterns() (in module modelopt.onnx.quantization.graph_utils) expert_biases (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) expert_intermediate_dim (MoEConfig attribute) expert_prefix() (ExpertRemovalLayerDescriptor method) expert_prefix_name (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) expert_weights (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) ExpertConfig (class in modelopt.torch.export.model_config) ExpertRemoval (MlpInitMode attribute) ExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin) ExpertRemovalPruningMixIn (class in modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin) experts (MOEConfig attribute) ExponentialMovingAverage (class in modelopt.torch.fastgen.ema) export() (DistillationModel method) (DynamicModule method) (DynamicSpace method) (in module modelopt.torch.distill.distillation) (in module modelopt.torch.nas.conversion) (in module modelopt.torch.sparsity.weight_sparsity.sparsification) (LayerwiseDistillationModel method) (SearchSpace method) export_amax() (TensorQuantizer method) export_format (SparseAttentionConfig attribute) export_fp4() (in module modelopt.torch.quantization.export_onnx) export_fp8() (in module modelopt.torch.quantization.export_onnx) export_fp8_mha() (in module modelopt.torch.quantization.export_onnx) export_hf_checkpoint() (in module modelopt.torch.export.unified_export_hf) export_int4() (in module modelopt.torch.quantization.export_onnx) export_int8() (in module modelopt.torch.quantization.export_onnx) export_mcore_gpt_to_hf() (in module modelopt.torch.export.unified_export_megatron) export_mode (AutoNASModeDescriptor property) (FastNASModeDescriptor property) (KnowledgeDistillationModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (PuzzletronDescriptor property) (SparseAttentionModeDescriptor property) (SparseMagnitudeModeDescriptor property) export_mxfp8() (in module modelopt.torch.quantization.export_onnx) export_sparse() (in module modelopt.torch.sparsity.weight_sparsity.mode) export_sparse_attention_config() (in module modelopt.torch.sparsity.attention_sparsity.conversion) export_sparse_softmax (SparseAttentionAttributeConfig attribute) export_speculative_decoding() (in module modelopt.torch.export.unified_export_hf) export_tensorrt_llm_checkpoint() (in module modelopt.torch.export.model_config_export) export_torch_mode() (in module modelopt.torch.quantization.utils) ExportConfig (class in modelopt.torch.nas.conversion) ExportContext (class in modelopt.torch.export.registry) ExportNASModeDescriptor (class in modelopt.torch.nas.conversion) ExportPEFTConfig (class in modelopt.torch.peft.config) ExportPEFTModeDescriptor (class in modelopt.torch.peft.mode) ExportSparseConfig (class in modelopt.torch.sparsity.weight_sparsity.config) ExportSparseModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode) ExportStudentConfig (class in modelopt.torch.distill.config) ExportStudentModeDescriptor (class in modelopt.torch.distill.mode) expose_minimal_state_dict (KDLossConfig attribute) ExternalTarget (class in modelopt.torch.puzzletron.sewing_kit.core) extra_repr() (DynamicModule method) (TensorQuantizer method) extract_block_configs_and_locations() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) extract_first_image_from_messages() (in module modelopt.torch.utils.nemotron_vlm_dataset_utils) extract_layer_id() (in module modelopt.onnx.llm_export_utils.surgeon_utils) extract_solution_results() (in module modelopt.torch.puzzletron.mip.sweep) F failure_msg() (GraphCollection method) (RobustTracer method) fake_quant (QuantizerAttributeConfig attribute) (TensorQuantizer property) fake_quant_impl() (in module modelopt.torch.quantization.tensor_quant) fake_quant_v_onwrite() (in module modelopt.torch.kernels.quantization.attention.bmm2_qdq) fake_score_pred_type (DMDConfig attribute) fake_tensor() (in module modelopt.torch.puzzletron.sewing_kit.utils) fake_tensor_like() (in module modelopt.torch.puzzletron.sewing_kit.utils) fake_tensors() (in module modelopt.torch.puzzletron.sewing_kit.utils) FakeTensorQuantFunction (class in modelopt.torch.quantization.tensor_quant) FastNASConfig (class in modelopt.torch.prune.fastnas) FastNASModeDescriptor (class in modelopt.torch.prune.fastnas) FastNASPatchManager (class in modelopt.torch.prune.fastnas) fc (ExpertConfig attribute) (MLPConfig attribute) (MOEConfig property) ffn (BlockConfig attribute) ffn_hidden_size_local (DecoderLayerConfig property) ffn_prefix() (FFNIntermediateLayerDescriptor method) ffn_prefix_name (FFNIntermediateLayerDescriptor attribute) (LlamaFFNIntermediateLayerDescriptor attribute) (MistralFFNIntermediateLayerDescriptor attribute) (NemotronHV2FFNIntermediateLayerDescriptor attribute) (Qwen3FFNIntermediateLayerDescriptor attribute) (Qwen3VLFFNIntermediateLayerDescriptor attribute) FFNConfig (class in modelopt.torch.puzzletron.block_config) FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin) FFNIntermediatePruningMixIn (class in modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin) fill() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) filter_quantizable_kgen_heads() (in module modelopt.onnx.quantization.graph_utils) filter_subblock_stats_by_args() (in module modelopt.torch.puzzletron.mip.run_puzzle) final_logit_softcapping (DecoderLayerConfig attribute) final_norm_name() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) finalize() (ScoringCheckpointManager method) (SharedQuantState method) (SharedWeightGlobalAmaxState method) find_conv_to_layernorm_nodes() (in module modelopt.onnx.quantization.graph_utils) find_custom_nodes() (GraphSanitizer method) find_fusible_partitions() (in module modelopt.onnx.quantization.partitioning) find_hardcoded_patterns() (in module modelopt.onnx.quantization.partitioning) find_layer_norm_partitions() (in module modelopt.onnx.quantization.partitioning) find_lowest_common_ancestor() (in module modelopt.onnx.utils) find_mha_partitions() (in module modelopt.onnx.quantization.graph_utils) (in module modelopt.onnx.quantization.partitioning) find_nodes_from_convs_to_exclude() (in module modelopt.onnx.quantization.graph_utils) find_nodes_from_matmul_to_exclude() (in module modelopt.onnx.quantization.graph_utils) find_nodes_from_mha_to_exclude() (in module modelopt.onnx.quantization.graph_utils) find_nodes_to_exclude() (in module modelopt.onnx.quantization.graph_utils) find_non_quantizable_partitions_from_patterns() (in module modelopt.onnx.quantization.partitioning) find_quant_cfg_entry_by_path() (in module modelopt.torch.quantization.config) find_quantizable_nodes() (in module modelopt.onnx.quantization.partitioning) find_scales() (in module modelopt.onnx.quantization.quant_utils) find_shared_input_groups() (in module modelopt.torch.quantization.utils) finish() (MlflowRunLogger method) FirstKV (GQAInitMode attribute) fit_logspace (CalibrationConfig attribute) FlashSkipSoftmaxConfig (class in modelopt.torch.sparsity.attention_sparsity.config) floor_scale (Llama4AttentionConfig attribute) flush() (TeeStream method) fold_dq_fp32_to_fp16_casts() (in module modelopt.onnx.utils) fold_fp8_qdq_to_dq() (in module modelopt.onnx.llm_export_utils.surgeon_utils) fold_pqs_to_weights() (QuantRecipe static method) fold_q_fp16_to_fp32_casts() (in module modelopt.onnx.utils) fold_qdq_scale_fp16_to_fp32_casts() (in module modelopt.onnx.utils) fold_weight() (in module modelopt.torch.quantization.model_quant) (QuantModule method) (SVDQuantLinear method) force_cache_dynamic_modules() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) format_criterion() (KDLossConfig class method) (LayerwiseKDConfig class method) format_global_config() (in module modelopt.torch.puzzletron.utils.parsing) format_stitched_losses() (in module modelopt.torch.puzzletron.utils.parsing) format_tree() (RegionPattern method) forward() (ClipFunction static method) (Discriminator method) (Discriminator_ImageDiT method) (DistillationLossBalancer method) (DistillationModel method) (DummyBlock method) (DummyLMHead method) (DummyWTE method) (DynamicBlockQuantizationFunction static method) (FakeTensorQuantFunction static method) (FP4CastSTEFunction static method) (GroupedQuantizer method) (IntCastSTEFunction static method) (LogitsDistillationLoss method) (LoRAModule method) (MatchingZeros method) (MFTLoss method) (MGDLoss method) (Passage method) (QuantInputBase method) (QuantLinearConvBase method) (QuantRNNBase method) (RealQuantLinear method) (ResBlock method) (Same method) (ScaledE4M3Function static method) (SparseAttentionModule method) (StaticBlockwiseFP4FakeQuantFunction static method) (StaticLossBalancer method) (StitchedModule method) (SVDQuantLinear method) (TensorQuantizer method) (VFRNNForward method) (WrapperModelForCausalLM method) forward_attention() (SparseAttentionMethod method) forward_loop (BaseSearcher attribute) ForwardHook (class in modelopt.torch.prune.importance_hooks.base_hooks) fp4_compatible() (in module modelopt.torch.quantization.backends.utils) fp4_dequantize() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel) fp4_fake_quant() (in module modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda) fp4_fake_quant_block() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper) FP4CastSTEFunction (class in modelopt.torch.quantization.tensor_quant) fp4qdq_to_2dq() (in module modelopt.onnx.quantization.qdq_utils) fp8_compatible() (in module modelopt.torch.quantization.backends.utils) fp8_eager() (in module modelopt.torch.quantization.tensor_quant) fp8_scale_candidates() (in module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep) fp8_scale_sweep (LocalHessianCalibConfig attribute) (MseCalibConfig attribute) FP8QTensor (class in modelopt.torch.quantization.qtensor.fp8_tensor) FP8QuantExporter (class in modelopt.onnx.export) freeze() (DynamicModule method) (Passage method) freeze_base_model (PEFTConfig attribute) freeze_lora_weights (PEFTConfig attribute) freeze_lora_weights() (in module modelopt.torch.peft.conversion) from_dict() (ChildRegionInputInsertionPoint class method) (ChildRegionOutputInsertionPoint class method) (InsertionScheme class method) (NodeInputInsertionPoint class method) (PatternCache class method) (PatternSchemes class method) (ResolvedInsertionPoint class method) from_quantized_weight() (in module modelopt.torch.export.quant_utils) from_region() (RegionPattern class method) from_tensor_quantizer() (StaticBlockScaleQuantizer class method) from_value() (InputArgs class method) from_yaml() (DMDConfig class method) FromTeacher (LinearInitMode attribute) fsdp2 (EMAConfig attribute) fsdp2_wrap() (in module modelopt.torch.utils.distributed) function (FunctionTarget attribute) functionals_to_replace (QuantRNNBase property) FunctionTarget (class in modelopt.torch.puzzletron.sewing_kit.core) fuse_prequant_layernorm() (in module modelopt.torch.export.quant_utils) fuse_prequant_to_linear() (in module modelopt.torch.export.quant_utils) fused (GPTQCalibConfig attribute) fused_expert_weights (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) fused_suffix (SplitRule attribute) FusedGatedMLP (MLPType attribute) G gamma (EMAConfig attribute) gan_disc_loss() (in module modelopt.torch.fastgen.losses) gan_gen_loss() (in module modelopt.torch.fastgen.losses) gan_loss_weight_gen (DMDConfig attribute) gan_r1_reg_alpha (DMDConfig attribute) gan_r1_reg_weight (DMDConfig attribute) gan_use_same_t_noise (DMDConfig attribute) gate (MLPConfig attribute) gate_attn (DecoderLayerConfig attribute) gate_ffwd (DecoderLayerConfig attribute) GatedMLP (MLPType attribute) gather_context_logits (LLM property) gather_multi_layer_puzzle_metrics() (in module modelopt.torch.puzzletron.mip.run_puzzle) gegelu_limit (DecoderLayerConfig attribute) gemm_registry (in module modelopt.torch.quantization.backends) gen_random_inputs() (in module modelopt.onnx.utils) generate() (SearchSpace method) generate_context_logits() (LLM method) generate_diffusion_dummy_forward_fn() (in module modelopt.torch.export.diffusers_utils) generate_diffusion_dummy_inputs() (in module modelopt.torch.export.diffusers_utils) generate_search_space() (in module modelopt.torch.nas.search_space) generate_text() (LLM method) generate_tokens() (LLM method) generation_seq_len (RuntimeConfig attribute) get() (ConverterFactory class method) (ModelDescriptorFactory class method) (ModeloptBaseConfig method) (TracedHpRegistry class method) get_activation_ops() (in module modelopt.onnx.op_types) get_activation_scaling_factor() (in module modelopt.torch.export.quant_utils) (NVFP4QTensor class method) get_active() (ActivityContext method) get_aggregation_ops() (in module modelopt.onnx.op_types) get_all_input_names() (in module modelopt.onnx.utils) get_amax() (in module modelopt.onnx.quantization.quant_utils) get_arbitrary_checkpoint_dir() (ReplacementLibrary method) get_attribute() (in module modelopt.onnx.utils) get_auto_name_for_config() (QuantRecipe static method) get_auto_quantize_config() (in module modelopt.torch.quantization.algorithms) (in module modelopt.torch.quantization.model_quant) get_available_surgeries() (in module modelopt.onnx.graph_surgery) get_batch_size() (in module modelopt.onnx.utils) get_batch_size_from_bytes() (in module modelopt.onnx.utils) get_bitwise_ops() (in module modelopt.onnx.op_types) get_bool_ops() (in module modelopt.onnx.op_types) get_calibration_stats() (SparseAttentionStatsManager method) get_call_count() (AccumulatingTimer class method) get_cast_to_type() (in module modelopt.onnx.utils) get_child_nodes() (in module modelopt.onnx.utils) get_children() (Region method) get_comparison_ops() (in module modelopt.onnx.op_types) get_concat_eliminated_tensors() (in module modelopt.onnx.quantization.graph_utils) get_conditional_ops() (in module modelopt.onnx.op_types) get_config_class() (ModeloptStateManager static method) get_configs_parallel() (in module modelopt.torch.export.distribute) get_consumer_nodes() (in module modelopt.onnx.utils) get_conversation_input_ids() (in module modelopt.torch.speculative.utils) get_copy_ops() (in module modelopt.onnx.op_types) get_cost() (QuantRecipeHparam method) get_cuda_ext() (in module modelopt.torch.quantization.extensions) get_cuda_ext_fp8() (in module modelopt.torch.quantization.extensions) get_cuda_ext_mx() (in module modelopt.torch.quantization.extensions) get_cuda_memory_stats() (in module modelopt.torch.utils.perf) get_custom_layers() (in module modelopt.onnx.trt_utils) get_dataset_dataloader() (in module modelopt.torch.utils.dataset_utils) get_dataset_samples() (in module modelopt.torch.utils.dataset_utils) get_default_attention_mask_and_position_ids() (in module modelopt.torch.speculative.utils) get_diffusers_components() (in module modelopt.torch.export.diffusers_utils) get_diffusion_components() (in module modelopt.torch.export.diffusers_utils) get_diffusion_model_type() (in module modelopt.torch.export.diffusers_utils) get_dist_syncd_obj() (DistributedProcessGroup static method) get_dtype() (in module modelopt.torch.export.layer_utils) get_dynamic_graph_inputs() (in module modelopt.onnx.utils) get_e2m1_bounds() (NVFP4QTensor class method) get_e2m1_values() (NVFP4QTensor class method) get_enc_dec_models() (in module modelopt.torch.export.layer_utils) get_enc_dec_token_ids() (in module modelopt.torch.export.layer_utils) get_encoder_config() (in module modelopt.torch.export.layer_utils) get_expert_linear_names() (in module modelopt.torch.export.layer_utils) get_experts_linear_names() (in module modelopt.torch.export.layer_utils) get_experts_list() (in module modelopt.torch.export.layer_utils) get_extended_model_outputs() (in module modelopt.onnx.quantization.graph_utils) get_field_name_from_key() (ModeloptBaseConfig method) get_fim_token_ids() (in module modelopt.torch.puzzletron.utils.data.dataset) get_first() (CalibrationDataProvider method) (RandomDataProvider method) get_full_insertion_scheme() (RegionPattern method) get_fusible_backbone() (in module modelopt.onnx.quantization.graph_utils) get_ground_truth() (AcceptanceRateValidation method) get_hash() (RegionPattern method) get_hparam() (DynamicModule method) (DynamicSpace method) (in module modelopt.torch.opt.utils) get_input_names() (in module modelopt.onnx.utils) get_input_names_from_bytes() (in module modelopt.onnx.utils) get_input_shapes() (in module modelopt.onnx.quantization.graph_utils) (in module modelopt.onnx.utils) get_input_shapes_from_bytes() (in module modelopt.onnx.utils) get_jsonl_text_samples() (in module modelopt.torch.utils.dataset_utils) get_kv_cache_bias() (in module modelopt.torch.export.quant_utils) get_kv_cache_dtype() (in module modelopt.torch.export.quant_utils) get_kv_cache_scaling_factor() (in module modelopt.torch.export.quant_utils) get_kwargs_for_create_model_with_rules() (in module modelopt.torch.opt.config) get_language_model_config() (ModelDescriptor static method) (Qwen3VLModelDescriptor static method) get_language_model_from_vl() (in module modelopt.torch.export.model_utils) get_layer_axis() (in module modelopt.onnx.quantization.quant_utils) get_layer_block_size() (in module modelopt.onnx.quantization.quant_utils) get_layer_info() (in module modelopt.onnx.quantization.graph_utils) get_layer_precision_mapping() (in module modelopt.onnx.quantization.graph_utils) get_loss_mask_recovery() (in module modelopt.torch.utils.loss_mask) get_manager() (PatchManager class method) get_max_batch_size() (in module modelopt.torch.utils.dataset_utils) get_min_opset_for_precisions() (in module modelopt.onnx.utils) get_model_attributes() (in module modelopt.torch.utils.network) get_model_type() (in module modelopt.torch.export.model_utils) (ModelLoader method) get_modelopt_state() (SequentialQuantizer method) (TensorQuantizer method) get_module_device() (in module modelopt.torch.utils.network) get_module_names_to_hook() (PruningMixIn method) get_modules_names_to_hook() (GptOssExpertRemovalLayerDescriptor method) (LayerDescriptor method) (NemotronHExpertRemovalLayerDescriptor method) (NemotronHV2ExpertRemovalLayerDescriptor method) get_named_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.utils) get_nested_key() (in module modelopt.torch.puzzletron.mip.utils) (in module modelopt.torch.puzzletron.utils.parsing) get_next() (CalibrationDataProvider method) (RandomDataProvider method) get_nmprune_info() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) get_node_filter_list() (in module modelopt.onnx.quantization.autotune) get_node_for_target() (Needle method) get_node_names() (in module modelopt.onnx.utils) get_node_names_from_bytes() (in module modelopt.onnx.utils) get_nodes() (Region method) get_num_bits() (in module modelopt.onnx.quantization.quant_utils) get_op_types_not_supported_in_low_precision() (in module modelopt.onnx.autocast.utils) get_opset_version() (in module modelopt.onnx.utils) get_original_cls_by_level() (DynamicModule method) get_output_names() (in module modelopt.onnx.utils) get_output_names_from_bytes() (in module modelopt.onnx.utils) get_output_shapes() (in module modelopt.onnx.utils) get_outputs_list() (OutputSaveHook method) get_parent_nodes() (in module modelopt.onnx.utils) get_pattern_schemes() (PatternCache method) get_prequant_scaling_factor() (in module modelopt.torch.export.quant_utils) get_producer_nodes() (in module modelopt.onnx.utils) get_progress_info() (ForwardHook method) (IterativeChannelContributionHook method) (RankedChoiceVotingHook method) get_qdq_activations_from_prev_layer (LayerwiseConfig attribute) get_qdq_precisions() (in module modelopt.onnx.utils) get_qkv_group_key() (in module modelopt.torch.export.diffusers_utils) get_qtensor() (QTensorWrapper method) get_quant_config() (in module modelopt.onnx.llm_export_utils.quantization_utils) (in module modelopt.torch.export.quant_utils) get_quantizable_op_types() (in module modelopt.onnx.quantization.ort_utils) get_quantization_format() (in module modelopt.torch.export.quant_utils) get_quantized_rnn_layer_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn) get_quantized_rnn_layer_variable_len_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn) get_quantized_rnn_layer_variable_len_reverse_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn) get_quantized_tensors() (in module modelopt.onnx.quantization.qdq_utils) get_region_nodes_and_descendants() (Region method) get_resize_scales() (in module modelopt.onnx.quantization.graph_utils) get_rope_type() (ModelLoader method) get_router_logits_and_routed_experts() (NemotronHRemoveExpertsIndependentHook method) (Qwen3VLRemoveExpertsIndependentHook method) (RemoveExpertsIndependentHook method) get_rule_type() (ModeloptBaseRule class method) get_same_padding() (in module modelopt.torch.utils.network) get_scaling_factor() (in module modelopt.torch.export.quant_utils) get_scaling_factor_from_weight() (in module modelopt.torch.export.quant_utils) get_score() (QuantRecipeHparam method) get_set_ops() (in module modelopt.onnx.op_types) get_shapes() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm) get_short_signature() (RegionPattern method) get_size_of_region_and_descendants() (Region method) get_skip_softmax_context() (in module modelopt.torch.kernels.sparsity.attention) get_skipped_output_layers() (in module modelopt.onnx.quantization.partitioning) get_sliced_tensor() (in module modelopt.torch.nas.modules.utils) get_sliced_tensor_by_slices() (in module modelopt.torch.nas.modules.utils) get_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.utils) get_sparse_context() (SparseAttentionMethod method) get_sparse_method() (in module modelopt.torch.sparsity.attention_sparsity.methods) get_speech_dataset_dataloader() (in module modelopt.torch.utils.speech_dataset_utils) get_state() (QTensorWrapper method) get_stats() (SparseAttentionModule method) get_subnet_config() (in module modelopt.torch.nas.utils) get_summary() (SparseAttentionStatsManager method) get_supported_datasets() (in module modelopt.torch.utils.dataset_utils) get_supported_speech_datasets() (in module modelopt.torch.utils.speech_dataset_utils) get_supported_vlm_datasets() (in module modelopt.torch.utils.vlm_dataset_utils) get_symbol() (SymMap method) get_symmetric_ops() (in module modelopt.onnx.op_types) get_teacher_memory_from_subblock_stats() (in module modelopt.torch.puzzletron.mip.sweep) get_teacher_num_params_from_subblock_stats() (in module modelopt.torch.puzzletron.mip.sweep) get_tensor_by_name() (in module modelopt.onnx.utils) get_tensor_consumer_node_indices() (in module modelopt.onnx.quantization.graph_utils) get_tensor_consumer_nodes() (in module modelopt.onnx.quantization.graph_utils) get_tensor_dtype() (in module modelopt.onnx.quantization.qdq_utils) get_tensor_from_name() (in module modelopt.onnx.quantization.graph_utils) get_tensor_producer_nodes() (in module modelopt.onnx.quantization.graph_utils) get_tensors_parallel() (in module modelopt.torch.export.distribute) get_threshold_info() (SparseAttentionMethod method) (SparseAttentionModule method) get_total_time() (AccumulatingTimer class method) get_transformer_layers() (in module modelopt.torch.export.layer_utils) get_ttt_msk_func() (in module modelopt.torch.speculative.utils) get_unique_consumer_node() (in module modelopt.onnx.autocast.utils) get_unwrapped_name() (in module modelopt.torch.utils.network) get_used_gpu_mem_fraction() (in module modelopt.torch.utils.perf) get_value_check_ops() (in module modelopt.onnx.op_types) get_variable_inputs() (in module modelopt.onnx.utils) get_vlm_dataset_dataloader() (in module modelopt.torch.utils.vlm_dataset_utils) get_weight_block_size() (in module modelopt.torch.export.quant_utils) get_weight_groups() (ModelDescriptor class method) (NemotronHModelDescriptor class method) (NemotronHV2ModelDescriptor class method) get_weight_scaling_factor() (in module modelopt.torch.export.quant_utils) get_weight_scaling_factor_2() (in module modelopt.torch.export.quant_utils) get_weights_scaling_factor() (in module modelopt.onnx.quantization.quant_utils) (MXFP8QTensor class method) (NVFP4QTensor class method) get_weights_scaling_factor_2() (in module modelopt.onnx.quantization.quant_utils) (NVFP4QTensor class method) get_weights_scaling_factor_2_from_quantizer() (NVFP4QTensor class method) get_weights_scaling_factor_from_quantizer() (MXFP8QTensor class method) (NVFP4QTensor class method) global_amax (SharedWeightGlobalAmaxState property) (StaticBlockScaleQuantizer property) GptOssConverter (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter) GptOssExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor) GptOssKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor) GptOssModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor) gptq_fused_block_scalar() (in module modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel) GPTQCalibConfig (class in modelopt.torch.quantization.config) gpu_memory_utilization (RuntimeConfig attribute) GPUMemoryMonitor (class in modelopt.torch.utils.memory_monitor) GQAInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils) GraphCollection (class in modelopt.torch.trace.tracer) GraphSanitizer (class in modelopt.onnx.autocast.graphsanitizer) group_key() (TiedWeightMap method) GroupedQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) GroupNorm (LayerNormType attribute) guidance_scale (DistillationConfig attribute) H halflife_kimg (EMAConfig attribute) handle_arg_string() (in module modelopt.torch.puzzletron.utils.parsing) HardDisabledTensorQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) has_attribute() (in module modelopt.onnx.utils) has_const_input() (in module modelopt.onnx.quantization.graph_utils) has_fake_tensor() (in module modelopt.torch.puzzletron.sewing_kit.utils) has_path_type() (in module modelopt.onnx.quantization.graph_utils) has_pattern() (PatternCache method) has_qdq_nodes() (in module modelopt.onnx.quantization.qdq_utils) has_quantized_block_scale (StaticBlockScaleQuantizer property) has_quantized_modules() (in module modelopt.torch.export.quant_utils) has_real_quant_gemm_impl() (RealQuantLinear method) has_score (BaseSearcher property) has_state (ModeloptStateManager property) has_state_for_mode_type() (ModeloptStateManager static method) hash (InsertionScheme property) head_dim (MambaConfig attribute) hidden_act (LinearActConfig attribute) (MLPConfig attribute) (ModelConfig property) (MOEConfig attribute) hidden_size (DecoderLayerConfig property) (EmbeddingConfig property) (ModelConfig property) (RuntimeConfig attribute) HiddenSizeInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils) HiddenStatesAndLMHead (class in modelopt.torch.puzzletron.utils.validate_runtime_pipeline) hide_loss_modules() (DistillationModel method) hide_quantizers_from_state_dict() (in module modelopt.torch.export.diffusers_utils) hide_teacher_model() (DistillationModel method) high_precision_nodes (InitializerConsumerTracker attribute) HistogramCalibrator (class in modelopt.torch.quantization.calib.histogram) history (IterativeSearcher attribute) hooked__replicate_for_data_parallel() (PatchManager static method) hooked_forward() (PatchManager static method) hooked_train() (PatchManager static method) Hparam (class in modelopt.torch.opt.hparam) hparam_names_for_search (BinarySearcher property) hparam_types_for_search (BinarySearcher property) hydra_config_dir (PuzzletronConfig attribute) hydra_config_name (PuzzletronConfig attribute) I import_mcore_gpt_from_hf() (in module modelopt.torch.export.unified_export_megatron) import_plugin() (in module modelopt.torch.utils.import_utils) import_scales_from_calib_cache() (in module modelopt.onnx.quantization.calib_utils) Importance (Hparam attribute) importance (Hparam property) (QuantRecipeHparam property) ImportanceEstimator (Hparam attribute) IncludeNodeNameRegexRule (class in modelopt.onnx.autocast.nodeclassifier) IncludeOpTypes (class in modelopt.onnx.autocast.nodeclassifier) INCOMING (Symbol.CLType attribute) IndependentChannelContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks) IndependentKvHeadContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks) InfeasibleError infer_dtype_from_model() (in module modelopt.torch.export.diffusers_utils) infer_shapes() (in module modelopt.onnx.utils) infer_teacher_dir() (in module modelopt.torch.puzzletron.replacement_library.build_replacement_library) infer_types() (in module modelopt.onnx.utils) infer_types_shapes() (in module modelopt.onnx.trt_utils) infer_types_shapes_tensorrt() (in module modelopt.onnx.trt_utils) infer_types_verification() (in module modelopt.onnx.utils) infer_weights_dtype() (in module modelopt.torch.puzzletron.tools.common) inference_flops() (in module modelopt.torch.nas.utils) init_child_from_parent() (in module modelopt.torch.puzzletron.tools.bypassed_training) init_empty_module() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) init_model_from_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) init_model_from_model_like() (in module modelopt.torch.utils.network) init_module_with_state_dict() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) init_rotary_embedding() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) initial_disabled_steps (SparseAttentionAttributeConfig attribute) initialize() (QDQAutotuner method) initialize_from() (TracedHp class method) (TracedHpRegistry class method) initialize_hydra_config() (in module modelopt.torch.puzzletron.tools.hydra_utils) initialize_hydra_config_for_dir() (in module modelopt.torch.puzzletron.tools.hydra_utils) InitializerConsumerTracker (class in modelopt.onnx.autocast.precisionconverter) InitializerRangeRule (class in modelopt.onnx.autocast.nodeclassifier) input_embedding_name() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) input_gate (RgLruConfig attribute) input_index (ChildRegionInputInsertionPoint attribute) (NodeInputInsertionPoint attribute) (ResolvedInsertionPoint attribute) input_layernorm (DecoderLayerConfig attribute) input_model_path (PuzzletronConfig attribute) input_overrides (Passage property) input_quantizer (QuantInputBase attribute) input_syms (ConcatSymbol property) InputArgs (class in modelopt.torch.puzzletron.sewing_kit.passage) InputIndexTracker (class in modelopt.onnx.autocast.precisionconverter) InputReducer (class in modelopt.torch.puzzletron.sewing_kit.core) inputs (Region attribute) insert_dq_nodes() (in module modelopt.onnx.quantization.qdq_utils) insert_fp8_mha_casts() (in module modelopt.onnx.quantization.graph_utils) insert_matmul_casts() (in module modelopt.onnx.quantization.graph_utils) insert_pre_quant_scale_nodes() (in module modelopt.onnx.quantization.qdq_utils) insert_qdq_nodes() (in module modelopt.onnx.quantization.qdq_utils) insert_transpose_nodes_for_column_major() (in module modelopt.onnx.quantization.qdq_utils) Insertion Scheme InsertionScheme (class in modelopt.onnx.quantization.autotune) install_hooks() (SharedQuantState method) INT4QTensor (class in modelopt.torch.quantization.qtensor.int4_tensor) INT4QuantExporter (class in modelopt.onnx.export) int8_to_fp8() (in module modelopt.onnx.quantization.fp8) INT8QTensor (class in modelopt.torch.quantization.qtensor.int8_tensor) INT8QuantExporter (class in modelopt.onnx.export) IntCastSTEFunction (class in modelopt.torch.quantization.tensor_quant) intermediate_size (FFNConfig attribute) interpret_trt_plugins_precision_flag() (in module modelopt.onnx.trt_utils) InvalidSchemeError invert() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt) IORangeRule (class in modelopt.onnx.autocast.nodeclassifier) is_active() (ActivityContext method) (Passage method) is_attention() (in module modelopt.torch.export.layer_utils) is_attn_sparsified() (in module modelopt.torch.sparsity.attention_sparsity.conversion) is_available() (in module modelopt.torch.utils.distributed) is_binary_op() (in module modelopt.onnx.op_types) is_causal (SparseAttentionAttributeConfig attribute) is_channels_last() (in module modelopt.torch.utils.network) is_composite (RegionPattern property) is_configurable (Hparam property) is_configurable() (DynamicSpace method) (in module modelopt.torch.opt.utils) is_const_input() (in module modelopt.onnx.quantization.graph_utils) is_constant (ConcatSymbol property) (Symbol property) is_control_flow_op() (in module modelopt.onnx.op_types) is_conv() (in module modelopt.torch.export.layer_utils) is_conversion_op() (in module modelopt.onnx.op_types) is_converted() (ModeloptStateManager class method) is_copy_op() (in module modelopt.onnx.op_types) is_cross_layer (Symbol property) is_dangling (Symbol property) is_data_dependent_shape_op() (in module modelopt.onnx.op_types) is_decoder_list() (in module modelopt.torch.export.layer_utils) is_default_quantizable_op_by_ort() (in module modelopt.onnx.op_types) is_descendant_of() (Region method) is_diffusers_object() (in module modelopt.torch.export.diffusers_utils) is_dynamic (Symbol property) is_dynamic() (DynamicSpace method) (in module modelopt.torch.opt.utils) is_embedding() (in module modelopt.torch.export.layer_utils) is_empty (InsertionScheme property) (RegionPattern property) is_enabled (SparseAttentionModule property) (TensorQuantizer property) is_export_mode (ExportNASModeDescriptor property) (ExportPEFTModeDescriptor property) (ExportSparseModeDescriptor property) (ExportStudentModeDescriptor property) (ModeDescriptor property) is_failed() (GraphCollection method) (RobustTracer method) is_fp8 (TensorQuantizer property) is_free (Symbol property) is_fsdp2_model() (in module modelopt.torch.utils.distributed) is_fused_experts (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) is_fusible_reduction_op() (in module modelopt.onnx.op_types) is_fusible_scaling_op() (in module modelopt.onnx.op_types) is_generator_op() (in module modelopt.onnx.op_types) is_in_safetensors_format() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils) is_incoming (Symbol property) is_initialized (NFSWorkspace property) is_initialized() (DistributedProcessGroup method) (in module modelopt.torch.utils.distributed) is_irregular_mem_access_op() (in module modelopt.onnx.op_types) is_layernorm() (in module modelopt.torch.export.layer_utils) is_leaf (RegionPattern property) is_leaf_module() (RobustTracer method) is_linear() (in module modelopt.torch.export.layer_utils) is_linear_op() (in module modelopt.onnx.op_types) is_llama4 (AttentionConfig property) is_mamba (AttentionConfig property) is_master() (in module modelopt.torch.utils.distributed) is_mlp() (in module modelopt.torch.export.layer_utils) is_modelopt_patches_enabled() (in module modelopt.torch.nas.utils) is_modelopt_qlora (ExportContext attribute) is_modifier_op() (in module modelopt.onnx.op_types) is_moe (FFNConfig property) is_moe() (in module modelopt.torch.export.layer_utils) is_multiclass_op() (in module modelopt.onnx.op_types) is_multimodal_model() (in module modelopt.torch.export.model_utils) is_mx_format (TensorQuantizer property) is_mxfp() (TensorQuantizer method) is_non_reshape_copy_op() (in module modelopt.onnx.op_types) is_normalization_op() (in module modelopt.onnx.op_types) is_nvfp4_dynamic (TensorQuantizer property) is_nvfp4_static (TensorQuantizer property) is_outgoing (Symbol property) is_parallel() (in module modelopt.torch.utils.network) is_patched() (PatchManager class method) is_peft_model() (in module modelopt.torch.peft.convert) is_pointwise_or_elementwise_op() (in module modelopt.onnx.op_types) is_pooling_or_window_op() (in module modelopt.onnx.op_types) is_profiled (InsertionScheme property) is_qkv_projection() (in module modelopt.torch.export.diffusers_utils) is_quantized() (in module modelopt.torch.quantization.utils) is_quantized_column_parallel_linear() (in module modelopt.torch.quantization.utils) is_quantized_linear() (in module modelopt.torch.quantization.utils) is_quantized_row_parallel_linear() (in module modelopt.torch.quantization.utils) is_quantlinear() (in module modelopt.torch.export.layer_utils) is_recurrent() (in module modelopt.torch.export.layer_utils) is_recurrent_op() (in module modelopt.onnx.op_types) is_registered_leaf() (RobustTracer class method) is_registered_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer) is_replacement_identical_to_teacher() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) is_running (GPUMemoryMonitor attribute) is_searchable (ConcatSymbol property) (Symbol property) is_selection_op() (in module modelopt.onnx.op_types) is_sequence_op() (in module modelopt.onnx.op_types) is_shape_op() (in module modelopt.onnx.op_types) is_shape_preserving (SymInfo property) is_shape_preserving() (SymMap method) is_skippable() (SymDepth method) is_sortable (Hparam property) (Symbol property) is_special_node() (ConcatNodeProcessor method) is_static_block_quant (TensorQuantizer property) is_submodule_of() (in module modelopt.torch.puzzletron.sewing_kit.utils) is_submodule_or_same() (in module modelopt.torch.puzzletron.sewing_kit.utils) is_tensorrt_llm_0_8_or_9() (in module modelopt.torch.export.tensorrt_llm_utils) is_unary_op() (in module modelopt.onnx.op_types) is_unvisited() (GraphCollection method) (RobustTracer method) is_valid_decilm_checkpoint() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) items() (ModeloptBaseConfig method) (SymMap method) iter_num (IterativeSearcher attribute) iter_shared_quant_states() (in module modelopt.torch.quantization.utils) iter_weights_for_calibration() (QuantModule method) IterativeChannelContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks) IterativeSearcher (class in modelopt.torch.nas.autonas) J json_dump() (in module modelopt.torch.utils.robust_json) json_dumps() (in module modelopt.torch.utils.robust_json) json_load() (in module modelopt.torch.utils.robust_json) K k (QKVConfig attribute) k_cache_bias (AttentionConfig attribute) k_cache_scaling_factor (AttentionConfig attribute) k_layernorm (AttentionConfig attribute) K_MROPE (RopeType attribute) K_NONE (RopeType attribute) K_ROPE_ROTATE_GPTJ (RopeType attribute) K_ROPE_ROTATE_NEOX (RopeType attribute) KDLossConfig (class in modelopt.torch.distill.config) keys() (ModeloptBaseConfig method) kl_div() (in module modelopt.torch.puzzletron.utils.validation) knot() (Needle method) KnotException KnowledgeDistillationModeDescriptor (class in modelopt.torch.distill.mode) kv_cache_dtype (AttentionConfig attribute) KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin) KVHeadsPruningMixIn (class in modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin) kwargs (InputArgs attribute) L L2NormHook (class in modelopt.torch.prune.importance_hooks.base_hooks) last_mode (ModeloptStateManager property) latency_ms (InsertionScheme attribute) launch_attn_groups_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_build_library_and_stats() (in module modelopt.torch.puzzletron.build_library_and_stats) launch_build_replacement_library() (in module modelopt.torch.puzzletron.replacement_library.build_replacement_library) launch_calc_subblock_stats() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats) launch_experts_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_ffn_intermediates_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_hidden_dim_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_memory_monitor() (in module modelopt.torch.utils.memory_monitor) launch_mip_and_realize_model() (in module modelopt.torch.puzzletron.mip.mip_and_realize_models) launch_moe_ffn_intermediates_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_prune_ckpt() (in module modelopt.torch.puzzletron.pruning.pruning_ckpts) launch_realize_model() (in module modelopt.torch.puzzletron.mip.mip_and_realize_models) launch_score_activations() (in module modelopt.torch.puzzletron.activation_scoring.score_pruning_activations) launch_scoring() (in module modelopt.torch.puzzletron.scoring) layer_block_name() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) layer_name_predicates() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) layer_types (DecoderLayerConfig attribute) LayerDescriptor (class in modelopt.torch.puzzletron.pruning.pruning_mixin) LayerNorm (LayerNormType attribute) layernorm_type (LayernormConfig attribute) LayernormConfig (class in modelopt.torch.export.model_config) LayerNormContributionHook (class in modelopt.torch.prune.importance_hooks.base_hooks) LayerNormPositionType (class in modelopt.torch.export.tensorrt_llm_type) LayerNormType (class in modelopt.torch.export.tensorrt_llm_type) layers (ModelConfig attribute) layerwise (QuantizeAlgorithmConfig attribute) layerwise_calibrate() (in module modelopt.torch.quantization.model_calib) LayerwiseConfig (class in modelopt.torch.quantization.config) LayerwiseDistillationModel (class in modelopt.torch.distill.layerwise_distillation_model) LayerwiseKDConfig (class in modelopt.torch.distill.config) LayerwiseKDModeDescriptor (class in modelopt.torch.distill.mode) LEAF (RegionType attribute) learn_amax (QuantizerAttributeConfig attribute) learnable_amax (LSQConfig attribute) Linear (in module modelopt.torch.quantization.nn.modules.quant_linear) linear (LinearActConfig attribute) linear_out (RecurrentConfig attribute) linear_type (LinearConfig attribute) linear_weight_names (FFNIntermediateLayerDescriptor attribute) (LlamaFFNIntermediateLayerDescriptor attribute) (MistralFFNIntermediateLayerDescriptor attribute) (NemotronHV2FFNIntermediateLayerDescriptor attribute) (Qwen3FFNIntermediateLayerDescriptor attribute) (Qwen3VLFFNIntermediateLayerDescriptor attribute) linear_x (RecurrentConfig attribute) linear_y (RecurrentConfig attribute) LinearActConfig (class in modelopt.torch.export.model_config) LinearConfig (class in modelopt.torch.export.model_config) LinearInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils) link_to() (ConcatSymbol method) (ConcatSymbol.Input method) (Symbol method) (SymDepth method) list_closest_to_median() (in module modelopt.torch.utils.list) list_of_scale_tensors (RealQuantLinear attribute) list_repo_files_cached() (in module modelopt.torch.utils.nemotron_vlm_dataset_utils) llama4 (AttentionConfig attribute) Llama4AttentionConfig (class in modelopt.torch.puzzletron.block_config) LlamaConverter (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_converter) LlamaFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor) LlamaKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor) LlamaModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor) LLM (class in modelopt.deploy.llm.generate) llm_to_onnx() (in module modelopt.onnx.llm_export_utils.export_utils) lm_head (MedusaHeadConfig attribute) (ModelConfig attribute) LMHead (class in modelopt.torch.puzzletron.utils.validate_runtime_pipeline) ln_embed (ModelConfig attribute) ln_f (ModelConfig attribute) load() (PatternCache class method) load_and_shard_model() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils) load_calib_amax() (TensorQuantizer method) load_calib_bias() (TensorQuantizer method) load_checkpoint() (ScoringCheckpointManager method) load_config() (in module modelopt.torch.fastgen.loader) (in module modelopt.torch.opt.config_loader) load_cpp_extension() (in module modelopt.torch.utils.cpp_extension) load_dmd_config() (in module modelopt.torch.fastgen.loader) load_hook_states() (ScoringCheckpointManager method) load_json() (in module modelopt.torch.puzzletron.utils.misc) load_model() (ModelLoader method) (ReplacementLibrary method) load_model_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) load_model_with_shape_infer() (in module modelopt.onnx.quantization.ort_patching) load_modelopt_state() (in module modelopt.torch.opt.conversion) load_moe_stats() (in module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory) load_onnx_model() (in module modelopt.onnx.trt_utils) load_puzzle_solutions() (in module modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements) load_search_checkpoint() (BaseSearcher method) (BinarySearcher method) load_sharded_state_dict() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils) load_state_dict() (DistillationModel method) (ExponentialMovingAverage method) (ForwardHook method) (in module modelopt.torch.puzzletron.tools.checkpoint_utils) (IndependentChannelContributionHook method) (IndependentKvHeadContributionHook method) (IterativeChannelContributionHook method) (L2NormHook method) (LayerNormContributionHook method) (ModeloptStateManager method) (RankedChoiceVotingHook method) (RemoveExpertsIndependentHook method) load_state_dict_post_hook() (DummyModule static method) load_vlm_or_llm() (in module modelopt.torch.speculative.utils) local_hessian_calibrate() (in module modelopt.torch.quantization.model_calib) local_vocab_size (EmbeddingConfig property) LocalHessianCalibConfig (class in modelopt.torch.quantization.config) log_text() (MlflowRunLogger method) logger (in module modelopt.torch.puzzletron.tools) logits_soft_cap (DecoderLayerConfig attribute) LogitsDistillationLoss (class in modelopt.torch.distill.losses) longrope_long_mscale (DecoderLayerConfig attribute) longrope_scaling_long_factors (DecoderLayerConfig attribute) longrope_scaling_short_factors (DecoderLayerConfig attribute) longrope_short_mscale (DecoderLayerConfig attribute) lora_a_init (PEFTAttributeConfig attribute) lora_b_init (PEFTAttributeConfig attribute) LoRAModule (class in modelopt.torch.peft.lora.layer) loss_balancer (DistillationModel property) (KDLossConfig attribute) loss_modules (DistillationModel property) LossMaskRecovery (class in modelopt.torch.utils.loss_mask) low_precision_nodes (InitializerConsumerTracker attribute) LowMemorySparseTensor (class in modelopt.torch.puzzletron.utils.validation) lowrank (SVDQuantConfig attribute) lsq() (in module modelopt.torch.quantization.model_calib) LSQConfig (class in modelopt.torch.quantization.config) lstm_cell_with_proj() (in module modelopt.torch.quantization.nn.modules.quant_rnn) M m4n2_1d() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) MagnitudeSearcher (class in modelopt.torch.sparsity.weight_sparsity.magnitude) main() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm) (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) make_causal_mask() (in module modelopt.torch.speculative.eagle.utils) make_divisible() (in module modelopt.torch.utils.network) make_gs_awq_scale() (in module modelopt.onnx.quantization.qdq_utils) make_gs_dequantize_node() (in module modelopt.onnx.quantization.qdq_utils) make_gs_dequantize_output() (in module modelopt.onnx.quantization.qdq_utils) make_gs_pre_quant_scale_node() (in module modelopt.onnx.quantization.qdq_utils) make_gs_pre_quant_scale_output() (in module modelopt.onnx.quantization.qdq_utils) make_gs_quantize_node() (in module modelopt.onnx.quantization.qdq_utils) make_gs_quantize_output() (in module modelopt.onnx.quantization.qdq_utils) make_gs_quantized_weight() (in module modelopt.onnx.quantization.qdq_utils) make_gs_scale() (in module modelopt.onnx.quantization.qdq_utils) make_gs_zp() (in module modelopt.onnx.quantization.qdq_utils) mamba (AttentionConfig attribute) MambaConfig (class in modelopt.torch.puzzletron.block_config) managed_attrs (SharedQuantState attribute) (SharedWeightGlobalAmaxState attribute) match() (in module modelopt.torch.utils.graph) match_fp8_mha_pattern() (in module modelopt.onnx.quantization.graph_utils) matches() (RegionPattern method) matches_pattern() (in module modelopt.torch.utils.regex) MatchingZeros (class in modelopt.torch.puzzletron.anymodel.puzzformer.no_op) max (Hparam property) max_beam_width (LLM property) max_calibrate() (in module modelopt.torch.quantization.model_calib) max_co_batch_size (AWQClipCalibConfig attribute) max_degrade (BinarySearcher attribute) max_depth (SymDepth property) max_entries_per_pattern (PatternCache attribute) max_position_embeddings (DecoderLayerConfig attribute) (ModelConfig property) max_seq_len (LLM property) max_seqlen (CalibrationConfig attribute) max_t (SampleTimestepConfig attribute) max_tokens_per_batch (AWQClipCalibConfig attribute) max_val (TensorStats attribute) maxbound (TensorQuantizer property) MaxCalibConfig (class in modelopt.torch.quantization.config) MaxCalibrator (class in modelopt.torch.quantization.calib.max) maximum_generation_attempts (Config attribute) maximum_mutations (Config attribute) maximum_sequence_region_size (Config attribute) MaxPool1d (in module modelopt.torch.quantization.nn.modules.quant_pooling) MaxPool2d (in module modelopt.torch.quantization.nn.modules.quant_pooling) MaxPool3d (in module modelopt.torch.quantization.nn.modules.quant_pooling) maybe_cast_block_configs() (in module modelopt.torch.puzzletron.block_config) maybe_transpose_expert_weight_dimensions() (in module modelopt.torch.export.quant_utils) medusa_heads (ModelConfig attribute) medusa_layers (MedusaHeadConfig attribute) medusa_num_heads (MedusaConfig attribute) medusa_num_layers (MedusaConfig attribute) MedusaConfig (class in modelopt.torch.speculative.config) MedusaHeadConfig (class in modelopt.torch.export.model_config) MedusaModeDescriptor (class in modelopt.torch.speculative.mode) MedusaModel (class in modelopt.torch.speculative.medusa.medusa_model) members (SharedQuantState property) merge() (PatternCache method) (Region method) merge_diffusion_checkpoint() (in module modelopt.torch.export.diffusers_utils) merge_gate_fc (MLPConfig attribute) merge_gate_fc() (in module modelopt.torch.export.model_config_utils) merge_qkv() (in module modelopt.torch.export.model_config_utils) metadata (Region attribute) metadata() (SharedQuantState class method) method (AWQClipCalibConfig attribute) (AWQFullCalibConfig attribute) (AWQLiteCalibConfig attribute) (GPTQCalibConfig attribute) (LocalHessianCalibConfig attribute) (LSQConfig attribute) (MaxCalibConfig attribute) (MseCalibConfig attribute) (NVFP4ActHeadroomCalibConfig attribute) (QuantizeAlgorithmConfig attribute) (SmoothQuantCalibConfig attribute) (SparseAttentionAttributeConfig attribute) (SVDQuantConfig attribute) (VSAAttributeConfig attribute) method_name (AutoQuantizeGradientSearcher attribute) (AutoQuantizeKLDivSearcher attribute) MFTLoss (class in modelopt.torch.distill.losses) MGDLoss (class in modelopt.torch.distill.losses) middle_value (BinarySearcher attribute) min (Hparam property) min_clip_ratio (AWQClipCalibConfig attribute) min_degrade (BinarySearcher attribute) min_depth (SymDepth property) min_t (SampleTimestepConfig attribute) min_val (TensorStats attribute) minimum_distance (PatternCache attribute) minimum_schemes_to_mutate (Config attribute) minimum_topdown_search_size (Config attribute) MistralFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor) MistralKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor) MistralSmallConverter (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter) MistralSmallModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor) MlflowRunLogger (class in modelopt.torch.utils.mlflow) mlp (DecoderLayerConfig attribute) MLP (MLPType attribute) mlp_layernorm (DecoderLayerConfig attribute) mlp_no_op_post_init() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) mlp_no_op_supported() (ModelDescriptor class method) mlp_replacing_linear (DecoderLayerConfig attribute) MLPConfig (class in modelopt.torch.export.model_config) MlpInitMode (class in modelopt.torch.puzzletron.pruning.pruning_utils) MLPType (class in modelopt.torch.export.tensorrt_llm_type) mn_1d_best() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) mode (EMAConfig attribute) (RotateConfig attribute) ModeDescriptor (class in modelopt.torch.opt.mode) model (BaseSearcher attribute) (ExportContext attribute) model_config (AutoNASConfig attribute) (AWQClipCalibConfig attribute) (AWQFullCalibConfig attribute) (AWQLiteCalibConfig attribute) (CalibrationConfig attribute) (CompressConfig attribute) (DFlashConfig attribute) (DistillationConfig attribute) (DMDConfig attribute) (EagleConfig attribute) (EMAConfig attribute) (ExportConfig attribute) (ExportPEFTConfig attribute) (ExportSparseConfig attribute) (ExportStudentConfig attribute) (FastNASConfig attribute) (FlashSkipSoftmaxConfig attribute) (GPTQCalibConfig attribute) (KDLossConfig attribute) (LayerwiseConfig attribute) (LayerwiseKDConfig attribute) (LocalHessianCalibConfig attribute) (LSQConfig attribute) (MaxCalibConfig attribute) (MedusaConfig attribute) (ModeloptBaseConfig attribute) (ModeloptBaseRule attribute) (ModeloptBaseRuleConfig attribute) (MseCalibConfig attribute) (NVFP4ActHeadroomCalibConfig attribute) (PEFTAttributeConfig attribute) (PEFTConfig attribute) (PuzzletronConfig attribute) (QuantizeAlgorithmConfig attribute) (QuantizeConfig attribute) (QuantizerAttributeConfig attribute) (QuantizerCfgEntry attribute) (ReplacementLibrary property) (RotateConfig attribute) (SampleTimestepConfig attribute) (SmoothQuantCalibConfig attribute) (SparseAttentionAttributeConfig attribute) (SparseAttentionConfig attribute) (SparseGPTConfig attribute) (SparseMagnitudeConfig attribute) (SVDQuantConfig attribute) (VSAAttributeConfig attribute) (VSAConfig attribute) model_config_from_dict() (in module modelopt.torch.export.model_config_utils) model_config_to_dict() (in module modelopt.torch.export.model_config_utils) model_dump() (KDLossConfig method) (ModeloptBaseConfig method) model_dump_json() (ModeloptBaseConfig method) model_to() (in module modelopt.torch.utils.network) model_type_is_enc_dec() (in module modelopt.torch.export.layer_utils) ModelConfig (class in modelopt.torch.export.model_config) ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.model_descriptor.base) ModelDescriptorFactory (class in modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory) ModelLoader (class in modelopt.onnx.llm_export_utils.export_utils) modelopt.deploy module modelopt.deploy.llm module modelopt.deploy.llm.generate module modelopt.onnx module modelopt.onnx.autocast module modelopt.onnx.autocast.convert module modelopt.onnx.autocast.graphsanitizer module modelopt.onnx.autocast.logging_config module modelopt.onnx.autocast.nodeclassifier module modelopt.onnx.autocast.precisionconverter module modelopt.onnx.autocast.referencerunner module modelopt.onnx.autocast.utils module modelopt.onnx.export module modelopt.onnx.graph_surgery module modelopt.onnx.llm_export_utils module modelopt.onnx.llm_export_utils.export_utils module modelopt.onnx.llm_export_utils.quantization_utils module modelopt.onnx.llm_export_utils.surgeon_utils module modelopt.onnx.logging_config module modelopt.onnx.op_types module modelopt.onnx.quantization module modelopt.onnx.quantization.autotune module modelopt.onnx.quantization.calib_utils module modelopt.onnx.quantization.extensions module modelopt.onnx.quantization.fp8 module modelopt.onnx.quantization.graph_utils module modelopt.onnx.quantization.gs_patching module modelopt.onnx.quantization.int4 module modelopt.onnx.quantization.int8 module modelopt.onnx.quantization.operators module modelopt.onnx.quantization.ort_patching module modelopt.onnx.quantization.ort_utils module modelopt.onnx.quantization.partitioning module modelopt.onnx.quantization.qdq_utils module modelopt.onnx.quantization.quant_utils module modelopt.onnx.trt_utils module modelopt.onnx.utils module modelopt.torch module modelopt.torch.distill module modelopt.torch.distill.config module modelopt.torch.distill.distillation module modelopt.torch.distill.distillation_model module modelopt.torch.distill.layerwise_distillation_model module modelopt.torch.distill.loss_balancers module modelopt.torch.distill.losses module modelopt.torch.distill.mode module modelopt.torch.distill.plugins module modelopt.torch.distill.registry module modelopt.torch.export module modelopt.torch.export.convert_hf_config module modelopt.torch.export.diffusers_utils module modelopt.torch.export.distribute module modelopt.torch.export.hf_config_map module modelopt.torch.export.hf_export_handlers module modelopt.torch.export.layer_utils module modelopt.torch.export.mcore_config_map module modelopt.torch.export.model_config module modelopt.torch.export.model_config_export module modelopt.torch.export.model_config_utils module modelopt.torch.export.model_utils module modelopt.torch.export.moe_utils module modelopt.torch.export.plugins module modelopt.torch.export.postprocess module modelopt.torch.export.quant_aware_conversion module modelopt.torch.export.quant_utils module modelopt.torch.export.registry module modelopt.torch.export.tensorrt_llm_type module modelopt.torch.export.tensorrt_llm_utils module modelopt.torch.export.transformer_engine module modelopt.torch.export.unified_export_hf module modelopt.torch.export.unified_export_hf_streaming module modelopt.torch.export.unified_export_megatron module modelopt.torch.fastgen module modelopt.torch.fastgen.config module modelopt.torch.fastgen.discriminators module modelopt.torch.fastgen.ema module modelopt.torch.fastgen.factory module modelopt.torch.fastgen.flow_matching module modelopt.torch.fastgen.loader module modelopt.torch.fastgen.losses module modelopt.torch.fastgen.methods module modelopt.torch.fastgen.methods.dmd module modelopt.torch.fastgen.pipeline module modelopt.torch.fastgen.plugins module modelopt.torch.fastgen.utils module modelopt.torch.kernels module modelopt.torch.kernels.common module modelopt.torch.kernels.common.attention module modelopt.torch.kernels.quantization module modelopt.torch.kernels.quantization.attention module modelopt.torch.kernels.quantization.attention.bmm2_qdq module modelopt.torch.kernels.quantization.common module modelopt.torch.kernels.quantization.common.fp8_quant module modelopt.torch.kernels.quantization.common.nvfp4_quant module modelopt.torch.kernels.quantization.conv module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm module modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda module modelopt.torch.kernels.quantization.gemm module modelopt.torch.kernels.quantization.gemm.fp4_kernel module modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper module modelopt.torch.kernels.quantization.gemm.fp8_kernel module modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep module modelopt.torch.kernels.sparsity module modelopt.torch.kernels.sparsity.attention module modelopt.torch.kernels.sparsity.gemm module modelopt.torch.nas module modelopt.torch.nas.algorithms module modelopt.torch.nas.autonas module modelopt.torch.nas.conversion module modelopt.torch.nas.hparams module modelopt.torch.nas.hparams.concat module modelopt.torch.nas.hparams.container module modelopt.torch.nas.modules module modelopt.torch.nas.modules.container module modelopt.torch.nas.modules.conv module modelopt.torch.nas.modules.linear module modelopt.torch.nas.modules.norm module modelopt.torch.nas.modules.utils module modelopt.torch.nas.patch module modelopt.torch.nas.plugins module modelopt.torch.nas.registry module modelopt.torch.nas.search_space module modelopt.torch.nas.traced_hp module modelopt.torch.nas.utils module modelopt.torch.opt module modelopt.torch.opt.config module modelopt.torch.opt.config_loader module modelopt.torch.opt.conversion module modelopt.torch.opt.dynamic module modelopt.torch.opt.hparam module modelopt.torch.opt.mode module modelopt.torch.opt.plugins module modelopt.torch.opt.plugins.huggingface module modelopt.torch.opt.searcher module modelopt.torch.opt.utils module modelopt.torch.peft module modelopt.torch.peft.config module modelopt.torch.peft.conversion module modelopt.torch.peft.convert module modelopt.torch.peft.custom module modelopt.torch.peft.lora module modelopt.torch.peft.lora.layer module modelopt.torch.peft.lora.plugins module modelopt.torch.peft.mode module modelopt.torch.prune module modelopt.torch.prune.fastnas module modelopt.torch.prune.importance_hooks module modelopt.torch.prune.importance_hooks.base_hooks module modelopt.torch.prune.importance_hooks.base_hooks_analysis module modelopt.torch.prune.importance_hooks.compare_module_outputs module modelopt.torch.prune.importance_hooks.expert_removal_hooks module modelopt.torch.prune.importance_hooks.plugins module modelopt.torch.prune.plugins module modelopt.torch.prune.pruning module modelopt.torch.puzzletron module modelopt.torch.puzzletron.activation_scoring module modelopt.torch.puzzletron.activation_scoring.activation_hooks module modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils module modelopt.torch.puzzletron.activation_scoring.score_pruning_activations module modelopt.torch.puzzletron.anymodel module modelopt.torch.puzzletron.anymodel.converter module modelopt.torch.puzzletron.anymodel.converter.base module modelopt.torch.puzzletron.anymodel.converter.convert_any_model module modelopt.torch.puzzletron.anymodel.converter.converter_factory module modelopt.torch.puzzletron.anymodel.model_descriptor module modelopt.torch.puzzletron.anymodel.model_descriptor.base module modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory module modelopt.torch.puzzletron.anymodel.models module modelopt.torch.puzzletron.anymodel.models.gpt_oss module modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter module modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor module modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_pruned_to_mxfp4 module modelopt.torch.puzzletron.anymodel.models.llama module modelopt.torch.puzzletron.anymodel.models.llama.llama_converter module modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor module modelopt.torch.puzzletron.anymodel.models.mistral_small module modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter module modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor module modelopt.torch.puzzletron.anymodel.models.nemotron_h module modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter module modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor module modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2 module modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter module modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor module modelopt.torch.puzzletron.anymodel.models.qwen2 module modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter module modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor module modelopt.torch.puzzletron.anymodel.models.qwen3 module modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter module modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor module modelopt.torch.puzzletron.anymodel.models.qwen3_vl module modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter module modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor module modelopt.torch.puzzletron.anymodel.puzzformer module modelopt.torch.puzzletron.anymodel.puzzformer.no_op module modelopt.torch.puzzletron.anymodel.puzzformer.patcher module modelopt.torch.puzzletron.block_config module modelopt.torch.puzzletron.build_library_and_stats module modelopt.torch.puzzletron.dataset module modelopt.torch.puzzletron.dataset.prepare_dataset module modelopt.torch.puzzletron.entrypoint module modelopt.torch.puzzletron.mip module modelopt.torch.puzzletron.mip.mip_and_realize_models module modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements module modelopt.torch.puzzletron.mip.run_puzzle module modelopt.torch.puzzletron.mip.sweep module modelopt.torch.puzzletron.mip.utils module modelopt.torch.puzzletron.plugins module modelopt.torch.puzzletron.pruning module modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin module modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin module modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin module modelopt.torch.puzzletron.pruning.pruning_ckpts module modelopt.torch.puzzletron.pruning.pruning_mixin module modelopt.torch.puzzletron.pruning.pruning_utils module modelopt.torch.puzzletron.puzzletron_nas_plugin module modelopt.torch.puzzletron.replacement_library module modelopt.torch.puzzletron.replacement_library.build_replacement_library module modelopt.torch.puzzletron.replacement_library.library module modelopt.torch.puzzletron.replacement_library.replacement_utils module modelopt.torch.puzzletron.scoring module modelopt.torch.puzzletron.sewing_kit module modelopt.torch.puzzletron.sewing_kit.core module modelopt.torch.puzzletron.sewing_kit.passage module modelopt.torch.puzzletron.sewing_kit.utils module modelopt.torch.puzzletron.subblock_stats module modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats module modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory module modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats module modelopt.torch.puzzletron.subblock_stats.runtime_utils module modelopt.torch.puzzletron.subblock_stats.runtime_vllm module modelopt.torch.puzzletron.tools module modelopt.torch.puzzletron.tools.bypassed_training module modelopt.torch.puzzletron.tools.bypassed_training.child_init module modelopt.torch.puzzletron.tools.checkpoint_utils module modelopt.torch.puzzletron.tools.checkpoint_utils_hf module modelopt.torch.puzzletron.tools.common module modelopt.torch.puzzletron.tools.hydra_utils module modelopt.torch.puzzletron.tools.kd_model module modelopt.torch.puzzletron.tools.post_init_sparse module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils module modelopt.torch.puzzletron.tools.validate_model module modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements module modelopt.torch.puzzletron.tools.validation_utils module modelopt.torch.puzzletron.utils module modelopt.torch.puzzletron.utils.checkpoint_manager module modelopt.torch.puzzletron.utils.data module modelopt.torch.puzzletron.utils.data.dataloaders module modelopt.torch.puzzletron.utils.data.dataset module modelopt.torch.puzzletron.utils.dummy_modules module modelopt.torch.puzzletron.utils.misc module modelopt.torch.puzzletron.utils.parsing module modelopt.torch.puzzletron.utils.validate_runtime_pipeline module modelopt.torch.puzzletron.utils.validation module modelopt.torch.puzzletron.utils.vllm_adapter module modelopt.torch.quantization module modelopt.torch.quantization.algorithms module modelopt.torch.quantization.backends module modelopt.torch.quantization.backends.utils module modelopt.torch.quantization.calib module modelopt.torch.quantization.calib.bias module modelopt.torch.quantization.calib.calibrator module modelopt.torch.quantization.calib.histogram module modelopt.torch.quantization.calib.max module modelopt.torch.quantization.calib.mse module modelopt.torch.quantization.calib.nvfp4_act_headroom module modelopt.torch.quantization.config module modelopt.torch.quantization.conversion module modelopt.torch.quantization.export_onnx module modelopt.torch.quantization.extensions module modelopt.torch.quantization.mode module modelopt.torch.quantization.model_calib module modelopt.torch.quantization.model_quant module modelopt.torch.quantization.nn module modelopt.torch.quantization.nn.functional module modelopt.torch.quantization.nn.modules module modelopt.torch.quantization.nn.modules.quant_activations module modelopt.torch.quantization.nn.modules.quant_batchnorm module modelopt.torch.quantization.nn.modules.quant_conv module modelopt.torch.quantization.nn.modules.quant_embedding module modelopt.torch.quantization.nn.modules.quant_instancenorm module modelopt.torch.quantization.nn.modules.quant_layernorm module modelopt.torch.quantization.nn.modules.quant_linear module modelopt.torch.quantization.nn.modules.quant_module module modelopt.torch.quantization.nn.modules.quant_pooling module modelopt.torch.quantization.nn.modules.quant_rnn module modelopt.torch.quantization.nn.modules.tensor_quantizer module modelopt.torch.quantization.plugins module modelopt.torch.quantization.qtensor module modelopt.torch.quantization.qtensor.base_qtensor module modelopt.torch.quantization.qtensor.fp8_tensor module modelopt.torch.quantization.qtensor.int4_tensor module modelopt.torch.quantization.qtensor.int8_tensor module modelopt.torch.quantization.qtensor.mxfp4_tensor module modelopt.torch.quantization.qtensor.mxfp8_tensor module modelopt.torch.quantization.qtensor.nf4_tensor module modelopt.torch.quantization.qtensor.nvfp4_tensor module modelopt.torch.quantization.tensor_quant module modelopt.torch.quantization.utils module modelopt.torch.sparsity module modelopt.torch.sparsity.attention_sparsity module modelopt.torch.sparsity.attention_sparsity.calibration module modelopt.torch.sparsity.attention_sparsity.config module modelopt.torch.sparsity.attention_sparsity.conversion module modelopt.torch.sparsity.attention_sparsity.methods module modelopt.torch.sparsity.attention_sparsity.mode module modelopt.torch.sparsity.attention_sparsity.model_sparsify module modelopt.torch.sparsity.attention_sparsity.plugins module modelopt.torch.sparsity.attention_sparsity.sparse_attention module modelopt.torch.sparsity.attention_sparsity.stats_manager module modelopt.torch.sparsity.attention_sparsity.utils module modelopt.torch.sparsity.weight_sparsity module modelopt.torch.sparsity.weight_sparsity.config module modelopt.torch.sparsity.weight_sparsity.magnitude module modelopt.torch.sparsity.weight_sparsity.mode module modelopt.torch.sparsity.weight_sparsity.module module modelopt.torch.sparsity.weight_sparsity.plugins module modelopt.torch.sparsity.weight_sparsity.searcher module modelopt.torch.sparsity.weight_sparsity.sparsegpt module modelopt.torch.sparsity.weight_sparsity.sparsification module modelopt.torch.speculative module modelopt.torch.speculative.config module modelopt.torch.speculative.dflash module modelopt.torch.speculative.dflash.conversion module modelopt.torch.speculative.dflash.default_config module modelopt.torch.speculative.dflash.dflash_model module modelopt.torch.speculative.eagle module modelopt.torch.speculative.eagle.conversion module modelopt.torch.speculative.eagle.default_config module modelopt.torch.speculative.eagle.eagle_model module modelopt.torch.speculative.eagle.utils module modelopt.torch.speculative.medusa module modelopt.torch.speculative.medusa.conversion module modelopt.torch.speculative.medusa.medusa_model module modelopt.torch.speculative.mode module modelopt.torch.speculative.plugins module modelopt.torch.speculative.speculative_decoding module modelopt.torch.speculative.utils module modelopt.torch.trace module modelopt.torch.trace.analyzer module modelopt.torch.trace.modules module modelopt.torch.trace.modules.concat module modelopt.torch.trace.modules.nn module modelopt.torch.trace.symbols module modelopt.torch.trace.tracer module modelopt.torch.utils module modelopt.torch.utils.cpp_extension module modelopt.torch.utils.dataset_utils module modelopt.torch.utils.distributed module modelopt.torch.utils.graph module modelopt.torch.utils.import_utils module modelopt.torch.utils.list module modelopt.torch.utils.logging module modelopt.torch.utils.loss_mask module modelopt.torch.utils.memory_monitor module modelopt.torch.utils.mlflow module modelopt.torch.utils.nemotron_vlm_dataset_utils module modelopt.torch.utils.network module modelopt.torch.utils.perf module modelopt.torch.utils.plugins module modelopt.torch.utils.random module modelopt.torch.utils.regex module modelopt.torch.utils.robust_json module modelopt.torch.utils.serialization module modelopt.torch.utils.speech_dataset_utils module modelopt.torch.utils.tensor module modelopt.torch.utils.vlm_dataset_utils module modelopt_post_restore() (QuantModule method) modelopt_state() (in module modelopt.torch.opt.conversion) ModeloptBaseConfig (class in modelopt.torch.opt.config) ModeloptBaseRule (class in modelopt.torch.opt.config) ModeloptBaseRuleConfig (class in modelopt.torch.opt.config) ModeloptField() (in module modelopt.torch.opt.config) ModeloptStateManager (class in modelopt.torch.opt.conversion) modes_with_states() (ModeloptStateManager method) modify() (DFlashModel method) (DistillationModel method) (DynamicModule method) (EagleModel method) (LayerwiseDistillationModel method) (MedusaModel method) (SparseModule method) module modelopt.deploy modelopt.deploy.llm modelopt.deploy.llm.generate modelopt.onnx modelopt.onnx.autocast modelopt.onnx.autocast.convert modelopt.onnx.autocast.graphsanitizer modelopt.onnx.autocast.logging_config modelopt.onnx.autocast.nodeclassifier modelopt.onnx.autocast.precisionconverter modelopt.onnx.autocast.referencerunner modelopt.onnx.autocast.utils modelopt.onnx.export modelopt.onnx.graph_surgery modelopt.onnx.llm_export_utils modelopt.onnx.llm_export_utils.export_utils modelopt.onnx.llm_export_utils.quantization_utils modelopt.onnx.llm_export_utils.surgeon_utils modelopt.onnx.logging_config modelopt.onnx.op_types modelopt.onnx.quantization modelopt.onnx.quantization.autotune modelopt.onnx.quantization.calib_utils modelopt.onnx.quantization.extensions modelopt.onnx.quantization.fp8 modelopt.onnx.quantization.graph_utils modelopt.onnx.quantization.gs_patching modelopt.onnx.quantization.int4 modelopt.onnx.quantization.int8 modelopt.onnx.quantization.operators modelopt.onnx.quantization.ort_patching modelopt.onnx.quantization.ort_utils modelopt.onnx.quantization.partitioning modelopt.onnx.quantization.qdq_utils modelopt.onnx.quantization.quant_utils modelopt.onnx.trt_utils modelopt.onnx.utils modelopt.torch modelopt.torch.distill modelopt.torch.distill.config modelopt.torch.distill.distillation modelopt.torch.distill.distillation_model modelopt.torch.distill.layerwise_distillation_model modelopt.torch.distill.loss_balancers modelopt.torch.distill.losses modelopt.torch.distill.mode modelopt.torch.distill.plugins modelopt.torch.distill.registry modelopt.torch.export modelopt.torch.export.convert_hf_config modelopt.torch.export.diffusers_utils modelopt.torch.export.distribute modelopt.torch.export.hf_config_map modelopt.torch.export.hf_export_handlers modelopt.torch.export.layer_utils modelopt.torch.export.mcore_config_map modelopt.torch.export.model_config modelopt.torch.export.model_config_export modelopt.torch.export.model_config_utils modelopt.torch.export.model_utils modelopt.torch.export.moe_utils modelopt.torch.export.plugins modelopt.torch.export.postprocess modelopt.torch.export.quant_aware_conversion modelopt.torch.export.quant_utils modelopt.torch.export.registry modelopt.torch.export.tensorrt_llm_type modelopt.torch.export.tensorrt_llm_utils modelopt.torch.export.transformer_engine modelopt.torch.export.unified_export_hf modelopt.torch.export.unified_export_hf_streaming modelopt.torch.export.unified_export_megatron modelopt.torch.fastgen modelopt.torch.fastgen.config modelopt.torch.fastgen.discriminators modelopt.torch.fastgen.ema modelopt.torch.fastgen.factory modelopt.torch.fastgen.flow_matching modelopt.torch.fastgen.loader modelopt.torch.fastgen.losses modelopt.torch.fastgen.methods modelopt.torch.fastgen.methods.dmd modelopt.torch.fastgen.pipeline modelopt.torch.fastgen.plugins modelopt.torch.fastgen.utils modelopt.torch.kernels modelopt.torch.kernels.common modelopt.torch.kernels.common.attention modelopt.torch.kernels.quantization modelopt.torch.kernels.quantization.attention modelopt.torch.kernels.quantization.attention.bmm2_qdq modelopt.torch.kernels.quantization.common modelopt.torch.kernels.quantization.common.fp8_quant modelopt.torch.kernels.quantization.common.nvfp4_quant modelopt.torch.kernels.quantization.conv modelopt.torch.kernels.quantization.conv.bench_implicit_gemm modelopt.torch.kernels.quantization.conv.implicit_gemm_cuda modelopt.torch.kernels.quantization.gemm modelopt.torch.kernels.quantization.gemm.fp4_kernel modelopt.torch.kernels.quantization.gemm.fp4_kernel_hopper modelopt.torch.kernels.quantization.gemm.fp8_kernel modelopt.torch.kernels.quantization.gemm.gptq_fused_kernel modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep modelopt.torch.kernels.sparsity modelopt.torch.kernels.sparsity.attention modelopt.torch.kernels.sparsity.gemm modelopt.torch.nas modelopt.torch.nas.algorithms modelopt.torch.nas.autonas modelopt.torch.nas.conversion modelopt.torch.nas.hparams modelopt.torch.nas.hparams.concat modelopt.torch.nas.hparams.container modelopt.torch.nas.modules modelopt.torch.nas.modules.container modelopt.torch.nas.modules.conv modelopt.torch.nas.modules.linear modelopt.torch.nas.modules.norm modelopt.torch.nas.modules.utils modelopt.torch.nas.patch modelopt.torch.nas.plugins modelopt.torch.nas.registry modelopt.torch.nas.search_space modelopt.torch.nas.traced_hp modelopt.torch.nas.utils modelopt.torch.opt modelopt.torch.opt.config modelopt.torch.opt.config_loader modelopt.torch.opt.conversion modelopt.torch.opt.dynamic modelopt.torch.opt.hparam modelopt.torch.opt.mode modelopt.torch.opt.plugins modelopt.torch.opt.plugins.huggingface modelopt.torch.opt.searcher modelopt.torch.opt.utils modelopt.torch.peft modelopt.torch.peft.config modelopt.torch.peft.conversion modelopt.torch.peft.convert modelopt.torch.peft.custom modelopt.torch.peft.lora modelopt.torch.peft.lora.layer modelopt.torch.peft.lora.plugins modelopt.torch.peft.mode modelopt.torch.prune modelopt.torch.prune.fastnas modelopt.torch.prune.importance_hooks modelopt.torch.prune.importance_hooks.base_hooks modelopt.torch.prune.importance_hooks.base_hooks_analysis modelopt.torch.prune.importance_hooks.compare_module_outputs modelopt.torch.prune.importance_hooks.expert_removal_hooks modelopt.torch.prune.importance_hooks.plugins modelopt.torch.prune.plugins modelopt.torch.prune.pruning modelopt.torch.puzzletron modelopt.torch.puzzletron.activation_scoring modelopt.torch.puzzletron.activation_scoring.activation_hooks modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils modelopt.torch.puzzletron.activation_scoring.score_pruning_activations modelopt.torch.puzzletron.anymodel modelopt.torch.puzzletron.anymodel.converter modelopt.torch.puzzletron.anymodel.converter.base modelopt.torch.puzzletron.anymodel.converter.convert_any_model modelopt.torch.puzzletron.anymodel.converter.converter_factory modelopt.torch.puzzletron.anymodel.model_descriptor modelopt.torch.puzzletron.anymodel.model_descriptor.base modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory modelopt.torch.puzzletron.anymodel.models modelopt.torch.puzzletron.anymodel.models.gpt_oss modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_converter modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_model_descriptor modelopt.torch.puzzletron.anymodel.models.gpt_oss.gpt_oss_pruned_to_mxfp4 modelopt.torch.puzzletron.anymodel.models.llama modelopt.torch.puzzletron.anymodel.models.llama.llama_converter modelopt.torch.puzzletron.anymodel.models.llama.llama_model_descriptor modelopt.torch.puzzletron.anymodel.models.mistral_small modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_converter modelopt.torch.puzzletron.anymodel.models.mistral_small.mistral_small_model_descriptor modelopt.torch.puzzletron.anymodel.models.nemotron_h modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2 modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor modelopt.torch.puzzletron.anymodel.models.qwen2 modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor modelopt.torch.puzzletron.anymodel.models.qwen3 modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor modelopt.torch.puzzletron.anymodel.models.qwen3_vl modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor modelopt.torch.puzzletron.anymodel.puzzformer modelopt.torch.puzzletron.anymodel.puzzformer.no_op modelopt.torch.puzzletron.anymodel.puzzformer.patcher modelopt.torch.puzzletron.block_config modelopt.torch.puzzletron.build_library_and_stats modelopt.torch.puzzletron.dataset modelopt.torch.puzzletron.dataset.prepare_dataset modelopt.torch.puzzletron.entrypoint modelopt.torch.puzzletron.mip modelopt.torch.puzzletron.mip.mip_and_realize_models modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements modelopt.torch.puzzletron.mip.run_puzzle modelopt.torch.puzzletron.mip.sweep modelopt.torch.puzzletron.mip.utils modelopt.torch.puzzletron.plugins modelopt.torch.puzzletron.pruning modelopt.torch.puzzletron.pruning.expert_removal_pruning_mixin modelopt.torch.puzzletron.pruning.ffn_intermediate_pruning_mixin modelopt.torch.puzzletron.pruning.kv_heads_pruning_mixin modelopt.torch.puzzletron.pruning.pruning_ckpts modelopt.torch.puzzletron.pruning.pruning_mixin modelopt.torch.puzzletron.pruning.pruning_utils modelopt.torch.puzzletron.puzzletron_nas_plugin modelopt.torch.puzzletron.replacement_library modelopt.torch.puzzletron.replacement_library.build_replacement_library modelopt.torch.puzzletron.replacement_library.library modelopt.torch.puzzletron.replacement_library.replacement_utils modelopt.torch.puzzletron.scoring modelopt.torch.puzzletron.sewing_kit modelopt.torch.puzzletron.sewing_kit.core modelopt.torch.puzzletron.sewing_kit.passage modelopt.torch.puzzletron.sewing_kit.utils modelopt.torch.puzzletron.subblock_stats modelopt.torch.puzzletron.subblock_stats.calc_runtime_stats modelopt.torch.puzzletron.subblock_stats.calc_subblock_params_and_memory modelopt.torch.puzzletron.subblock_stats.calc_subblock_stats modelopt.torch.puzzletron.subblock_stats.runtime_utils modelopt.torch.puzzletron.subblock_stats.runtime_vllm modelopt.torch.puzzletron.tools modelopt.torch.puzzletron.tools.bypassed_training modelopt.torch.puzzletron.tools.bypassed_training.child_init modelopt.torch.puzzletron.tools.checkpoint_utils modelopt.torch.puzzletron.tools.checkpoint_utils_hf modelopt.torch.puzzletron.tools.common modelopt.torch.puzzletron.tools.hydra_utils modelopt.torch.puzzletron.tools.kd_model modelopt.torch.puzzletron.tools.post_init_sparse modelopt.torch.puzzletron.tools.sharded_checkpoint_utils modelopt.torch.puzzletron.tools.validate_model modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements modelopt.torch.puzzletron.tools.validation_utils modelopt.torch.puzzletron.utils modelopt.torch.puzzletron.utils.checkpoint_manager modelopt.torch.puzzletron.utils.data modelopt.torch.puzzletron.utils.data.dataloaders modelopt.torch.puzzletron.utils.data.dataset modelopt.torch.puzzletron.utils.dummy_modules modelopt.torch.puzzletron.utils.misc modelopt.torch.puzzletron.utils.parsing modelopt.torch.puzzletron.utils.validate_runtime_pipeline modelopt.torch.puzzletron.utils.validation modelopt.torch.puzzletron.utils.vllm_adapter modelopt.torch.quantization modelopt.torch.quantization.algorithms modelopt.torch.quantization.backends modelopt.torch.quantization.backends.utils modelopt.torch.quantization.calib modelopt.torch.quantization.calib.bias modelopt.torch.quantization.calib.calibrator modelopt.torch.quantization.calib.histogram modelopt.torch.quantization.calib.max modelopt.torch.quantization.calib.mse modelopt.torch.quantization.calib.nvfp4_act_headroom modelopt.torch.quantization.config modelopt.torch.quantization.conversion modelopt.torch.quantization.export_onnx modelopt.torch.quantization.extensions modelopt.torch.quantization.mode modelopt.torch.quantization.model_calib modelopt.torch.quantization.model_quant modelopt.torch.quantization.nn modelopt.torch.quantization.nn.functional modelopt.torch.quantization.nn.modules modelopt.torch.quantization.nn.modules.quant_activations modelopt.torch.quantization.nn.modules.quant_batchnorm modelopt.torch.quantization.nn.modules.quant_conv modelopt.torch.quantization.nn.modules.quant_embedding modelopt.torch.quantization.nn.modules.quant_instancenorm modelopt.torch.quantization.nn.modules.quant_layernorm modelopt.torch.quantization.nn.modules.quant_linear modelopt.torch.quantization.nn.modules.quant_module modelopt.torch.quantization.nn.modules.quant_pooling modelopt.torch.quantization.nn.modules.quant_rnn modelopt.torch.quantization.nn.modules.tensor_quantizer modelopt.torch.quantization.plugins modelopt.torch.quantization.qtensor modelopt.torch.quantization.qtensor.base_qtensor modelopt.torch.quantization.qtensor.fp8_tensor modelopt.torch.quantization.qtensor.int4_tensor modelopt.torch.quantization.qtensor.int8_tensor modelopt.torch.quantization.qtensor.mxfp4_tensor modelopt.torch.quantization.qtensor.mxfp8_tensor modelopt.torch.quantization.qtensor.nf4_tensor modelopt.torch.quantization.qtensor.nvfp4_tensor modelopt.torch.quantization.tensor_quant modelopt.torch.quantization.utils modelopt.torch.sparsity modelopt.torch.sparsity.attention_sparsity modelopt.torch.sparsity.attention_sparsity.calibration modelopt.torch.sparsity.attention_sparsity.config modelopt.torch.sparsity.attention_sparsity.conversion modelopt.torch.sparsity.attention_sparsity.methods modelopt.torch.sparsity.attention_sparsity.mode modelopt.torch.sparsity.attention_sparsity.model_sparsify modelopt.torch.sparsity.attention_sparsity.plugins modelopt.torch.sparsity.attention_sparsity.sparse_attention modelopt.torch.sparsity.attention_sparsity.stats_manager modelopt.torch.sparsity.attention_sparsity.utils modelopt.torch.sparsity.weight_sparsity modelopt.torch.sparsity.weight_sparsity.config modelopt.torch.sparsity.weight_sparsity.magnitude modelopt.torch.sparsity.weight_sparsity.mode modelopt.torch.sparsity.weight_sparsity.module modelopt.torch.sparsity.weight_sparsity.plugins modelopt.torch.sparsity.weight_sparsity.searcher modelopt.torch.sparsity.weight_sparsity.sparsegpt modelopt.torch.sparsity.weight_sparsity.sparsification modelopt.torch.speculative modelopt.torch.speculative.config modelopt.torch.speculative.dflash modelopt.torch.speculative.dflash.conversion modelopt.torch.speculative.dflash.default_config modelopt.torch.speculative.dflash.dflash_model modelopt.torch.speculative.eagle modelopt.torch.speculative.eagle.conversion modelopt.torch.speculative.eagle.default_config modelopt.torch.speculative.eagle.eagle_model modelopt.torch.speculative.eagle.utils modelopt.torch.speculative.medusa modelopt.torch.speculative.medusa.conversion modelopt.torch.speculative.medusa.medusa_model modelopt.torch.speculative.mode modelopt.torch.speculative.plugins modelopt.torch.speculative.speculative_decoding modelopt.torch.speculative.utils modelopt.torch.trace modelopt.torch.trace.analyzer modelopt.torch.trace.modules modelopt.torch.trace.modules.concat modelopt.torch.trace.modules.nn modelopt.torch.trace.symbols modelopt.torch.trace.tracer modelopt.torch.utils modelopt.torch.utils.cpp_extension modelopt.torch.utils.dataset_utils modelopt.torch.utils.distributed modelopt.torch.utils.graph modelopt.torch.utils.import_utils modelopt.torch.utils.list modelopt.torch.utils.logging modelopt.torch.utils.loss_mask modelopt.torch.utils.memory_monitor modelopt.torch.utils.mlflow modelopt.torch.utils.nemotron_vlm_dataset_utils modelopt.torch.utils.network modelopt.torch.utils.perf modelopt.torch.utils.plugins modelopt.torch.utils.random modelopt.torch.utils.regex modelopt.torch.utils.robust_json modelopt.torch.utils.serialization modelopt.torch.utils.speech_dataset_utils modelopt.torch.utils.tensor modelopt.torch.utils.vlm_dataset_utils module (ModuleTarget attribute) module_name_regex() (ExpertRemovalLayerDescriptor method) (FFNIntermediateLayerDescriptor method) (KVHeadsLayerDescriptor method) (LayerDescriptor method) module_name_relative_to_active_passage() (Passage class method) module_output (PassageOutput attribute) ModuleTarget (class in modelopt.torch.puzzletron.sewing_kit.core) moe (FFNConfig attribute) moe_calib_experts_ratio (QuantizeAlgorithmConfig attribute) moe_num_experts (DecoderLayerConfig attribute) moe_prefix() (ExpertRemovalLayerDescriptor method) moe_prefix_name (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) moe_renorm_mode (DecoderLayerConfig attribute) moe_top_k (DecoderLayerConfig attribute) moe_tp_mode (DecoderLayerConfig attribute) MoEChannelPruning (MlpInitMode attribute) MOEConfig (class in modelopt.torch.export.model_config) MoEConfig (class in modelopt.torch.puzzletron.block_config) monitor_interval (GPUMemoryMonitor attribute) monitor_thread (GPUMemoryMonitor attribute) mse_loss() (in module modelopt.torch.puzzletron.utils.validation) MseCalibConfig (class in modelopt.torch.quantization.config) MseCalibrator (class in modelopt.torch.quantization.calib.mse) MultipleExternalNodesException mup_attn_multiplier (DecoderLayerConfig attribute) mup_embedding_multiplier (DecoderLayerConfig attribute) mup_use_scaling (DecoderLayerConfig attribute) mup_width_multiplier (DecoderLayerConfig attribute) MXFP4QTensor (class in modelopt.torch.quantization.qtensor.mxfp4_tensor) MXFP8QTensor (class in modelopt.torch.quantization.qtensor.mxfp8_tensor) MXFP8QuantExporter (class in modelopt.onnx.export) N name (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (DFlashModeDescriptor property) (EagleModeDescriptor property) (ExportNASModeDescriptor property) (ExportPEFTModeDescriptor property) (ExportSparseModeDescriptor property) (ExportStudentModeDescriptor property) (FastNASModeDescriptor property) (FunctionTarget attribute) (KnowledgeDistillationModeDescriptor property) (LayerwiseKDModeDescriptor property) (LossMaskRecovery attribute) (MedusaModeDescriptor property) (ModeDescriptor property) (ModuleTarget attribute) (PEFTModeDescriptor property) (PuzzletronDescriptor property) (SharedQuantState attribute) (SharedWeightGlobalAmaxState attribute) (SparseAttentionMethod property) (SparseAttentionModeDescriptor property) (SparseGPTModeDescriptor property) (SparseMagnitudeModeDescriptor property) name_onnx_nodes() (in module modelopt.onnx.utils) named_dynamic_modules() (DynamicSpace method) (in module modelopt.torch.opt.utils) named_hparams() (DynamicModule method) (DynamicSpace method) (in module modelopt.torch.opt.utils) named_modules() (SymMap method) named_sym_dicts() (SymMap method) named_symbols() (SymMap method) narrow_range (QuantizerAttributeConfig attribute) (TensorQuantizer property) need_calibration() (in module modelopt.torch.quantization.config) Needle (class in modelopt.torch.puzzletron.sewing_kit.core) NemotronHConverter (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_converter) NemotronHExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor) NemotronHKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor) NemotronHModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h.nemotron_h_model_descriptor) NemotronHRemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks) NemotronHV2Converter (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_converter) NemotronHV2ExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor) NemotronHV2FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor) NemotronHV2KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor) NemotronHV2ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.nemotron_h_v2.nemotron_h_v2_model_descriptor) NemotronTarPlusJsonlIterable (class in modelopt.torch.utils.nemotron_vlm_dataset_utils) new_decoder_architecture (DecoderLayerConfig attribute) next_modes (AutoNASModeDescriptor property) (FastNASModeDescriptor property) (ModeDescriptor property) (SparseMagnitudeModeDescriptor property) next_prohibited_modes (ModeDescriptor property) (SparseAttentionModeDescriptor property) NF4QTensor (class in modelopt.torch.quantization.qtensor.nf4_tensor) NFSWorkspace (class in modelopt.torch.export.distribute) nn_batchnorm1d (AutoNASConfig attribute) (FastNASConfig attribute) nn_batchnorm2d (AutoNASConfig attribute) (FastNASConfig attribute) nn_batchnorm3d (AutoNASConfig attribute) (FastNASConfig attribute) nn_conv1d (AutoNASConfig attribute) (FastNASConfig attribute) nn_conv2d (AutoNASConfig attribute) (FastNASConfig attribute) (SparseGPTConfig attribute) (SparseMagnitudeConfig attribute) nn_conv3d (AutoNASConfig attribute) (FastNASConfig attribute) nn_convtranspose1d (AutoNASConfig attribute) (FastNASConfig attribute) nn_convtranspose2d (AutoNASConfig attribute) (FastNASConfig attribute) nn_convtranspose3d (AutoNASConfig attribute) (FastNASConfig attribute) nn_groupnorm (AutoNASConfig attribute) (FastNASConfig attribute) nn_instancenorm1d (AutoNASConfig attribute) (FastNASConfig attribute) nn_instancenorm2d (AutoNASConfig attribute) (FastNASConfig attribute) nn_instancenorm3d (AutoNASConfig attribute) (FastNASConfig attribute) nn_layernorm (AutoNASConfig attribute) (FastNASConfig attribute) nn_linear (AutoNASConfig attribute) (FastNASConfig attribute) (SparseGPTConfig attribute) (SparseMagnitudeConfig attribute) nn_sequential (AutoNASConfig attribute) nn_syncbatchnorm (AutoNASConfig attribute) (FastNASConfig attribute) no_modelopt_patches (class in modelopt.torch.nas.utils) no_none_elements() (in module modelopt.onnx.llm_export_utils.surgeon_utils) no_op (SubblockConfig attribute) no_stdout() (in module modelopt.torch.utils.logging) NoActivePassageContextError node (InputIndexTracker attribute) node_index (ChildRegionOutputInsertionPoint attribute) (InputIndexTracker attribute) (NodeInputInsertionPoint attribute) (ResolvedInsertionPoint attribute) node_inputs (InsertionScheme attribute) node_passages (StitchedModule attribute) NodeClassifier (class in modelopt.onnx.autocast.nodeclassifier) NodeInputInsertionPoint (class in modelopt.onnx.quantization.autotune) NodeRuleBase (class in modelopt.onnx.autocast.nodeclassifier) nodes (Region attribute) NONE (Symbol.CLType attribute) normalize_quant_cfg() (QuantizeConfig class method) normalize_quant_cfg_list() (in module modelopt.torch.quantization.config) normalized_hadamard_transform() (in module modelopt.torch.quantization.nn.functional) normalized_mse_loss() (in module modelopt.torch.puzzletron.tools.kd_model) (in module modelopt.torch.puzzletron.utils.validation) num2hrb() (in module modelopt.torch.utils.logging) num_attention_heads (DecoderLayerConfig attribute) (ModelConfig property) (RuntimeConfig attribute) num_bits (QuantizerAttributeConfig attribute) (QuantRecipe property) (TensorQuantizer property) num_decode_tokens (CalibrationConfig attribute) num_experts_per_tok (MoEConfig attribute) num_groups (MambaConfig attribute) num_heads (MambaConfig attribute) num_iters (RuntimeConfig attribute) num_key_value_heads (AttentionConfig attribute) (RuntimeConfig attribute) num_kv_heads (DecoderLayerConfig attribute) (ModelConfig property) num_length_bins (CalibrationConfig attribute) num_local_experts (MoEConfig attribute) num_medusa_heads (ModelConfig attribute) num_medusa_layers (ModelConfig attribute) num_patterns (PatternCache property) num_satisfied (IterativeSearcher attribute) num_schemes (PatternSchemes property) num_train_timesteps (DistillationConfig attribute) num_warmup_iters (RuntimeConfig attribute) numpy_to_torch() (in module modelopt.torch.utils.tensor) numpy_type (PrecisionTypes attribute) nvfp4_act_headroom_calibrate() (in module modelopt.torch.quantization.model_calib) nvfp4_fp8_scale_sweep() (in module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep) nvfp4_fp8_scale_sweep_hessian() (in module modelopt.torch.kernels.quantization.gemm.nvfp4_fp8_sweep) nvfp4_gemm() (in module modelopt.torch.quantization.backends) NVFP4ActHeadroomCalibConfig (class in modelopt.torch.quantization.config) NVFP4ActHeadroomCalibrator (class in modelopt.torch.quantization.calib.nvfp4_act_headroom) NVFP4MSECalibrator (class in modelopt.torch.quantization.calib.mse) NVFP4QTensor (class in modelopt.torch.quantization.qtensor.nvfp4_tensor) NVFP4QuantExporter (class in modelopt.onnx.export) NVFP4StaticQuantizer (in module modelopt.torch.quantization.nn.modules.tensor_quantizer) O o_proj_name (GptOssKVHeadsLayerDescriptor attribute) (KVHeadsLayerDescriptor attribute) (LlamaKVHeadsLayerDescriptor attribute) (MistralKVHeadsLayerDescriptor attribute) (NemotronHKVHeadsLayerDescriptor attribute) (NemotronHV2KVHeadsLayerDescriptor attribute) (Qwen3KVHeadsLayerDescriptor attribute) (Qwen3VLKVHeadsLayerDescriptor attribute) OfflineSupervisedDataset (class in modelopt.torch.speculative.eagle.utils) only_student_forward() (DistillationModel method) only_teacher_forward() (DistillationModel method) OnlyInternalNodesException onnx_type (PrecisionTypes attribute) onnx_type_str_to_enum() (in module modelopt.onnx.utils) ONNXQuantExporter (class in modelopt.onnx.export) original (Hparam property) original() (in module modelopt.torch.utils.random) original_cls (DynamicModule property) original_max_position_embeddings (DecoderLayerConfig attribute) original_meta_tensor (BaseQuantizedTensor attribute) original_score (BinarySearcher attribute) OUTGOING (Symbol.CLType attribute) output_embedding_name() (GptOssModelDescriptor static method) (LlamaModelDescriptor static method) (MistralSmallModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen2ModelDescriptor static method) (Qwen3ModelDescriptor static method) (Qwen3VLModelDescriptor static method) output_index (ChildRegionOutputInsertionPoint attribute) output_overrides (Passage property) output_quantizer (QuantInputBase attribute) outputs (Region attribute) OutputSaveHook (class in modelopt.torch.prune.importance_hooks.compare_module_outputs) OutputsLoopFoundException OutputValue (in module modelopt.torch.puzzletron.sewing_kit.passage) override_config_with_block_configs() (in module modelopt.torch.puzzletron.anymodel.puzzformer.patcher) P p_mean (SampleTimestepConfig attribute) p_std (SampleTimestepConfig attribute) pack_float32_to_4bit_cpp_based() (in module modelopt.onnx.quantization.quant_utils) pack_float32_to_4bit_optimized() (in module modelopt.onnx.quantization.quant_utils) pack_int4_in_uint8() (in module modelopt.torch.export.quant_utils) pack_linear_weights() (in module modelopt.torch.export.model_config_utils) pack_real_quantize_weight() (in module modelopt.torch.quantization.qtensor.base_qtensor) pack_weights_to_int4() (in module modelopt.onnx.quantization.quant_utils) pad_embedding_lm_head() (in module modelopt.torch.export.postprocess) pad_nvfp4_weights() (in module modelopt.torch.export.diffusers_utils) pad_token_id (ModelConfig attribute) pad_weights() (in module modelopt.torch.export.model_config_utils) parallel_attention (DecoderLayerConfig attribute) parallel_blocks (BlockConfig attribute) parallel_state (QuantModule property) ParallelState (class in modelopt.torch.utils.distributed) param_num_from_forward() (in module modelopt.torch.utils.network) parent (Region attribute) (Symbol property) parent_class (QuantizerCfgEntry attribute) parse_json() (in module modelopt.torch.puzzletron.utils.parsing) parse_layer_replacement() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) parse_path() (in module modelopt.torch.puzzletron.utils.parsing) parse_shapes_spec() (in module modelopt.onnx.utils) part_suffixes (SplitRule attribute) partial_rotary_factor (DecoderLayerConfig attribute) pass_through_bwd (QuantizerAttributeConfig attribute) Passage (class in modelopt.torch.puzzletron.sewing_kit.passage) PassageInputAdapter (class in modelopt.torch.puzzletron.sewing_kit.passage) PassageInputOverrides (class in modelopt.torch.puzzletron.sewing_kit.passage) PassageOutput (class in modelopt.torch.puzzletron.sewing_kit.passage) PassageOutputAdapter (class in modelopt.torch.puzzletron.sewing_kit.passage) PassageOutputOverrides (class in modelopt.torch.puzzletron.sewing_kit.passage) patch() (PatchManager method) patch_data (PatchManager property) patch_data_or_empty (PatchManager property) patch_gs_modules() (in module modelopt.onnx.quantization.gs_patching) patch_module() (in module modelopt.torch.puzzletron.sewing_kit.passage) patch_ort_modules() (in module modelopt.onnx.quantization.ort_patching) patch_transformers5_params_loading() (in module modelopt.torch.speculative.utils) PatchManager (class in modelopt.torch.nas.patch) Pattern pattern (PatternSchemes attribute) (RenameRule attribute) Pattern Cache pattern_cache_max_entries_per_pattern (Config attribute) pattern_cache_minimum_distance (Config attribute) pattern_schemes (PatternCache attribute) pattern_signature (PatternSchemes property) pattern_size (PatternSchemes property) PatternCache (class in modelopt.onnx.quantization.autotune) PatternSchemes (class in modelopt.onnx.quantization.autotune) peak_memory (GPUMemoryMonitor attribute) peer_rank (RemoteTarget attribute) PEFTAttributeConfig (class in modelopt.torch.peft.config) PEFTConfig (class in modelopt.torch.peft.config) PEFTModeDescriptor (class in modelopt.torch.peft.mode) per_channel_scale (LinearConfig attribute) perc_damp (GPTQCalibConfig attribute) perform_pipeline_stitches() (in module modelopt.torch.puzzletron.utils.validate_runtime_pipeline) performance_threshold (Config attribute) permute() (in module modelopt.torch.puzzletron.utils.data.dataset) pipeline_parallel (ModelConfig attribute) pop() (SymMap method) populate() (SharedQuantState class method) population (EvolveSearcher attribute) position_embedding (ModelConfig attribute) position_embedding_type (DecoderLayerConfig attribute) post_feedforward_layernorm (DecoderLayerConfig attribute) post_layernorm (DecoderLayerConfig attribute) (LayerNormPositionType attribute) post_process() (ConcatNodeProcessor method) (FP8QuantExporter static method) (INT4QuantExporter static method) (INT8QuantExporter static method) (MXFP8QuantExporter static method) (NVFP4QuantExporter static method) (ONNXQuantExporter static method) postprocess_amax() (in module modelopt.torch.quantization.model_quant) postprocess_model_config() (in module modelopt.torch.export.postprocess) postprocess_state_dict() (in module modelopt.torch.export.quant_utils) postprocess_tensors() (in module modelopt.torch.export.postprocess) pre_feedforward_layernorm (DecoderLayerConfig attribute) pre_layernorm (LayerNormPositionType attribute) pre_process() (FP8QuantExporter static method) (INT4QuantExporter static method) (INT8QuantExporter static method) (MXFP8QuantExporter static method) (NVFP4QuantExporter static method) (ONNXQuantExporter static method) pre_quant_scale (TensorQuantizer property) PrecisionConverter (class in modelopt.onnx.autocast.precisionconverter) PrecisionTypes (class in modelopt.onnx.autocast.precisionconverter) precompile() (in module modelopt.torch.quantization.extensions) pred_noise_to_pred_x0() (in module modelopt.torch.fastgen.flow_matching) pred_type (DistillationConfig attribute) pred_x0_from_flow() (in module modelopt.torch.fastgen.flow_matching) prefill_seq_len (RuntimeConfig attribute) prep_for_eval() (in module modelopt.torch.nas.patch) prepare() (in module modelopt.torch.sparsity.weight_sparsity.sparsegpt) prepare_cu_seqlens() (ConstantLengthDataset method) prepare_dataloader() (in module modelopt.torch.puzzletron.tools.validate_model) prepare_enc_dec_export_dir() (in module modelopt.torch.export.tensorrt_llm_utils) prepare_messages_for_chat_template() (in module modelopt.torch.utils.dataset_utils) prepare_model() (in module modelopt.torch.puzzletron.tools.validate_model) prepare_t5_decoder_layer() (in module modelopt.torch.export.tensorrt_llm_utils) prepare_tmp_checkpoint_dir() (ReplacementLibrary method) preprocess_linear_fusion() (in module modelopt.torch.export.quant_utils) prequant_scaling_factor (LinearConfig attribute) (QKVConfig property) preserve_quantizer_attributes_context() (in module modelopt.torch.quantization.conversion) print_args() (in module modelopt.torch.utils.logging) print_quant_summary() (in module modelopt.torch.quantization.model_quant) print_rank_0() (in module modelopt.torch.utils.logging) print_search_space_summary() (in module modelopt.torch.nas.utils) print_sparse_attention_summary() (in module modelopt.torch.sparsity.attention_sparsity.conversion) print_stat() (in module modelopt.onnx.quantization.graph_utils) print_summary() (SearchSpace method) process() (ConcatNodeProcessor method) process_and_save_dataset() (in module modelopt.torch.puzzletron.dataset.prepare_dataset) process_group (RemoteTarget attribute) process_layer_quant_config() (in module modelopt.torch.export.quant_utils) process_model() (ONNXQuantExporter class method) profile() (in module modelopt.torch.nas.algorithms) profile_timestamp (InsertionScheme attribute) proj (ExpertConfig attribute) (MLPConfig attribute) promote_nvfp4_static_quantizers() (in module modelopt.torch.quantization.utils) promote_static_block_weight_quantizers() (in module modelopt.torch.quantization.utils) prune() (in module modelopt.torch.prune.pruning) (SymMap method) prune_single_layer() (ExpertRemovalPruningMixIn method) (FFNIntermediatePruningMixIn method) (KVHeadsPruningMixIn method) PruneByActivationsLog (MlpInitMode attribute) PruneByChannelRanking (HiddenSizeInitMode attribute) PruneKVHeads (GQAInitMode attribute) pruning_mixins() (GptOssModelDescriptor static method) (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) (Qwen3VLModelDescriptor static method) PruningMixIn (class in modelopt.torch.puzzletron.pruning.pruning_mixin) puzzle_dir (PuzzletronConfig attribute) puzzletron() (in module modelopt.torch.puzzletron.entrypoint) PuzzletronConfig (class in modelopt.torch.puzzletron.puzzletron_nas_plugin) PuzzletronDescriptor (class in modelopt.torch.puzzletron.puzzletron_nas_plugin) PuzzletronModel (class in modelopt.torch.puzzletron.puzzletron_nas_plugin) PuzzletronSearcher (class in modelopt.torch.puzzletron.puzzletron_nas_plugin) Q q (QKVConfig attribute) Q/DQ Nodes q_layernorm (AttentionConfig attribute) qdq_to_dq() (in module modelopt.onnx.quantization.qdq_utils) QDQAutotuner (class in modelopt.onnx.quantization.autotune) QDQConvTranspose (class in modelopt.onnx.quantization.operators) QDQCustomOp (class in modelopt.onnx.quantization.operators) QDQNormalization (class in modelopt.onnx.quantization.operators) qkv (AttentionConfig attribute) QKVConfig (class in modelopt.torch.export.model_config) qkvo_weight_names (GptOssKVHeadsLayerDescriptor attribute) (KVHeadsLayerDescriptor attribute) (LlamaKVHeadsLayerDescriptor attribute) (MistralKVHeadsLayerDescriptor attribute) (NemotronHKVHeadsLayerDescriptor attribute) (NemotronHV2KVHeadsLayerDescriptor attribute) (Qwen3KVHeadsLayerDescriptor attribute) (Qwen3VLKVHeadsLayerDescriptor attribute) QTensorWrapper (class in modelopt.torch.quantization.qtensor.base_qtensor) quant_cfg (QuantizeConfig attribute) quant_gemm (CompressConfig attribute) quant_tensor() (in module modelopt.onnx.quantization.quant_utils) QuantAdaptiveAvgPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantAdaptiveAvgPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantAdaptiveAvgPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantAvgPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantAvgPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantAvgPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantConv1d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantConv2d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantConv3d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantConversionUnsupportedError QuantConvTranspose1d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantConvTranspose2d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantConvTranspose3d (class in modelopt.torch.quantization.nn.modules.quant_conv) QuantEmbedding (in module modelopt.torch.quantization.nn.modules.quant_embedding) QuantInputBase (class in modelopt.torch.quantization.nn.modules.quant_module) QuantInstanceNorm1d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm) QuantInstanceNorm2d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm) QuantInstanceNorm3d (class in modelopt.torch.quantization.nn.modules.quant_instancenorm) quantization (ConvConfig attribute) (LinearConfig attribute) (ModelConfig attribute) quantize() (BaseQuantizedTensor class method) (FP8QTensor class method) (in module modelopt.onnx.llm_export_utils.quantization_utils) (in module modelopt.onnx.quantization) (in module modelopt.onnx.quantization.fp8) (in module modelopt.onnx.quantization.int4) (in module modelopt.onnx.quantization.int8) (in module modelopt.onnx.quantization.quant_utils) (in module modelopt.torch.quantization.model_quant) (INT4QTensor class method) (INT8QTensor class method) (MXFP4QTensor class method) (MXFP8QTensor class method) (NF4QTensor class method) (NVFP4QTensor class method) (QDQConvTranspose method) (QDQCustomOp method) (QDQNormalization method) quantize_pre_scale (LSQConfig attribute) quantize_weight() (QuantLinearConvBase method) (QuantRNNBase method) quantize_weights_to_int4() (in module modelopt.onnx.quantization.qdq_utils) quantize_weights_to_mxfp8() (in module modelopt.onnx.quantization.qdq_utils) quantize_with_scale() (MXFP8QTensor class method) QuantizeAlgorithmConfig (class in modelopt.torch.quantization.config) QuantizeConfig (class in modelopt.torch.quantization.config) quantized (GptOssConverter attribute) quantized_cell_forward() (in module modelopt.torch.quantization.nn.modules.quant_rnn) quantized_data (BaseQuantizedTensor attribute) (FP8QTensor attribute) (INT4QTensor attribute) (INT8QTensor attribute) (MXFP4QTensor attribute) (MXFP8QTensor attribute) (NF4QTensor attribute) (NVFP4QTensor attribute) quantizer_name (QuantizerCfgEntry attribute) QuantizerAttributeConfig (class in modelopt.torch.quantization.config) QuantizerCfgEntry (class in modelopt.torch.quantization.config) QuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear) QuantLinearConvBase (class in modelopt.torch.quantization.nn.modules.quant_module) QuantMaxPool1d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantMaxPool2d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantMaxPool3d (class in modelopt.torch.quantization.nn.modules.quant_pooling) QuantModule (class in modelopt.torch.quantization.nn.modules.quant_module) QuantRecipe (class in modelopt.torch.quantization.algorithms) QuantRecipeHparam (class in modelopt.torch.quantization.algorithms) QuantRNNBase (class in modelopt.torch.quantization.nn.modules.quant_rnn) QuantRNNFullBase (class in modelopt.torch.quantization.nn.modules.quant_rnn) query_pre_attn_scalar (DecoderLayerConfig attribute) Qwen2Converter (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_converter) Qwen2FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor) Qwen2ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen2.qwen2_model_descriptor) Qwen3Converter (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_converter) Qwen3FFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor) Qwen3KVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor) Qwen3ModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3.qwen3_model_descriptor) Qwen3VLConverter (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_converter) Qwen3VLExpertRemovalLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor) Qwen3VLFFNIntermediateLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor) Qwen3VLKVHeadsLayerDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor) Qwen3VLModelDescriptor (class in modelopt.torch.puzzletron.anymodel.models.qwen3_vl.qwen3_vl_model_descriptor) Qwen3VLRemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks) qwen_type (DecoderLayerConfig attribute) R r1_loss() (in module modelopt.torch.fastgen.losses) raise_unknown_subblock_config_error() (in module modelopt.torch.puzzletron.utils.misc) rampup_ratio (EMAConfig attribute) Random (HiddenSizeInitMode attribute) (LinearInitMode attribute) (MlpInitMode attribute) random() (in module modelopt.torch.utils.random) RandomBlock (GQAInitMode attribute) RandomDataProvider (class in modelopt.onnx.quantization.calib_utils) randomize_weights() (in module modelopt.onnx.utils) randomize_weights_onnx_bytes() (in module modelopt.onnx.utils) RandomKV (GQAInitMode attribute) RandomSearcher (class in modelopt.torch.nas.autonas) rank (ModelConfig attribute) (PEFTAttributeConfig attribute) rank() (DistributedProcessGroup method) (in module modelopt.torch.utils.distributed) RankedChoiceVotingHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks) RankedChoiceVotingHookNemotronH (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks) read_configs_and_weights_from_rank() (NFSWorkspace method) read_f16_tensor_as_fp32() (in module modelopt.onnx.utils) real_tensors() (in module modelopt.torch.puzzletron.sewing_kit.utils) RealQuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear) record_call_module() (RobustTracer method) recurrent (DecoderLayerConfig attribute) recurrent_gate (RgLruConfig attribute) recurrent_param (RgLruConfig attribute) RecurrentConfig (class in modelopt.torch.export.model_config) recursive_trace() (GraphCollection method) (in module modelopt.torch.trace.tracer) reduce_amax() (in module modelopt.torch.quantization.utils) reduce_sum() (in module modelopt.torch.quantization.utils) reducer_fn() (InputReducer method) ReferenceRunner (class in modelopt.onnx.autocast.referencerunner) Region (class in modelopt.onnx.quantization.autotune) region_index (ChildRegionInputInsertionPoint attribute) (ChildRegionOutputInsertionPoint attribute) region_outputs (InsertionScheme attribute) RegionPattern (class in modelopt.onnx.quantization.autotune) RegionType (class in modelopt.onnx.quantization.autotune) register() (ConverterFactory class method) (in module modelopt.torch.quantization.conversion) (ModelDescriptorFactory class method) (SymMap class method) (TracedHpRegistry class method) register_activation_hooks() (in module modelopt.torch.puzzletron.activation_scoring.activation_hooks.utils) register_custom_model_plugins_on_the_fly() (in module modelopt.torch.peft.custom) (in module modelopt.torch.sparsity.attention_sparsity.plugins) register_custom_support() (AutoQuantizeGradientSearcher class method) register_decorator() (ConverterFactory class method) (ModelDescriptorFactory class method) register_default() (ModeloptBaseRuleConfig class method) register_diffusers_triton_attention() (in module modelopt.torch.kernels.sparsity.attention) register_hydra_resolvers() (in module modelopt.torch.puzzletron.tools.hydra_utils) register_importance() (Hparam method) register_leaf() (RobustTracer class method) register_loss_mask_recovery() (in module modelopt.torch.utils.loss_mask) register_ltx_triton_attention() (in module modelopt.torch.kernels.sparsity.attention) register_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer) register_sparse_method() (in module modelopt.torch.sparsity.attention_sparsity.methods) rel_attn_max_distance (DecoderLayerConfig attribute) rel_attn_num_buckets (DecoderLayerConfig attribute) rel_attn_table (AttentionConfig attribute) RelativeAttentionTableConfig (class in modelopt.torch.export.model_config) RemoteTarget (class in modelopt.torch.puzzletron.sewing_kit.core) remove_bn() (in module modelopt.torch.utils.network) remove_child() (Region method) remove_disconnected_outputs() (GraphSanitizer method) remove_graph_input_q() (in module modelopt.onnx.quantization.qdq_utils) remove_hooks() (SharedQuantState method) remove_input_dq_and_output_q() (in module modelopt.onnx.quantization.qdq_utils) remove_node_training_mode() (in module modelopt.onnx.utils) remove_output_initializers() (in module modelopt.onnx.quantization.graph_utils) remove_partial_input_qdq() (in module modelopt.onnx.quantization.graph_utils) remove_redundant_cast_nodes() (in module modelopt.onnx.quantization.graph_utils) remove_redundant_casts() (in module modelopt.onnx.utils) remove_state() (ModeloptStateManager class method) remove_weights_data() (in module modelopt.onnx.utils) RemoveExpertsIndependentHook (class in modelopt.torch.prune.importance_hooks.expert_removal_hooks) RenameRule (class in modelopt.torch.export.quant_aware_conversion) repeat_block_n_times (RuntimeConfig attribute) repl (RenameRule attribute) replace_attention_with_gqa() (in module modelopt.onnx.graph_surgery) replace_custom_domain_nodes() (GraphSanitizer method) replace_forward() (in module modelopt.torch.nas.utils) replace_function() (in module modelopt.torch.quantization.utils) replace_layernorm_pattern() (GraphSanitizer method) replace_lora_module() (in module modelopt.torch.peft.conversion) replace_quant_module() (in module modelopt.torch.quantization.conversion) replace_scale_values() (in module modelopt.onnx.quantization.qdq_utils) replace_sparse_attention_modules() (in module modelopt.torch.sparsity.attention_sparsity.conversion) replace_with_linear (SubblockConfig attribute) replace_zero_scale_with_smallest_nonzero() (in module modelopt.onnx.quantization.qdq_utils) replacement_is_teacher() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) ReplacementLibrary (class in modelopt.torch.puzzletron.replacement_library.library) report() (AccumulatingTimer class method) report_memory() (in module modelopt.torch.utils.perf) representative_weight_quantizer() (in module modelopt.torch.quantization.utils) require_model_like (ModeDescriptor property) RequiredPassageOutputsCapturedSignal requires_trust_remote_code() (ModelDescriptor static method) (NemotronHModelDescriptor static method) (NemotronHV2ModelDescriptor static method) ResBlock (class in modelopt.torch.speculative.utils) reset() (AccumulatingTimer class method) (BiasCalibrator method) (ConcatNodeProcessor method) (HistogramCalibrator method) (MaxCalibrator method) (MseCalibrator method) (NVFP4ActHeadroomCalibrator method) (NVFP4MSECalibrator method) (Passage method) (SparseAttentionStatsManager method) reset_amax() (TensorQuantizer method) reset_before_sample() (PatchManager method) reset_bias() (TensorQuantizer method) reset_choices() (ConcatTracedHp method) (Hparam method) reset_dynamic_attributes() (DynamicModule method) reset_search() (BaseSearcher method) reshape_1d() (in module modelopt.torch.sparsity.weight_sparsity.magnitude) reshape_scales_for_per_channel_nodes() (in module modelopt.onnx.quantization.quant_utils) residual_layernorm (DecoderLayerConfig attribute) residual_mlp (DecoderLayerConfig attribute) resmooth_and_get_scale() (in module modelopt.torch.export.quant_utils) resolve() (ChildRegionInputInsertionPoint method) (ChildRegionOutputInsertionPoint method) (NodeInputInsertionPoint method) resolve_dependencies() (TracedHp method) resolve_descriptor_from_pretrained() (in module modelopt.torch.puzzletron.anymodel.model_descriptor.model_descriptor_factory) resolve_patterns() (SharedQuantState class method) resolve_pruning_mixin() (in module modelopt.torch.puzzletron.pruning.pruning_utils) resolve_torch_dtype() (in module modelopt.torch.puzzletron.tools.common) ResolvedInsertionPoint (class in modelopt.onnx.quantization.autotune) restore (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (DFlashModeDescriptor property) (EagleModeDescriptor property) (ExportNASModeDescriptor property) (ExportPEFTModeDescriptor property) (ExportSparseModeDescriptor property) (ExportStudentModeDescriptor property) (FastNASModeDescriptor property) (KnowledgeDistillationModeDescriptor property) (MedusaModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (PuzzletronDescriptor property) (SparseAttentionModeDescriptor property) (SparseMagnitudeModeDescriptor property) restore() (in module modelopt.torch.opt.conversion) (SharedQuantState class method) restore_active_quantizers() (QuantRecipeHparam method) restore_autonas_searchspace() (in module modelopt.torch.nas.autonas) restore_dflash_model() (in module modelopt.torch.speculative.dflash.conversion) restore_eagle_model() (in module modelopt.torch.speculative.eagle.conversion) restore_export_sparse() (in module modelopt.torch.sparsity.weight_sparsity.mode) restore_fastnas_searchspace() (in module modelopt.torch.prune.fastnas) restore_from_members() (SharedQuantState method) restore_from_modelopt_state() (in module modelopt.torch.opt.conversion) restore_medusa_model() (in module modelopt.torch.speculative.medusa.conversion) restore_model_config() (in module modelopt.torch.export.model_config_utils) restore_puzzletron_model() (in module modelopt.torch.puzzletron.puzzletron_nas_plugin) restore_searchspace() (in module modelopt.torch.nas.autonas) restore_sparse_attention_model() (in module modelopt.torch.sparsity.attention_sparsity.conversion) restore_sparse_attention_state() (in module modelopt.torch.sparsity.attention_sparsity.conversion) restore_sparse_model() (in module modelopt.torch.sparsity.weight_sparsity.mode) return_tuple_of_size() (in module modelopt.torch.puzzletron.anymodel.puzzformer.no_op) revert_quant_config_names() (in module modelopt.torch.export.quant_aware_conversion) revert_weight_conversion_quant_aware() (in module modelopt.torch.export.quant_aware_conversion) rewind() (CalibrationDataProvider method) (RandomDataProvider method) rf_alpha() (in module modelopt.torch.fastgen.flow_matching) rf_sigma() (in module modelopt.torch.fastgen.flow_matching) rg_lru (RecurrentConfig attribute) RgLruConfig (class in modelopt.torch.export.model_config) rho (NVFP4ActHeadroomCalibConfig attribute) RmsNorm (LayerNormType attribute) rnn_hidden_size (DecoderLayerConfig attribute) RNNLayerForward (class in modelopt.torch.quantization.nn.modules.quant_rnn) RobustTracer (class in modelopt.torch.trace.tracer) ROOT (RegionType attribute) rope_ratio (DecoderLayerConfig attribute) rope_scaling (DecoderLayerConfig attribute) RopeType (class in modelopt.onnx.llm_export_utils.export_utils) rotary_base (DecoderLayerConfig attribute) rotary_dim (AttentionConfig attribute) rotary_pct (DecoderLayerConfig attribute) rotate (QuantizerAttributeConfig attribute) rotate_back_is_enabled (TensorQuantizer property) rotate_block_size (TensorQuantizer property) rotate_fp32 (RotateConfig attribute) rotate_is_enabled (TensorQuantizer property) rotate_is_fp32 (TensorQuantizer property) RotateConfig (class in modelopt.torch.quantization.config) router (MOEConfig attribute) router_biases (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) router_weights (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) rtn() (in module modelopt.onnx.quantization.quant_utils) RulerDatasetBuilder (class in modelopt.torch.sparsity.attention_sparsity.calibration) run() (NodeClassifier method) (Passage method) (ReferenceRunner method) (TensorRTPyBenchmark method) (TrtExecBenchmark method) run_benchmark() (in module modelopt.torch.kernels.quantization.conv.bench_implicit_gemm) run_forward_loop() (in module modelopt.torch.utils.network) run_graph_surgery() (in module modelopt.onnx.graph_surgery) run_mip() (in module modelopt.torch.puzzletron.mip.mip_with_multi_layer_replacements) run_mip_sweep() (in module modelopt.torch.puzzletron.mip.sweep) run_puzzle() (in module modelopt.torch.puzzletron.mip.run_puzzle) run_search() (BaseSearcher method) (BaseSparseSearcher method) (IterativeSearcher method) (PuzzletronSearcher method) run_search_with_stats() (AutoQuantizeGradientSearcher method) (AutoQuantizeKLDivSearcher method) run_step() (IterativeSearcher method) run_url (MlflowRunLogger property) run_vllm_latency_benchmark() (in module modelopt.torch.puzzletron.subblock_stats.runtime_vllm) RuntimeConfig (class in modelopt.torch.puzzletron.subblock_stats.runtime_utils) S safe_load() (in module modelopt.torch.utils.serialization) safe_save() (in module modelopt.torch.utils.serialization) Same (class in modelopt.torch.puzzletron.anymodel.puzzformer.no_op) same_device_as() (in module modelopt.torch.utils.tensor) sample() (BinarySearcher method) (EvolveSearcher method) (in module modelopt.torch.nas.utils) (in module modelopt.torch.utils.random) (IterativeSearcher method) (RandomSearcher method) (SearchSpace method) sample_during_training (AutoNASPatchManager property) (FastNASPatchManager property) sample_from_t_list() (in module modelopt.torch.fastgen.flow_matching) sample_t_cfg (DistillationConfig attribute) sample_timesteps() (DistillationPipeline method) (in module modelopt.torch.fastgen.flow_matching) samples (CalibrationConfig attribute) (IterativeSearcher attribute) SampleTimestepConfig (class in modelopt.torch.fastgen.config) sanitize() (GraphSanitizer method) sanitize_io_casts() (GraphSanitizer method) sanitize_search_config() (AutoQuantizeGradientSearcher method) (AutoQuantizeKLDivSearcher method) (BaseSearcher method) (BaseSparseSearcher method) (IterativeSearcher method) save() (in module modelopt.torch.opt.conversion) (PatternCache method) save_checkpoint() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) (ScoringCheckpointManager method) save_checkpoint_from_shards() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) save_every (LayerwiseConfig attribute) save_expert_token_count_table() (in module modelopt.torch.export.moe_utils) save_hook_states() (ForwardHook class method) save_mode_in_state (ExportStudentModeDescriptor property) (KnowledgeDistillationModeDescriptor property) (ModeDescriptor property) save_model() (in module modelopt.torch.puzzletron.subblock_stats.runtime_utils) save_model_as_anymodel() (in module modelopt.torch.puzzletron.subblock_stats.runtime_utils) save_model_config() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) save_multi_layer_outputs() (in module modelopt.torch.prune.importance_hooks.compare_module_outputs) save_onnx() (in module modelopt.onnx.utils) save_onnx_bytes_to_dir() (in module modelopt.onnx.utils) save_search_checkpoint() (BaseSearcher method) save_subblocks() (in module modelopt.torch.puzzletron.tools.checkpoint_utils_hf) scale (PEFTAttributeConfig attribute) scale_algorithm (LSQConfig attribute) SCALE_DTYPE (MXFP8QTensor attribute) ScaleCalibConfig (LSQConfig attribute) scaled_dot_product_attention() (in module modelopt.torch.quantization.export_onnx) scaled_e4m3_impl() (in module modelopt.torch.quantization.tensor_quant) ScaledE4M3Function (class in modelopt.torch.quantization.tensor_quant) schemes (PatternSchemes attribute) scope_prefixes (RenameRule attribute) score_module_rules (AutoQuantizeGradientSearcher attribute) ScoringCheckpointManager (class in modelopt.torch.puzzletron.utils.checkpoint_manager) search() (BaseSearcher method) (in module modelopt.torch.nas.algorithms) search_algorithm (AutoNASModeDescriptor property) (FastNASModeDescriptor property) (ModeDescriptor property) (PuzzletronDescriptor property) (SparseGPTModeDescriptor property) (SparseMagnitudeModeDescriptor property) search_regions() (CombinedRegionSearch method) search_space_size() (in module modelopt.torch.opt.utils) SearchSpace (class in modelopt.torch.nas.search_space) select() (DynamicSpace method) (in module modelopt.torch.nas.utils) self_attention (DecoderLayerConfig attribute) self_attention_layernorm (DecoderLayerConfig attribute) sensitivity_map (BinarySearcher attribute) seq_length (DecoderLayerConfig attribute) SequentialQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) set_calibration_mode() (SparseAttentionMethod method) (SparseAttentionStatsManager method) set_calibration_recipe() (QuantRecipeHparam method) set_expert_quantizer_amax() (in module modelopt.torch.export.layer_utils) set_from_attribute_config() (HardDisabledTensorQuantizer method) (SparseAttentionModule method) (TensorQuantizer method) set_from_modelopt_state() (TensorQuantizer method) set_ir_version() (GraphSanitizer method) set_mask() (SparseModule method) set_members() (SharedQuantState method) set_modelopt_patches_enabled (class in modelopt.torch.nas.utils) set_quantizer_attribute() (in module modelopt.torch.quantization.conversion) set_quantizer_attributes_full() (in module modelopt.torch.quantization.conversion) set_quantizer_attributes_partial() (in module modelopt.torch.quantization.conversion) set_quantizer_by_cfg() (in module modelopt.torch.quantization.conversion) set_quantizer_by_cfg_context() (in module modelopt.torch.quantization.conversion) set_shapes() (TensorRTPyBenchmark method) set_skip_softmax_context() (in module modelopt.torch.kernels.sparsity.attention) set_skippable() (SymDepth method) set_sparse_attention_attribute() (in module modelopt.torch.sparsity.attention_sparsity.conversion) set_sparse_attention_by_cfg() (in module modelopt.torch.sparsity.attention_sparsity.conversion) set_student_loss_reduction_fn() (DistillationLossBalancer method) set_submodule() (in module modelopt.torch.puzzletron.tools.sharded_checkpoint_utils) (in module modelopt.torch.utils.network) set_symbol() (SymMap method) set_trt_plugin_domain() (in module modelopt.onnx.trt_utils) setup_mappings() (in module modelopt.onnx.autocast.utils) shape (TensorStats attribute) share_embedding_table (ModelConfig attribute) shared_expert (MOEConfig attribute) shared_expert_gate (MOEConfig attribute) shared_expert_intermediate_dim (MoEConfig attribute) SharedQuantState (class in modelopt.torch.quantization.utils) SharedWeightGlobalAmaxState (class in modelopt.torch.quantization.utils) shift (SampleTimestepConfig attribute) should_quantize_to_8bit() (in module modelopt.onnx.quantization.graph_utils) should_skip_batch() (ScoringCheckpointManager method) shrink_step (AWQClipCalibConfig attribute) shuffle() (in module modelopt.torch.utils.random) silence_matched_warnings() (in module modelopt.torch.utils.logging) simple_parse_args_string() (in module modelopt.torch.puzzletron.utils.parsing) size (TensorStats property) size() (DynamicSpace method) (in module modelopt.torch.utils.distributed) sizeof_dtype() (in module modelopt.torch.puzzletron.utils.misc) skip_forward_without_activation_calib (MaxCalibConfig attribute) skip_init() (in module modelopt.torch.puzzletron.tools.checkpoint_utils) skip_layers (SVDQuantConfig attribute) skip_softmax_threshold (SparseAttentionAttributeConfig attribute) skippable_idxs (SymDepth property) smoothquant() (in module modelopt.torch.quantization.model_calib) SmoothQuantCalibConfig (class in modelopt.torch.quantization.config) solution_to_str() (in module modelopt.torch.puzzletron.utils.misc) solver_choices (QuantRecipeHparam property) sort_parameters() (SearchSpace method) sort_replacements() (in module modelopt.torch.puzzletron.mip.utils) sparse_cfg (FlashSkipSoftmaxConfig attribute) (SparseAttentionConfig attribute) (VSAConfig attribute) sparse_mixer_epsilon (DecoderLayerConfig attribute) SparseAttentionAttributeConfig (class in modelopt.torch.sparsity.attention_sparsity.config) SparseAttentionConfig (class in modelopt.torch.sparsity.attention_sparsity.config) SparseAttentionMethod (class in modelopt.torch.sparsity.attention_sparsity.methods) SparseAttentionModeDescriptor (class in modelopt.torch.sparsity.attention_sparsity.mode) SparseAttentionModule (class in modelopt.torch.sparsity.attention_sparsity.sparse_attention) SparseAttentionStatsManager (class in modelopt.torch.sparsity.attention_sparsity.stats_manager) SparseGPTConfig (class in modelopt.torch.sparsity.weight_sparsity.config) SparseGPTModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode) SparseGPTSearcher (class in modelopt.torch.sparsity.weight_sparsity.sparsegpt) SparseMagnitudeConfig (class in modelopt.torch.sparsity.weight_sparsity.config) SparseMagnitudeModeDescriptor (class in modelopt.torch.sparsity.weight_sparsity.mode) SparseModule (class in modelopt.torch.sparsity.weight_sparsity.module) sparsify (SubblockConfig attribute) sparsify() (in module modelopt.torch.sparsity.attention_sparsity.model_sparsify) (in module modelopt.torch.sparsity.weight_sparsity.sparsification) sparsity_m (SparseAttentionAttributeConfig attribute) sparsity_n (SparseAttentionAttributeConfig attribute) split_config_and_weights() (in module modelopt.torch.export.model_config_utils) split_replacements_to_teacher_and_student() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) SplitRule (class in modelopt.torch.export.quant_aware_conversion) standardize_constructor_args() (in module modelopt.torch.utils.network) standardize_model_args() (in module modelopt.torch.utils.network) standardize_model_like_tuple() (in module modelopt.torch.utils.network) standardize_named_model_args() (in module modelopt.torch.utils.network) start() (AccumulatingTimer method) (GPUMemoryMonitor method) (MlflowRunLogger method) (Timer method) start_iter (EMAConfig attribute) start_multiplier (LocalHessianCalibConfig attribute) (MseCalibConfig attribute) state_dict() (BaseSearcher method) (DistillationModel method) (ExponentialMovingAverage method) (ForwardHook method) (IndependentChannelContributionHook method) (IndependentKvHeadContributionHook method) (IterativeChannelContributionHook method) (L2NormHook method) (LayerNormContributionHook method) (ModeloptStateManager method) (RankedChoiceVotingHook method) (RemoveExpertsIndependentHook method) state_dim (MambaConfig attribute) state_version (ModeloptStateManager property) static_blockwise_fp4_cast() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel) static_blockwise_fp4_fake_quant() (in module modelopt.torch.kernels.quantization.gemm.fp4_kernel) StaticBlockScaleQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) StaticBlockwiseFP4FakeQuantFunction (class in modelopt.torch.quantization.tensor_quant) StaticLossBalancer (class in modelopt.torch.distill.loss_balancers) stats() (in module modelopt.torch.utils.list) step_size (LocalHessianCalibConfig attribute) (MseCalibConfig attribute) (TensorQuantizer property) stitch() (Needle method) StitchedModule (class in modelopt.torch.puzzletron.sewing_kit.core) stop() (AccumulatingTimer method) (GPUMemoryMonitor method) (Timer method) stop_multiplier (LocalHessianCalibConfig attribute) (MseCalibConfig attribute) StoreWithExplicitFlag (class in modelopt.onnx.quantization.autotune) str_full (PrecisionTypes attribute) str_short (PrecisionTypes attribute) strict (ExportConfig attribute) student_sample_steps (DistillationConfig attribute) student_sample_type (DistillationConfig attribute) student_update_freq (DMDConfig attribute) subblock_config_to_str() (in module modelopt.torch.puzzletron.utils.misc) SubblockConfig (class in modelopt.torch.puzzletron.block_config) supported_hooks() (ExpertRemovalPruningMixIn method) (FFNIntermediatePruningMixIn method) (KVHeadsPruningMixIn method) (PruningMixIn method) svdquant() (in module modelopt.torch.quantization.model_calib) SVDQuantConfig (class in modelopt.torch.quantization.config) SVDQuantLinear (class in modelopt.torch.quantization.nn.modules.quant_linear) swizzle_nvfp4_scales() (in module modelopt.torch.export.diffusers_utils) Symbol (class in modelopt.torch.trace.symbols) Symbol.CLType (class in modelopt.torch.trace.symbols) symbolic() (DynamicBlockQuantizationFunction static method) (FakeTensorQuantFunction static method) (ScaledE4M3Function static method) SymDepth (class in modelopt.torch.trace.modules.nn) SymDict (SymInfo attribute) SymInfo (class in modelopt.torch.trace.symbols) SymMap (class in modelopt.torch.trace.symbols) SymRegisterFunc (SymMap attribute) sync() (SharedQuantState method) (SharedWeightGlobalAmaxState method) sync_amax_across_distributed_group() (TensorQuantizer method) sync_expert_weight_amax (MaxCalibConfig attribute) sync_moe_gate_up_amax() (in module modelopt.torch.export.layer_utils) sync_tied_input_amax() (in module modelopt.torch.export.quant_utils) T t_list (SampleTimestepConfig attribute) target_name (ExpertRemovalLayerDescriptor attribute) (GptOssExpertRemovalLayerDescriptor attribute) (NemotronHExpertRemovalLayerDescriptor attribute) (NemotronHV2ExpertRemovalLayerDescriptor attribute) (Qwen3VLExpertRemovalLayerDescriptor attribute) target_quantizer_kind (SharedQuantState attribute) (SharedWeightGlobalAmaxState attribute) target_sparse_ratio (CalibrationConfig attribute) teacher_model (DistillationModel property) (KDLossConfig attribute) TeeStream (class in modelopt.torch.utils.logging) temporarily_fold_weights() (in module modelopt.torch.quantization.model_quant) temporary_set_config_value() (in module modelopt.torch.speculative.utils) tensor_name (ResolvedInsertionPoint attribute) tensor_parallel (ModelConfig attribute) TensorQuantizer (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) TensorQuantizerCache (class in modelopt.torch.quantization.nn.modules.tensor_quantizer) TensorRT Timing Cache TensorRTPyBenchmark (class in modelopt.onnx.quantization.autotune) TensorStats (class in modelopt.onnx.autocast.referencerunner) threshold_trials (CalibrationConfig attribute) thresholds (SparseAttentionAttributeConfig attribute) tie_member_quantizer() (SharedQuantState method) (SharedWeightGlobalAmaxState method) tie_member_quantizers() (SharedQuantState method) tied_amax (LSQConfig attribute) TiedWeightMap (class in modelopt.torch.export.model_utils) time_dist_type (SampleTimestepConfig attribute) Timer (class in modelopt.torch.utils.perf) to() (LowMemorySparseTensor method) (QTensorWrapper method) to_blockconfig() (AttentionConfig method) (FFNConfig method) (SubblockConfig method) to_dense() (LowMemorySparseTensor method) to_dict() (BlockConfig method) (ChildRegionInputInsertionPoint method) (ChildRegionOutputInsertionPoint method) (ForwardHook method) (IndependentChannelContributionHook method) (IndependentKvHeadContributionHook method) (InsertionScheme method) (IterativeChannelContributionHook method) (L2NormHook method) (LayerNormContributionHook method) (NodeInputInsertionPoint method) (PatternCache method) (PatternSchemes method) (RankedChoiceVotingHook method) (RemoveExpertsIndependentHook method) (ResolvedInsertionPoint method) to_empty_if_meta_device() (in module modelopt.torch.utils.tensor) to_quantized_weight() (in module modelopt.torch.export.quant_utils) tokenize() (AcceptanceRateValidation method) tokenizer_path (RuntimeConfig attribute) top_k_ratio (VSAAttributeConfig attribute) top_percent_to_mutate (Config attribute) topologically_sort_graph_nodes() (in module modelopt.onnx.utils) torch_detach() (in module modelopt.torch.utils.tensor) torch_to() (in module modelopt.torch.utils.tensor) torch_to_numpy() (in module modelopt.torch.utils.tensor) torch_to_onnx() (in module modelopt.onnx.llm_export_utils.export_utils) torch_to_tensorrt_llm_checkpoint() (in module modelopt.torch.export.model_config_export) total_schemes (PatternCache property) tp (LinearConfig attribute) trace() (RobustTracer method) TracedHp (class in modelopt.torch.nas.traced_hp) TracedHpRegistry (class in modelopt.torch.nas.traced_hp) track() (MlflowRunLogger method) train() (DistillationModel method) transfer_state_dict() (ModeloptStateManager class method) transpose_dequantize_linear_weights() (in module modelopt.onnx.graph_surgery) Tree (class in modelopt.torch.speculative.utils) TreeNode (class in modelopt.torch.speculative.utils) trt_high_precision_dtype (QuantizerAttributeConfig attribute) (TensorQuantizer property) TrtExecBenchmark (class in modelopt.onnx.quantization.autotune) Truncate (HiddenSizeInitMode attribute) (MlpInitMode attribute) truncate_pattern_for_subblock() (ModelDescriptor static method) type (EMAConfig attribute) (QuantizerAttributeConfig attribute) U unfreeze() (Passage method) unpatch() (PatchManager method) unregister() (in module modelopt.torch.quantization.conversion) (SymMap class method) (TracedHpRegistry class method) unregister_default() (ModeloptBaseRuleConfig class method) unregister_leaf() (RobustTracer class method) unregister_quant_backend() (in module modelopt.torch.quantization.nn.modules.tensor_quantizer) unsigned (QuantizerAttributeConfig attribute) (TensorQuantizer property) unwrap_model() (in module modelopt.torch.utils.network) update() (ExponentialMovingAverage method) (ModeloptBaseConfig method) update_attributes_for_per_channel_nodes() (in module modelopt.onnx.quantization.qdq_utils) update_autonas_metadata() (in module modelopt.torch.nas.autonas) update_block_size() (in module modelopt.onnx.quantization.quant_utils) update_domain() (in module modelopt.onnx.utils) update_ema() (DMDPipeline method) update_experts_avg_prequant_scale() (in module modelopt.torch.export.layer_utils) update_for_new_mode (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (FastNASModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (SparseAttentionModeDescriptor property) (SparseMagnitudeModeDescriptor property) update_for_save (AutoNASModeDescriptor property) (BaseCalibrateModeDescriptor property) (FastNASModeDescriptor property) (ModeDescriptor property) (PEFTModeDescriptor property) (SparseAttentionModeDescriptor property) (SparseMagnitudeModeDescriptor property) update_last_state_before_new_mode() (ModeloptStateManager method) update_last_state_before_save() (ModeloptStateManager method) update_layer_lora() (LoRAModule method) update_lm_head_quantization() (in module modelopt.torch.export.postprocess) update_model() (in module modelopt.torch.peft.convert) update_model_config() (in module modelopt.torch.puzzletron.tools.bypassed_training.child_init) update_progress() (ScoringCheckpointManager method) update_quant_cfg_with_kv_cache_quant() (in module modelopt.torch.quantization.utils) update_sparse_attention_metadata() (in module modelopt.torch.sparsity.attention_sparsity.conversion) update_sparse_metadata() (in module modelopt.torch.sparsity.weight_sparsity.mode) update_trt_ep_support() (in module modelopt.onnx.quantization.ort_utils) upgrade_opset_21() (in module modelopt.onnx.quantization.fp8) upper_percentile (NVFP4ActHeadroomCalibConfig attribute) use_alibi (DecoderLayerConfig attribute) use_cache (DecoderLayerConfig attribute) use_constant_amax (QuantizerAttributeConfig attribute) use_qk_norm (Llama4AttentionConfig attribute) use_rope (Llama4AttentionConfig attribute) use_trt_qdq_ops() (in module modelopt.onnx.quantization.qdq_utils) uses_autocast() (ModelDescriptor static method) (Qwen3VLModelDescriptor static method) V v (QKVConfig attribute) v_cache_bias (AttentionConfig attribute) v_cache_scaling_factor (AttentionConfig attribute) val2list() (in module modelopt.torch.utils.list) val2tuple() (in module modelopt.torch.utils.list) validate() (AcceptanceRateValidation method) validate_8bit_layers() (in module modelopt.onnx.quantization.graph_utils) validate_adapter_cfg() (PEFTConfig class method) validate_adapter_type() (PEFTConfig class method) validate_attr() (TensorQuantizer method) validate_backend() (SparseAttentionAttributeConfig class method) validate_batch_size() (in module modelopt.onnx.utils) validate_bias() (QuantizerAttributeConfig class method) validate_block_size() (RotateConfig class method) (SparseAttentionAttributeConfig class method) validate_block_size_3d() (VSAAttributeConfig class method) validate_block_sizes() (QuantizerAttributeConfig class method) validate_calibrator() (QuantizerAttributeConfig class method) validate_chunk_size() (CalibrationConfig class method) validate_config() (QuantizerAttributeConfig class method) validate_constant_amax() (QuantizerAttributeConfig class method) validate_constant_amax_modes() (QuantizerAttributeConfig method) validate_dense_recent_tokens() (SparseAttentionAttributeConfig class method) validate_dense_sink_tokens() (SparseAttentionAttributeConfig class method) validate_init_method() (PEFTAttributeConfig class method) validate_layerwise_checkpoint_dir() (QuantizeAlgorithmConfig method) validate_learn_amax() (QuantizerAttributeConfig class method) validate_max_seqlen() (CalibrationConfig class method) validate_method() (SparseAttentionAttributeConfig class method) validate_model() (in module modelopt.torch.puzzletron.tools.validate_model) validate_model_and_extract_hidden_states() (in module modelopt.torch.puzzletron.tools.validation_utils) validate_model_with_teacher_similarity_metrics() (in module modelopt.torch.puzzletron.tools.validation_utils) validate_num_bits() (QuantizerAttributeConfig method) validate_num_decode_tokens() (CalibrationConfig class method) validate_num_length_bins() (CalibrationConfig class method) validate_online() (AcceptanceRateValidation method) validate_onnx() (in module modelopt.onnx.utils) validate_op_types_spelling() (in module modelopt.onnx.quantization.graph_utils) validate_puzzle_solutions() (in module modelopt.torch.puzzletron.tools.validate_puzzle_with_multi_replacements) validate_rank() (PEFTAttributeConfig class method) validate_rule() (ModeloptBaseRule class method) validate_samples() (CalibrationConfig class method) validate_scale() (PEFTAttributeConfig class method) validate_scale_shape_for_per_channel_nodes() (in module modelopt.onnx.quantization.qdq_utils) validate_sparsity_m() (SparseAttentionAttributeConfig class method) validate_sparsity_n() (SparseAttentionAttributeConfig class method) validate_sparsity_n_vs_m() (SparseAttentionAttributeConfig method) validate_target_sparse_ratio() (CalibrationConfig class method) validate_threshold_trials() (CalibrationConfig class method) validate_thresholds() (SparseAttentionAttributeConfig class method) validate_top_k_ratio() (VSAAttributeConfig class method) validate_tracking_uri() (in module modelopt.torch.utils.mlflow) validate_video_shape() (VSAAttributeConfig class method) validate_vsa_method() (VSAAttributeConfig class method) value() (RemoteTarget method) values() (ModeloptBaseConfig method) values_from_node (StitchedModule attribute) values_to_node (StitchedModule attribute) verbose (Config attribute) VFRNNForward (class in modelopt.torch.quantization.nn.modules.quant_rnn) video_shape (VSAAttributeConfig attribute) view_as_float8_e4m3fn_if_needed() (in module modelopt.torch.export.postprocess) view_as_uint8_if_needed() (in module modelopt.torch.export.postprocess) vision_output_dim (DecoderLayerConfig attribute) vocab_embedding (ModelConfig attribute) vocab_size (ModelConfig attribute) (RuntimeConfig attribute) vocab_size_padded (ModelConfig property) VSAAttributeConfig (class in modelopt.torch.sparsity.attention_sparsity.config) VSAConfig (class in modelopt.torch.sparsity.attention_sparsity.config) vsd_loss() (in module modelopt.torch.fastgen.losses) W walk_subgraphs_recursive() (in module modelopt.onnx.autocast.utils) warn_rank_0() (in module modelopt.torch.utils.logging) weight (ConvConfig attribute) (EmbeddingConfig attribute) (LayernormConfig attribute) (LinearConfig attribute) (QKVConfig property) (RelativeAttentionTableConfig attribute) (Same property) weight_attr_names() (in module modelopt.torch.quantization.utils) weight_dequant() (in module modelopt.torch.kernels.quantization.gemm.fp8_kernel) weight_quantizer (QuantLinearConvBase attribute) (QuantRNNBase attribute) weight_scale_algorithm (NVFP4ActHeadroomCalibConfig attribute) weights_path_to_checkpoint_dir() (in module modelopt.torch.puzzletron.replacement_library.replacement_utils) weights_precision (SubblockConfig attribute) weights_scaling_factor (LinearConfig attribute) (QKVConfig property) weights_scaling_factor_2 (LinearConfig attribute) (QKVConfig property) world_size() (DistributedProcessGroup method) WrapperModelForCausalLM (class in modelopt.onnx.llm_export_utils.export_utils) write() (TeeStream method) write_configs_and_weights() (NFSWorkspace method) write_results() (in module modelopt.torch.puzzletron.tools.validation_utils) write_results_to_csv() (in module modelopt.torch.puzzletron.mip.sweep) X x0_to_eps() (in module modelopt.torch.fastgen.flow_matching) x0_to_flow() (in module modelopt.torch.fastgen.flow_matching) Y y_bias (RecurrentConfig attribute) Z zero_grad() (in module modelopt.torch.utils.network)