Gemma4 Mtp Runtime Kernels#

void trt_edgellm::kernel::launchGemma4MTPBuildVerifyTokens(
int32_t const *seedTokenIds,
int32_t const *draftTokenIds,
int32_t *verifyTokenIds,
int32_t batchSize,
int32_t draftingStep,
cudaStream_t stream,
)#

Build linear target-verification token IDs: [seed, draft_0, …, draft_{N-1}].

void trt_edgellm::kernel::launchGemma4MTPGatherSeedHidden(
void const *sourceHiddenStates,
void *seedHiddenStates,
int32_t const *sourceTokenIndices,
int32_t batchSize,
int64_t sourceSeqLen,
int64_t hiddenSize,
size_t elementBytes,
cudaStream_t stream,
)#

Gather one target hidden-state row per batch into the assistant seed-hidden input.

void trt_edgellm::kernel::launchGemma4MTPStoreDraftToken(
int32_t const *selectedTokenIds,
int32_t *draftTokenIds,
int32_t batchSize,
int32_t draftingStep,
int32_t step,
cudaStream_t stream,
)#

Store sampled assistant token IDs into the draft-token matrix at the current draft step.