Model Optimizer
/
Model Optimizer
/
modelopt API
/
torch
/
kernels
/
common
/
attention
attention
#
Shared Triton kernels for modelopt (attention, quantization, etc.).
Back to top
Previous
common
Next
quantization