ThinkingBudgetLogitsProcessor# class tensorrt_llm.llmapi.ThinkingBudgetLogitsProcessor( thinking_token_budget: int, reasoning_start_token_ids: List[int], reasoning_end_token_ids: List[int], )[source]# Bases: LogitsProcessor Force the reasoning end token sequence once a thinking budget is spent. __init__( thinking_token_budget: int, reasoning_start_token_ids: List[int], reasoning_end_token_ids: List[int], ) → None[source]#