vllm.model_executor.layers.mamba.checkpoint
¶
Classes:
-
MambaPrefillCheckpointBuilder–Build backend-neutral prefill checkpoint locations.
-
MambaPrefillCheckpointExporter–Export a mid-prefill checkpoint into backend-specific paged states.
Functions:
-
compute_mamba_prefill_checkpoints–Per-row internal prefill checkpoint offsets and cache block columns.
MambaPrefillCheckpointBuilder
¶
Build backend-neutral prefill checkpoint locations.
Source code in vllm/model_executor/layers/mamba/checkpoint.py
MambaPrefillCheckpointExporter
¶
Bases: ABC
Export a mid-prefill checkpoint into backend-specific paged states.
Methods:
-
export–Write checkpoint state into the paged cache.
Source code in vllm/model_executor/layers/mamba/checkpoint.py
export(checkpoint, *args, **kwargs)
abstractmethod
¶
Write checkpoint state into the paged cache.
compute_mamba_prefill_checkpoints(seq_lens, query_lens, hash_block_size, mamba_block_size, checkpoint_alignment, drop_eagle_block)
¶
Per-row internal prefill checkpoint offsets and cache block columns.
Backends call this instead of re-deriving the rules, so they decline in
lockstep with the scheduler and MambaManager: allocating a checkpoint
block without writing it leaves the prefix cache serving uninitialized
state.
Returns:
-
list[int]–(offsets, cols): the checkpoint's offset into each row's query and -
list[int]–its block-table column.
0and-1mean the row has none.