Skip to content

vllm_omni.diffusion.attention.backends.trtllm_calibration

logger module-attribute

logger = logging.getLogger(__name__)

apply_skip_softmax_calibration

apply_skip_softmax_calibration(
    attention_config: Any, model: Any
) -> None

apply_to_pipeline

apply_to_pipeline(pipeline, calibration: dict) -> int

is_ignored

is_ignored(module_name: str, ignore_patterns) -> bool

layer_match_names

layer_match_names(module_name: str) -> tuple[str, ...]

parse_secondary_expert_calibration

parse_secondary_expert_calibration(
    model: str | None,
) -> dict | None

parse_sparse_attention_config

parse_sparse_attention_config(
    sac: dict | None,
) -> dict | None

propagate_skip_softmax_calibration

propagate_skip_softmax_calibration(
    specs: list, model: str | None, tf_config: Any
) -> None

resolve_layer_calibration

resolve_layer_calibration(
    module_name: str, calibration: dict
) -> dict | None

select_expert

select_expert(module_name: str, expert_keys) -> str | None