Skip to content

vllm_omni.diffusion.models.cosmos3.mixed_precision.strategy

Format-specific live-weight validation and reference A16 materialization.

Cosmos3PrecisionStrategy

Quantization-format boundary behind the shared precision schedule.

accepts

accepts(method: object | None) -> bool

Return whether this strategy owns a native linear method.

apply_high

apply_high(
    layer: Module, x: Tensor, bias: Tensor | None
) -> Tensor

Apply the reference dense A16 path.

materialize

materialize(layer: Module) -> Tensor

Materialize the live quantized weight as a dense BF16 matrix.

validate_after_processing

validate_after_processing(
    layer: Module, module_name: str
) -> None

Validate the live native weight representation.

validate_before_processing

validate_before_processing(
    method: object, layer: Module, module_name: str
) -> None

Reject native transforms that cannot support live dequantization.

Fp8W8A8W8A16Strategy

Bases: Cosmos3PrecisionStrategy

Use native ModelOpt W8A8 or reference dense W8A16.

accepts

accepts(method: object | None) -> bool

materialize

materialize(layer: Module) -> Tensor

validate_after_processing

validate_after_processing(
    layer: Module, module_name: str
) -> None

validate_before_processing

validate_before_processing(
    method: object, layer: Module, module_name: str
) -> None

Nvfp4W4A4W4A16Strategy

Bases: Cosmos3PrecisionStrategy

Use native ModelOpt W4A4 or reference dense W4A16.

accepts

accepts(method: object | None) -> bool

materialize

materialize(layer: Module) -> Tensor

validate_after_processing

validate_after_processing(
    layer: Module, module_name: str
) -> None

validate_before_processing

validate_before_processing(
    method: object, layer: Module, module_name: str
) -> None