vllm_omni.model_executor.models.indextts2.codec ¶
Inference-only EnhancedCodec runtime for IndexTTS 2.5.
Modules:
| Name | Description |
|---|---|
models | Inference-only EnhancedCodec decoder for IndexTTS 2.5. |
quantizer | Decode-only factorized residual vector quantizer. |
vocos | ConvNeXt Vocos backbone used by the IndexTTS 2.5 codec decoder. |
EnhancedCodec ¶
Bases: Module
Subset of EnhancedCodec required for decode(codes).
decoder instance-attribute ¶
decoder = nn.Sequential(
VocosBackbone(
input_channels=hidden_size,
dim=vocos_dim,
intermediate_dim=vocos_intermediate_dim,
num_layers=vocos_num_layers,
),
nn.Linear(vocos_dim, hidden_size),
)
quantizer instance-attribute ¶
quantizer = ResidualVQDecoder(
input_dim=hidden_size,
num_quantizers=num_quantizers,
codebook_size=codebook_size,
codebook_dim=codebook_dim,
)