vllm_omni.model_executor.models.audex.speech_decoder ¶
Vendored Audex causal speech decoder (Apache-2.0).
Verbatim copy of the audex_causal_speech_decoder remote-code package from nvidia/Nemotron-Labs-Audex-2B. Vendored because transformers' dynamic module loader resolves HuggingFace-cache blob symlinks to their real paths, which breaks the package's relative imports when loading with trust_remote_code directly from a hub snapshot.
Modules:
| Name | Description |
|---|---|
configuration_audex_causal_speech_decoder | |
modeling_audex_causal_speech_decoder | |
streaming_utils | |
AudexCausalSpeechDecoderModel ¶
Bases: PreTrainedModel
all_tied_weights_keys class-attribute instance-attribute ¶
audex_speech_token_embedder instance-attribute ¶
audex_speech_token_embedder = AudexSpeechTokenEmbedder(
output_dim=config.vq_dim,
token_embed_dim=config.token_embed_dim,
codebook_levels=config.codebook_levels,
)
module instance-attribute ¶
module = CausalCodecDecoderVocos(
hidden_dim=config.hidden_dim,
depth=config.depth,
heads=config.heads,
pos_meb_dim=config.pos_meb_dim,
hop_length=config.hop_length,
vq_dim=config.vq_dim,
lookahead_steps=config.lookahead_steps,
)
create_session ¶
create_session(
*,
chunk_frames: int = 1,
sample_rate: int | None = None,
return_numpy: bool = True,
) -> AudexCausalSpeechDecoderSession
decode_cached ¶
decode_cached(
vq_emb: Tensor,
cache: CausalCodecDecoderCache,
lookahead_vq_emb: Tensor | None = None,
) -> Tensor