vllm_omni.diffusion.models.t5_encoder.t5_encoder ¶
T5Block ¶
Bases: Module
layer instance-attribute ¶
layer = nn.ModuleList(
[
T5LayerSelfAttention(
config,
has_relative_attention_bias,
prefix=f"{prefix}.layer.0",
),
T5LayerFF(config, prefix=f"{prefix}.layer.1"),
]
)
T5DenseActDense ¶
T5DenseGatedActDense ¶
T5EncoderModel ¶
Bases: Module
T5 encoder model applying upstream vLLM layers
T5LayerFF ¶
Bases: Module
DenseReluDense instance-attribute ¶
DenseReluDense = T5DenseGatedActDense(
config, prefix=f"{prefix}.DenseReluDense"
)
layer_norm instance-attribute ¶
T5LayerSelfAttention ¶
Bases: Module
SelfAttention instance-attribute ¶
SelfAttention = T5SelfAttention(
config,
has_relative_attention_bias,
prefix=f"{prefix}.SelfAttention",
)
layer_norm instance-attribute ¶
T5SelfAttention ¶
Bases: Module
has_relative_attention_bias instance-attribute ¶
o instance-attribute ¶
o = RowParallelLinear(
self.inner_dim,
self.d_model,
bias=False,
input_is_parallel=True,
return_bias=False,
)
qkv_proj instance-attribute ¶
qkv_proj = QKVParallelLinear(
hidden_size=self.d_model,
head_size=self.d_kv,
total_num_heads=self.n_heads,
total_num_kv_heads=self.n_heads,
bias=False,
)
relative_attention_bias instance-attribute ¶
relative_attention_max_distance instance-attribute ¶
relative_attention_num_buckets instance-attribute ¶
compute_bias ¶
Compute relative position bias, returning only the local head shard.