Skip to content

Commit e27ef4e

Browse files
committed
fix qwen3.5 mtp accept rate
1 parent 8b54b52 commit e27ef4e

3 files changed

Lines changed: 3 additions & 0 deletions

File tree

lightllm/models/qwen3_5_mtp/layer_infer/pre_layer_infer.py

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -23,6 +23,7 @@ def _mtp_fuse(
2323
input_embdings.shape[0] == tgt_embdings.shape[0]
2424
), f"shape {input_embdings.shape} != shape {tgt_embdings.shape}"
2525

26+
layer_weight.main_norm_weight_(input=tgt_embdings, eps=self.eps_, out=tgt_embdings)
2627
layer_weight.enorm_weight_(input=input_embdings, eps=self.eps_, out=input_embdings)
2728
layer_weight.hnorm_weight_(input=tgt_embdings, eps=self.eps_, out=tgt_embdings)
2829
cat_embdings = torch.cat((input_embdings, tgt_embdings), dim=-1)

lightllm/models/qwen3_5_mtp/layer_weights/pre_and_post_layer_weight.py

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -42,4 +42,5 @@ def __init__(self, data_type, network_config, quant_cfg: Quantcfg):
4242
# Shared with the main Qwen3.5 model, injected by the model class (not loaded here).
4343
self.wte_weight_: EmbeddingWeight = None
4444
self.lm_head_weight_: LMHeadWeight = None
45+
self.main_norm_weight_: NoTpGEMMANormWeight = None
4546
return

lightllm/models/qwen3_5_mtp/model.py

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -69,6 +69,7 @@ def _init_weights(self, start_layer_index=None):
6969
# Shared with the main Qwen3.5 model (mtp_use_dedicated_embeddings: false).
7070
self.pre_post_weight.wte_weight_ = self.main_model.pre_post_weight.wte_weight_
7171
self.pre_post_weight.lm_head_weight_ = self.main_model.pre_post_weight.lm_head_weight_
72+
self.pre_post_weight.main_norm_weight_ = self.main_model.pre_post_weight.final_norm_weight_
7273
return
7374

7475
def _init_infer_layer(self, start_layer_index=None):

0 commit comments

Comments
 (0)