There was an error while loading. Please reload this page.
1 parent 039338f commit f97fa97Copy full SHA for f97fa97
1 file changed
nunchaku/ops/gemm.py
@@ -33,7 +33,7 @@ def svdq_gemm_w4a4_cuda(
33
lora_scales: list[float] | None = None,
34
fuse_silu: bool = False,
35
fp4: bool = False,
36
- alpha: float = 1.0,
+ alpha: float | None = 1.0,
37
wcscales: torch.Tensor | None = None,
38
out_q: torch.Tensor | None = None,
39
out_k: torch.Tensor | None = None,
@@ -124,7 +124,8 @@ def svdq_gemm_w4a4_cuda(
124
if lora_scales is None:
125
rank = lora_up.shape[1]
126
lora_scales = [1.0] * math.ceil(rank / 16)
127
-
+ if alpha is None:
128
+ alpha = 1.0
129
ops.gemm_w4a4(
130
act,
131
wgt,
0 commit comments