From 6e53e3007c9b14deb04d1f7767a6bec40b42f251 Mon Sep 17 00:00:00 2001 From: biondizzle Date: Mon, 1 Jun 2026 04:59:06 +0000 Subject: [PATCH] =?UTF-8?q?fix:=20clamp=20block=5Famax=20to=20E4M3=20max?= =?UTF-8?q?=20(448)=20in=20quantize=5Factivation=5Fnvfp4=20=E2=80=94=20pre?= =?UTF-8?q?vents=20NaN=20from=20overflow?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- dsv4/ops/quantize.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/dsv4/ops/quantize.py b/dsv4/ops/quantize.py index 29b97bc9..c010bd41 100644 --- a/dsv4/ops/quantize.py +++ b/dsv4/ops/quantize.py @@ -145,7 +145,7 @@ def quantize_activation_nvfp4(x_bf16, global_scale, block_size=SF_VEC_SIZE): zero_block = block_amax < (6.0 * 2.0 ** -9) x_reshaped = torch.where(zero_block.unsqueeze(-1), torch.zeros_like(x_reshaped), x_reshaped) - block_amax = block_amax.clamp(min=1e-8) + block_amax = block_amax.clamp(min=1e-8, max=6.0 * 448.0) # E4M3 max = 448 block_scale = (block_amax / 6.0).to(torch.float8_e4m3fn) block_scale = torch.where(zero_block, torch.zeros_like(block_scale), block_scale)