diff --git a/dsv4/ops/quantize.py b/dsv4/ops/quantize.py index 29b97bc9..c010bd41 100644 --- a/dsv4/ops/quantize.py +++ b/dsv4/ops/quantize.py @@ -145,7 +145,7 @@ def quantize_activation_nvfp4(x_bf16, global_scale, block_size=SF_VEC_SIZE): zero_block = block_amax < (6.0 * 2.0 ** -9) x_reshaped = torch.where(zero_block.unsqueeze(-1), torch.zeros_like(x_reshaped), x_reshaped) - block_amax = block_amax.clamp(min=1e-8) + block_amax = block_amax.clamp(min=1e-8, max=6.0 * 448.0) # E4M3 max = 448 block_scale = (block_amax / 6.0).to(torch.float8_e4m3fn) block_scale = torch.where(zero_block, torch.zeros_like(block_scale), block_scale)