diff --git a/tests/unit/checkpoint/test_convert_checkpoint.py b/tests/unit/checkpoint/test_convert_checkpoint.py index 5d3856e95f59..9ac0b70d6546 100644 --- a/tests/unit/checkpoint/test_convert_checkpoint.py +++ b/tests/unit/checkpoint/test_convert_checkpoint.py @@ -160,6 +160,6 @@ def test_convert_zero_checkpoint_to_fp32_state_dict(self, tmpdir): assert tensor.dtype == torch.bfloat16 torch.testing.assert_close(tensor.float(), state_dict[name], rtol=5e-3, atol=5e-3) - fp32_size = (fp32_save_dir / 'pytorch_model.bin').stat().st_size - bf16_size = (bf16_save_dir / 'pytorch_model.bin').stat().st_size + fp32_size = (fp32_save_dir / 'pytorch_model.bin').stat().size + bf16_size = (bf16_save_dir / 'pytorch_model.bin').stat().size assert bf16_size < fp32_size * 0.6 diff --git a/tests/unit/inference/quantization/test_intX_quantization.py b/tests/unit/inference/quantization/test_intX_quantization.py index 18a491123b84..29bbfdf95936 100644 --- a/tests/unit/inference/quantization/test_intX_quantization.py +++ b/tests/unit/inference/quantization/test_intX_quantization.py @@ -378,6 +378,7 @@ def test_float_int8_quantization(self): reset_random() quantization_test_helper(torch.float32, 8) + @pytest.mark.skipif(device == 'cpu', reason='CPU does support FP16 GEMM') def test_half_int8_quantization(self): reset_random() quantization_test_helper(torch.float16, 8)