diff --git a/onnxruntime/contrib_ops/cuda/quantization/qordered_ops/qordered_matmul.cc b/onnxruntime/contrib_ops/cuda/quantization/qordered_ops/qordered_matmul.cc index 566d36b279..f939a0e895 100644 --- a/onnxruntime/contrib_ops/cuda/quantization/qordered_ops/qordered_matmul.cc +++ b/onnxruntime/contrib_ops/cuda/quantization/qordered_ops/qordered_matmul.cc @@ -151,7 +151,7 @@ Status QOrderedMatMul::ComputeInternal(OpKernelContext* context) const { TensorShape shapeY(tensor_A.Shape()); shapeY[shapeY.NumDimensions() - 1] = colsB; - const float zero = 0.0f; + constexpr float zero = 0.0f; const int8_t* C = nullptr; const float* scaleC = &zero; const Tensor* tensor_C = context->Input(6); diff --git a/onnxruntime/core/providers/cpu/quantization/qlinearconv.cc b/onnxruntime/core/providers/cpu/quantization/qlinearconv.cc index f6e3d96943..ff1230012b 100644 --- a/onnxruntime/core/providers/cpu/quantization/qlinearconv.cc +++ b/onnxruntime/core/providers/cpu/quantization/qlinearconv.cc @@ -815,7 +815,7 @@ Status QLinearConv::Compute(OpKernelContext* context) const { } auto conv_worker = [&](ptrdiff_t batch) { - int64_t output_start = batch * stride_m; + int64_t output_start = (int64_t)batch * (int64_t)stride_m; int64_t output_count = std::min((int64_t)stride_m, output_image_size - output_start); ActType const** worker_indirection_buffer = nullptr;