onnxruntime/onnxruntime/contrib_ops
Yufeng Li 156368b67f
Quantize attention with Cuda (#3693)
* Add definition of QAttention
* implemention of QAttention on GPU
2020-05-04 14:20:38 -07:00
..
cpu Quantize attention with Cuda (#3693) 2020-05-04 14:20:38 -07:00
cuda Quantize attention with Cuda (#3693) 2020-05-04 14:20:38 -07:00