PCONV: The Missing but Desirable Sparsity in DNN Weight Pruning for Real-Time Execution on Mobile DevicesXiaolong Ma, Yanzhi Wang, Bin Ren et al.|Proceedings of the AAAI Conference on Artificial Intelligence|2020Cited by 188
DNNFusion: accelerating deep neural networks execution with advanced operator fusionWei Niu, Bin Ren, Jiexiong Guan et al.|Unknown|2021Cited by 152
SPViT: Enabling Faster Vision Transformers via Latency-Aware Soft Token PruningZhenglun Kong, Yanzhi Wang, Minghai Qin et al.|Lecture notes in computer science|2022Cited by 143