Meng Li's Homepage
Meng Li's Homepage
Home
News
Talks
Publications
Projects
Students
Contact
Light
Dark
Automatic
English
中文 (简体)
Algorithm/Software
ArkVale: Efficient Generative LLM Inference with Recallable Key-Value Eviction
Renze Chen
,
Zhuofeng Wang
,
Beiquan Cao
,
Tong Wu
,
Size Zheng
,
Xiuhong Li
,
Xuechao Wei
,
Shengen Yan
,
Meng Li
,
Yun Liang
Paper
PrivCirNet: Efficient Private Inference via Block Circulant Transformation
Tianshi Xu
,
Lemeng Wu
,
Runsheng Wang
,
Meng Li
Paper
AdapMoE: Adaptive Sensitivity-based Expert Gating and Management for Efficient MoE Inference
Shuzhang Zhong
,
Ling Liang
,
Yuan Wang
,
Runsheng Wang
,
Ru Huang
,
Meng Li
Paper
FlexHE: A flexible Kernel Generation Framework for Homomorphic Encryption-Based Private Inference
Jiangrui Yu
,
Wenxuan Zeng
,
Tianshi Xu
,
Renze Chen
,
Yun (Eric) Liang
,
Runsheng Wang
,
Ru Huang
,
Meng Li
Paper
MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers
Zebin Yang
,
Renze Chen
,
Taiqiang Wu
,
Ngai Wong
,
Yun (Eric) Liang
,
Runsheng Wang
,
Ru Huang
,
Meng Li
Paper
PrivQuant: Communication-Efficient Private Inference with Quantized Network/Protocol Co-Optimization
Tianshi Xu
,
Shuzhang Zhong
,
Wenxuan Zeng
,
Runsheng Wang
,
Meng Li
Paper
ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding
Shuzhang Zhong
,
Zebin Yang
,
Ruihao Gong
,
Runsheng Wang
,
Ru Huang
,
Meng Li
Paper
FastQuery: Communication-efficient Embedding Table Query for Private LLMs inference
Chenqi Lin
,
Tianshi Xu
,
Zebin Yang
,
Meng Li
,
Runsheng Wang
,
Ru Huang
Paper
CoPriv: Network/Protocol Co-Optimization for Communication-Efficient Private Inference
A network–protocol co-optimization framework for reducing the communication overhead of secure private inference.
Wenxuan Zeng
,
Meng Li
,
Haichuan Yang
,
Wen-Jie Lu
,
Runsheng Wang
,
Ru Huang
Paper
Falcon: Accelerating Homomorphically Encrypted Convolutions for Efficient Private Mobile Network Inference
Tianshi Xu
,
Meng Li
,
Runsheng Wang
,
Ru Huang
Paper
«
»
Cite
×