Meng Li's Homepage
Meng Li's Homepage
Home
News
Talks
Publications
Projects
Students
Contact
Light
Dark
Automatic
English
中文 (简体)
Efficient AI
MatMoE: Matryoshka Mixture-of-Experts with Dynamic Mixed-Precision Quantization for Efficient Inference
Renjie Wei
,
Haochen Huang
,
Chuyu Qiu
,
Jinqi Wen
,
Dehao Xu
,
Meng Li
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
Tong Xie
,
Zuodong Zhang
,
Chao Yang
,
Yuan Wang
,
Runsheng Wang
,
Meng Li
NICE: 3D-NAND-based In-Memory-Computing with In-Situ ECC-Protection for Fault-Tolerant and Efficient LLM Inference
Boyi Fu
,
Weikai Xu
,
Tong Xie
,
Jin Luo
,
Yaoyu Tao
,
Meng Li
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
Zizhuo Fu
,
Yifan Zhou
,
Zhaoxin Lu
,
Guangyu Sun
,
Runsheng Wang
,
Meng Li
,
Yibo Lin
Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse
Zizhuo Fu
,
Wenxuan Zeng
,
Runsheng Wang
,
Meng Li
HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction
Shengxuan Qiu
,
Haochen Huang
,
Shuzhang Zhong
,
Pengfei Zuo
,
Meng Li
TEAM: Temporal–Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration
Linye Wei
,
Zixiang Luo
,
Pingzhi Tang
,
Meng Li
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
Shuzhang Zhong
,
Haochen Huang
,
Shengxuan Qiu
,
Pengfei Zuo
,
Runsheng Wang
,
Meng Li
CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems
Tong Xie
,
Yijiahao Qi
,
Jinqi Wen
,
Zishen Wan
,
Yanchi Dong
,
Zihao Wang
,
Shaofei Cai
,
Yitao Liang
,
Tianyu Jia
,
Yuan Wang
,
Runsheng Wang
,
Meng Li
DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference
Jinqi Wen
,
Tong Xie
,
Runsheng Wang
,
Meng Li
»
Cite
×