Meng Li's Homepage
Meng Li's Homepage
Home
News
Talks
Publications
Projects
Students
Contact
Light
Dark
Automatic
English
中文 (简体)
Algorithm/Software
MatMoE: Matryoshka Mixture-of-Experts with Dynamic Mixed-Precision Quantization for Efficient Inference
Renjie Wei
,
Haochen Huang
,
Chuyu Qiu
,
Jinqi Wen
,
Dehao Xu
,
Meng Li
Helios: Melting Kernel Boundaries for GPU-Accelerated HE via Graph Rewriting and Microarchitecture-Aware Mapping
Yi Chen
,
Ziyu Tang
,
Chao Yang
,
Guang Fan
,
Mingzhe Zhang
,
Meng Li
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
Zizhuo Fu
,
Yifan Zhou
,
Zhaoxin Lu
,
Guangyu Sun
,
Runsheng Wang
,
Meng Li
,
Yibo Lin
Paper
Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse
Zizhuo Fu
,
Wenxuan Zeng
,
Runsheng Wang
,
Meng Li
Paper
HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction
Shengxuan Qiu
,
Haochen Huang
,
Shuzhang Zhong
,
Pengfei Zuo
,
Meng Li
Paper
TEAM: Temporal–Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration
Linye Wei
,
Zixiang Luo
,
Pingzhi Tang
,
Meng Li
Paper
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
A speculative exploration system that breaks reward synchronization barriers to accelerate scalable Tree-of-Thought reasoning.
Shuzhang Zhong
,
Haochen Huang
,
Shengxuan Qiu
,
Pengfei Zuo
,
Runsheng Wang
,
Meng Li
Paper
DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference
Jinqi Wen
,
Tong Xie
,
Runsheng Wang
,
Meng Li
Paper
DySL-VLA: Efficient Vision-Language-Action Model Inference via Dynamic-Static Layer-Skipping for Robot Manipulation
Zebin Yang
,
Yijiahao Qi
,
Tong Xie
,
Bo Yu
,
Shaoshan Liu
,
Meng Li
Paper
KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning
Zebin Yang
,
Tong Xie
,
Baotong Lu
,
Shaoshan Liu
,
Bo Yu
,
Meng Li
Paper
»
Cite
×