Meng Li's Homepage
Meng Li's Homepage
Home
News
Talks
Publications
Projects
Students
Contact
Light
Dark
Automatic
English
中文 (简体)
Algorithm/Software
Cachemir: Fully Homomorphic Encrypted Inference of Generative Large Language Model with KV Cache
A fully homomorphic encrypted LLM inference framework that efficiently integrates the KV cache for autoregressive decoding.
Ye Yu
,
Yifan Zhou
,
Yi Chen
,
Pedro Soto
,
Wenjie Xiong
,
Meng Li
Paper
Jetson-PI: Towards Onboard Real-Time Robot Control via Foresight-Aligned Asynchronous Inference
Foresight-aligned asynchronous inference and an optimized edge runtime for real-time onboard vision-language-action model deployment.
Zebin Yang
,
Qi Wang
,
Yunhe Wang
,
Xiurui Guo
,
Bo Yu
,
Shaoshan Liu
,
Jiafeng Xu
,
Hao Dong
,
Meng Li
Paper
Code
Project
ROSETTA: Efficient and Accurate Privacy-Preserving LLM Decoding via Hybrid CKKS/TFHE Evaluation
A hybrid CKKS/TFHE framework for efficient and accurate privacy-preserving autoregressive LLM decoding.
Jiangrui Yu
,
Baosheng Zhang
,
Liang Kong
,
Lin Ding
,
Yi Chen
,
Ye Yu
,
Mingzhe Zhang
,
Meng Li
Paper
MatMoE: Matryoshka Mixture-of-Experts with Dynamic Mixed-Precision Quantization for Efficient Inference
Renjie Wei
,
Haochen Huang
,
Chuyu Qiu
,
Jinqi Wen
,
Dehao Xu
,
Meng Li
Helios: Melting Kernel Boundaries for GPU-Accelerated HE via Graph Rewriting and Microarchitecture-Aware Mapping
Yi Chen
,
Ziyu Tang
,
Chao Yang
,
Guang Fan
,
Mingzhe Zhang
,
Meng Li
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
Zizhuo Fu
,
Yifan Zhou
,
Zhaoxin Lu
,
Guangyu Sun
,
Runsheng Wang
,
Meng Li
,
Yibo Lin
Paper
Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse
Zizhuo Fu
,
Wenxuan Zeng
,
Runsheng Wang
,
Meng Li
Paper
HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction
Shengxuan Qiu
,
Haochen Huang
,
Shuzhang Zhong
,
Pengfei Zuo
,
Meng Li
Paper
TEAM: Temporal–Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration
Linye Wei
,
Zixiang Luo
,
Pingzhi Tang
,
Meng Li
Paper
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
A speculative exploration system that breaks reward synchronization barriers to accelerate scalable Tree-of-Thought reasoning.
Shuzhang Zhong
,
Haochen Huang
,
Shengxuan Qiu
,
Pengfei Zuo
,
Runsheng Wang
,
Meng Li
Paper
»
Cite
×