李萌的个人主页
李萌的个人主页
首页
新闻
最新讲座
论文发表
开源项目
学生
联系方式
浅色
深色
自动
中文 (简体)
English
Algorithm/Software
MatMoE: Matryoshka Mixture-of-Experts with Dynamic Mixed-Precision Quantization for Efficient Inference
Renjie Wei
,
Haochen Huang
,
Chuyu Qiu
,
Jinqi Wen
,
Dehao Xu
,
李萌
Helios: Melting Kernel Boundaries for GPU-Accelerated HE via Graph Rewriting and Microarchitecture-Aware Mapping
Yi Chen
,
Ziyu Tang
,
Chao Yang
,
Guang Fan
,
Mingzhe Zhang
,
李萌
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
Zizhuo Fu
,
Yifan Zhou
,
Zhaoxin Lu
,
Guangyu Sun
,
Runsheng Wang
,
李萌
,
Yibo Lin
论文
Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse
Zizhuo Fu
,
Wenxuan Zeng
,
Runsheng Wang
,
李萌
论文
HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction
Shengxuan Qiu
,
Haochen Huang
,
Shuzhang Zhong
,
Pengfei Zuo
,
李萌
论文
TEAM: Temporal–Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration
Linye Wei
,
Zixiang Luo
,
Pingzhi Tang
,
李萌
论文
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
A speculative exploration system that breaks reward synchronization barriers to accelerate scalable Tree-of-Thought reasoning.
Shuzhang Zhong
,
Haochen Huang
,
Shengxuan Qiu
,
Pengfei Zuo
,
Runsheng Wang
,
李萌
论文
DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference
Jinqi Wen
,
Tong Xie
,
Runsheng Wang
,
李萌
论文
DySL-VLA: Efficient Vision-Language-Action Model Inference via Dynamic-Static Layer-Skipping for Robot Manipulation
Zebin Yang
,
Yijiahao Qi
,
Tong Xie
,
Bo Yu
,
Shaoshan Liu
,
李萌
论文
KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning
Zebin Yang
,
Tong Xie
,
Baotong Lu
,
Shaoshan Liu
,
Bo Yu
,
李萌
论文
»
引用
×