<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Algorithm/Software | Meng Li's Homepage</title><link>https://mengli.me/tag/algorithm/software/</link><atom:link href="https://mengli.me/tag/algorithm/software/index.xml" rel="self" type="application/rss+xml"/><description>Algorithm/Software</description><generator>Wowchemy (https://wowchemy.com)</generator><language>en-us</language><lastBuildDate>Sat, 11 Jul 2026 00:00:00 +0000</lastBuildDate><image><url>https://mengli.me/media/icon_hu_ad1e0b0e8ea3c209.png</url><title>Algorithm/Software</title><link>https://mengli.me/tag/algorithm/software/</link></image><item><title>MatMoE: Matryoshka Mixture-of-Experts with Dynamic Mixed-Precision Quantization for Efficient Inference</title><link>https://mengli.me/publication/iccad-2026-matmoe/</link><pubDate>Sat, 11 Jul 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2026-matmoe/</guid><description/></item><item><title>Helios: Melting Kernel Boundaries for GPU-Accelerated HE via Graph Rewriting and Microarchitecture-Aware Mapping</title><link>https://mengli.me/publication/micro-2026-helios/</link><pubDate>Sun, 05 Jul 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/micro-2026-helios/</guid><description/></item><item><title>RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System</title><link>https://mengli.me/publication/iseda-2026-repart/</link><pubDate>Tue, 12 May 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iseda-2026-repart/</guid><description/></item><item><title>Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse</title><link>https://mengli.me/publication/icml-2026-attn/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2026-attn/</guid><description/></item><item><title>HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction</title><link>https://mengli.me/publication/icml-2026-hyper/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2026-hyper/</guid><description/></item><item><title>TEAM: Temporal–Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration</title><link>https://mengli.me/publication/icml-2026-team/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2026-team/</guid><description/></item><item><title>Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration</title><link>https://mengli.me/publication/osdi-2026-brb/</link><pubDate>Mon, 30 Mar 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/osdi-2026-brb/</guid><description/></item><item><title>DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference</title><link>https://mengli.me/publication/dac-2026-drift/</link><pubDate>Tue, 24 Feb 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2026-drift/</guid><description/></item><item><title>DySL-VLA: Efficient Vision-Language-Action Model Inference via Dynamic-Static Layer-Skipping for Robot Manipulation</title><link>https://mengli.me/publication/dac-2026-dyslvla/</link><pubDate>Tue, 24 Feb 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2026-dyslvla/</guid><description/></item><item><title>KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning</title><link>https://mengli.me/publication/dac-2026-keep/</link><pubDate>Tue, 24 Feb 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2026-keep/</guid><description/></item><item><title>Orchestrating Dual-Boundaries: An Arithmetic Intensity Inspired Acceleration Framework for Diffusion Language Models</title><link>https://mengli.me/publication/dac-2026-odbllm/</link><pubDate>Tue, 24 Feb 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2026-odbllm/</guid><description/></item><item><title>CryptoMoE: Privacy-Preserving and Scalable Mixture of Experts Inference via Balanced Expert Routing</title><link>https://mengli.me/publication/neurips-2025-cryptomoe/</link><pubDate>Sun, 14 Dec 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2025-cryptomoe/</guid><description/></item><item><title>EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval</title><link>https://mengli.me/publication/neurips-2025-efficientnav/</link><pubDate>Sun, 14 Dec 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2025-efficientnav/</guid><description/></item><item><title>MPCache: MPC-Friendly KV Cache Eviction for Efficient Private LLM Inference</title><link>https://mengli.me/publication/neurips-2025-mpcache/</link><pubDate>Sun, 14 Dec 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2025-mpcache/</guid><description/></item><item><title>No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering</title><link>https://mengli.me/publication/iccad-2025-3dgs/</link><pubDate>Mon, 27 Oct 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2025-3dgs/</guid><description/></item><item><title>Breaking the Layer Barrier: Remodeling Private Transformer Inference with Hybrid CKKS and MPC</title><link>https://mengli.me/publication/usenix-2025-blb/</link><pubDate>Wed, 14 May 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/usenix-2025-blb/</guid><description/></item><item><title>HybriMoE: Hybrid CPU-GPU Scheduling and Cache Management for Efficient MoE Inference</title><link>https://mengli.me/publication/dac-2025-hybrimoe/</link><pubDate>Tue, 25 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2025-hybrimoe/</guid><description/></item><item><title>ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance</title><link>https://mengli.me/publication/dac-2025-realm/</link><pubDate>Tue, 25 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2025-realm/</guid><description/></item><item><title>SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding</title><link>https://mengli.me/publication/dac-2025-specasr/</link><pubDate>Tue, 25 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2025-specasr/</guid><description/></item><item><title>SCALES: Boost Binary Neural Network for Image Super-Resolution with Efficient Scalings</title><link>https://mengli.me/publication/date-2025-scales/</link><pubDate>Mon, 24 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/date-2025-scales/</guid><description/></item><item><title>ArkVale: Efficient Generative LLM Inference with Recallable Key-Value Eviction</title><link>https://mengli.me/publication/neurips-2024-arkvale/</link><pubDate>Sat, 14 Dec 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2024-arkvale/</guid><description/></item><item><title>PrivCirNet: Efficient Private Inference via Block Circulant Transformation</title><link>https://mengli.me/publication/neurips-2024-privcirnet/</link><pubDate>Sat, 14 Dec 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2024-privcirnet/</guid><description/></item><item><title>AdapMoE: Adaptive Sensitivity-based Expert Gating and Management for Efficient MoE Inference</title><link>https://mengli.me/publication/iccad-2024-adapmoe/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-adapmoe/</guid><description/></item><item><title>FlexHE: A flexible Kernel Generation Framework for Homomorphic Encryption-Based Private Inference</title><link>https://mengli.me/publication/iccad-2024-flexhe/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-flexhe/</guid><description/></item><item><title>MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers</title><link>https://mengli.me/publication/iccad-2024-mcubert/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-mcubert/</guid><description/></item><item><title>PrivQuant: Communication-Efficient Private Inference with Quantized Network/Protocol Co-Optimization</title><link>https://mengli.me/publication/iccad-2024-privquant/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-privquant/</guid><description/></item><item><title>ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding</title><link>https://mengli.me/publication/iccad-2024-propd/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-propd/</guid><description/></item><item><title>FastQuery: Communication-efficient Embedding Table Query for Private LLMs inference</title><link>https://mengli.me/publication/dac-2024-fastquery/</link><pubDate>Sun, 07 Jul 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2024-fastquery/</guid><description/></item><item><title>CoPriv: Network/Protocol Co-Optimization for Communication-Efficient Private Inference</title><link>https://mengli.me/publication/neurips-2023-copriv/</link><pubDate>Thu, 14 Dec 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2023-copriv/</guid><description/></item><item><title>Falcon: Accelerating Homomorphically Encrypted Convolutions for Efficient Private Mobile Network Inference</title><link>https://mengli.me/publication/iccad-2023-falcon/</link><pubDate>Tue, 24 Oct 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2023-falcon/</guid><description/></item><item><title>Memory-aware Scheduling for Complex Wired Networks with Iterative Graph Optimization</title><link>https://mengli.me/publication/iccad-2023-mem/</link><pubDate>Tue, 24 Oct 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2023-mem/</guid><description/></item><item><title>MPCViT: Searching for Accurate and Efficient MPC-Friendly Vision Transformer with Heterogeneous Attention</title><link>https://mengli.me/publication/iccv-2023-mpcvit/</link><pubDate>Tue, 24 Oct 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccv-2023-mpcvit/</guid><description/></item><item><title>AVATAR: An Aging- and Variation-Aware Dynamic Timing Analyzer for Error-Efficient Computing</title><link>https://mengli.me/publication/tcad-2023-avatar/</link><pubDate>Fri, 07 Jul 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/tcad-2023-avatar/</guid><description/></item><item><title>BiT: Robustly Binarized Multi-distilled Transformer</title><link>https://mengli.me/publication/neurips-2022-bit/</link><pubDate>Tue, 27 Sep 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/neurips-2022-bit/</guid><description/></item><item><title>Depth Shrink: Empowering Hardware-Friendly Shallow Neural Networks</title><link>https://mengli.me/publication/icml-2022-depthshrink/</link><pubDate>Fri, 10 Jun 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2022-depthshrink/</guid><description/></item><item><title>Omni-sparsity DNN: Fast Sparsity Optimization for On-Device Streaming E2E ASR via Supernet</title><link>https://mengli.me/publication/icassp-2022-omnisparsity/</link><pubDate>Sun, 22 May 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icassp-2022-omnisparsity/</guid><description/></item><item><title>Multi-Scale High-Resolution Vision Transformer for Semantic Segmentation</title><link>https://mengli.me/publication/cvpr-2022-hrvit/</link><pubDate>Sat, 05 Mar 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/cvpr-2022-hrvit/</guid><description/></item><item><title>SplitNets: Designing Neural Architectures for Efficient Distributed Computing on Head-Mounted Systems</title><link>https://mengli.me/publication/cvpr-2022-splitnet/</link><pubDate>Sat, 05 Mar 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/cvpr-2022-splitnet/</guid><description/></item><item><title>NASViT: Neural Architecture Search for Efficient Vision Transformers with Gradient Conflict aware Supernet Training</title><link>https://mengli.me/publication/iclr-2022-nasvit/</link><pubDate>Mon, 14 Feb 2022 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iclr-2022-nasvit/</guid><description/></item><item><title>AlphaNet: Improved Training of Supernets with Alpha-Divergence</title><link>https://mengli.me/publication/icml-2021-alphanet/</link><pubDate>Thu, 10 Jun 2021 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2021-alphanet/</guid><description/></item><item><title>AttentiveNAS: Improving Neural Architecture Search via Attentive Sampling</title><link>https://mengli.me/publication/cvpr-2021-attentivenas/</link><pubDate>Thu, 01 Apr 2021 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/cvpr-2021-attentivenas/</guid><description/></item><item><title>KeepAugment: A Simple Information-Preserving Data Augmentation Approach</title><link>https://mengli.me/publication/cvpr-2021-keepaugment/</link><pubDate>Mon, 23 Nov 2020 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/cvpr-2021-keepaugment/</guid><description/></item><item><title>TimingSAT: Decamouflaging timing-based logic obfuscation</title><link>https://mengli.me/publication/itc-2018-timingsat/</link><pubDate>Mon, 01 Oct 2018 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/itc-2018-timingsat/</guid><description/></item><item><title>Federated Learning with Non-IID Data</title><link>https://mengli.me/publication/arxiv-2018-federated/</link><pubDate>Sat, 02 Jun 2018 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/arxiv-2018-federated/</guid><description/></item><item><title>PrivyNet: A Flexible Framework for Privacy-Preserving Deep Neural Network Training</title><link>https://mengli.me/publication/arxiv-2018-privynet/</link><pubDate>Fri, 12 Jan 2018 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/arxiv-2018-privynet/</guid><description/></item><item><title>Cross-level monte carlo framework for system vulnerability evaluation against fault attack</title><link>https://mengli.me/publication/dac-2017-fault/</link><pubDate>Sun, 18 Jun 2017 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2017-fault/</guid><description/></item><item><title>AppSAT: Approximately Deobfuscating Integrated Circuits</title><link>https://mengli.me/publication/host-2017-appsat/</link><pubDate>Mon, 01 May 2017 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/host-2017-appsat/</guid><description/></item><item><title>A monte carlo simulation flow for seu analysis of sequential circuits</title><link>https://mengli.me/publication/dac-2016-seu/</link><pubDate>Sun, 05 Jun 2016 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2016-seu/</guid><description/></item></channel></rss>