<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Shuzhang Zhong | Meng Li's Homepage</title><link>https://mengli.me/authors/shuzhang_zhong_2023g/</link><atom:link href="https://mengli.me/authors/shuzhang_zhong_2023g/index.xml" rel="self" type="application/rss+xml"/><description>Shuzhang Zhong</description><generator>Wowchemy (https://wowchemy.com)</generator><language>en-us</language><image><url>https://mengli.me/media/icon_hu_ad1e0b0e8ea3c209.png</url><title>Shuzhang Zhong</title><link>https://mengli.me/authors/shuzhang_zhong_2023g/</link></image><item><title>HyPER: Bridging Exploration and Exploitation for Scalable LLM Reasoning with Hypothesis Path Expansion and Reduction</title><link>https://mengli.me/publication/icml-2026-hyper/</link><pubDate>Fri, 01 May 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/icml-2026-hyper/</guid><description/></item><item><title>Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration</title><link>https://mengli.me/publication/osdi-2026-brb/</link><pubDate>Mon, 30 Mar 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/osdi-2026-brb/</guid><description/></item><item><title>NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference</title><link>https://mengli.me/publication/dac-2026-nasic/</link><pubDate>Tue, 24 Feb 2026 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2026-nasic/</guid><description/></item><item><title>H2EAL: Hybrid-Bonding Architecture with Hybrid Sparse Attention for Efficient Long-Context LLM Inference</title><link>https://mengli.me/publication/iccad-2025-h2eal/</link><pubDate>Mon, 27 Oct 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2025-h2eal/</guid><description/></item><item><title>HD-MoE: Hybrid and Dynamic Parallelism for Mixture-of-Expert LLMs with 3D Near-Memory Processing</title><link>https://mengli.me/publication/iccad-2025-hdmoe/</link><pubDate>Mon, 27 Oct 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2025-hdmoe/</guid><description/></item><item><title>HybriMoE: Hybrid CPU-GPU Scheduling and Cache Management for Efficient MoE Inference</title><link>https://mengli.me/publication/dac-2025-hybrimoe/</link><pubDate>Tue, 25 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2025-hybrimoe/</guid><description/></item><item><title>SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding</title><link>https://mengli.me/publication/dac-2025-specasr/</link><pubDate>Tue, 25 Feb 2025 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/dac-2025-specasr/</guid><description/></item><item><title>AdapMoE: Adaptive Sensitivity-based Expert Gating and Management for Efficient MoE Inference</title><link>https://mengli.me/publication/iccad-2024-adapmoe/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-adapmoe/</guid><description/></item><item><title>PrivQuant: Communication-Efficient Private Inference with Quantized Network/Protocol Co-Optimization</title><link>https://mengli.me/publication/iccad-2024-privquant/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-privquant/</guid><description/></item><item><title>ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding</title><link>https://mengli.me/publication/iccad-2024-propd/</link><pubDate>Sun, 27 Oct 2024 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2024-propd/</guid><description/></item><item><title>Memory-aware Scheduling for Complex Wired Networks with Iterative Graph Optimization</title><link>https://mengli.me/publication/iccad-2023-mem/</link><pubDate>Tue, 24 Oct 2023 00:00:00 +0000</pubDate><guid>https://mengli.me/publication/iccad-2023-mem/</guid><description/></item></channel></rss>