Private AI

FastQuery: Communication-efficient Embedding Table Query for Private LLMs inference
CoPriv: Network/Protocol Co-Optimization for Communication-Efficient Private Inference
MPCViT: Searching for Accurate and Efficient MPC-Friendly Vision Transformer with Heterogeneous Attention