Papers are organized by topic. Students can sign up to present a paper in the online signup sheet (Tencent Docs).

LLM Serving

  1. CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving
    Yuhan Liu, Hanchen Li, Yihua Cheng, Siddhant Ray, Yuyang Huang, Qizheng Zhang, Kuntai Du, Jiayi Yao, Shan Lu, Ganesh Ananthanarayanan, Michael Maire, Henry Hoffmann, Ari Holtzman, Junchen Jiang
    SIGCOMM, 2024
  2. CacheBlend: Fast Large Language Model Serving for RAG with Cached Knowledge Fusion
    Jiayi Yao, Hanchen Li, Yuhan Liu, Siddhant Ray, Yihua Cheng, Qizheng Zhang, Kuntai Du, Shan Lu, Junchen Jiang
    EuroSys, 2025
  3. MegaScale-Infer: Efficient Mixture-of-Experts Model Serving with Disaggregated Expert Parallelism
    Ruidong Zhu, Ziheng Jiang, Chao Jin, Peng Wu, Cesar A. Stuardo, Dongyang Wang, Xinlei Zhang, Huaping Zhou, Haoran Wei, Yang Cheng, Jianzhe Xiao, Xinyi Zhang, Lingjun Liu, Haibin Lin, Li-Wen Chang, Jianxi Ye, Xiao Yu, Xuanzhe Liu, Xin Jin, Xin Liu
    SIGCOMM, 2025
  4. TimelyLLM: Time-sensitive LLM Serving System for Physical-I/O Limited Agents
    Neiwen Ling, Guojun Chen, Anurag Khandelwal, Lin Zhong
    MobiSys, 2026
  5. SAIL: Redesigning Collaborative Language Inference with a Single Server-to-Mobile Handoff
    Gibum Park, Sanghyun Han, Yonghwa Cho, Chanjeong Park, Kyunghan Lee
    MobiSys, 2026

Networking for AI

  1. Alibaba HPN: A Data Center Network for Large Language Model Training
    Kun Qian, Yongqing Xi, Jiamin Cao, Jiaqi Gao, Yichi Xu, Yu Guan, Binzhang Fu, Xuemei Shi, Fangbo Zhu, Rui Miao, Chao Wang, Peng Wang, Pengcheng Zhang, Xianlong Zeng, Eddie Ruan, Zhiping Yao, Ennan Zhai, Dennis Cai
    SIGCOMM, 2024
  2. ResCCL: Resource-Efficient Scheduling for Collective Communication
    Tongrui Liu, Chenyang Hei, Fuliang Li, Chengxi Gao, Jiamin Cao, Tianshu Wang, Ennan Zhai, Xingwei Wang
    SIGCOMM, 2025
  3. UCCL-Tran: An Extensible Software Transport Layer for GPU Networking
    Yang Zhou, Zhongjie Chen, Ziming Mao, ChonLam Lao, Shuo Yang, Pravein Govindan Kannan, Xizhi Zhang, Jiaqi Gao, Yilong Zhao, Yongji Wu, Kaichao You, Fengyuan Ren, Zhiying Xu, Costin Raiciu, Ion Stoica
    OSDI, 2026
  4. MixNet: A Runtime Reconfigurable Optical-Electrical Fabric for Distributed Mixture-of-Experts Training
    Xudong Liao, Yijun Sun, Han Tian, Xinchen Wan, Yilun Jin, Zilong Wang, Zhenghang Ren, Xinyang Huang, Wenxue Li, Kin Fai Tse, Zhizhen Zhong, Guyue Liu, Ying Zhang, Xiaofeng Ye, Yiming Zhang, Kai Chen
    SIGCOMM, 2025
  5. ByteScale: Communication-Efficient Scaling of LLM Training with a 2048K Context Length on 16384 GPUs
    Hao Ge, Junda Feng, Qi Huang, Fangcheng Fu, Xiaonan Nie, Lei Zuo, Haibin Lin, Bin Cui, Xin Liu
    SIGCOMM, 2025
  6. TCCL: Discovering Better Communication Paths for PCIe GPU Clusters
    Heehoon Kim, Junyeol Ryu, Jaejin Lee
    ASPLOS, 2024

AI for Networking

  1. CausalTune: Causal Learning based Automated Cellular RAN Configuration Tuning Framework
    Leyang Xue, Bolun Zhang, Yibo Ma, Mahesh K. Marina, He Yan, Yu Zhou, Cheuk Yiu Ip, Senthil Dhandapani, James Klosowski
    SIGCOMM, 2026
  2. m3: Accurate Flow-Level Performance Estimation using Machine Learning
    Chenning Li, Arash Nasr-Esfahany, Kevin Zhao, Kimia Noorbakhsh, Prateesh Goyal, Mohammad Alizadeh, Thomas E. Anderson
    SIGCOMM, 2024
  3. Towards LLM-Based Failure Localization in Production-Scale Networks
    Chenxu Wang, Xumiao Zhang, Runwei Lu, Xianshang Lin, Xuan Zeng, Xinlei Zhang, Zhe An, Gongwei Wu, Jiaqi Gao, Chen Tian, Guihai Chen, Guyue Liu, Yuhong Liao, Tao Lin, Dennis Cai, Ennan Zhai
    SIGCOMM, 2025
  4. Transferable Neural WAN TE for Changing Topologies
    Abd AlRhman AlQiam, Yuanjun Yao, Zhaodong Wang, Satyajeet Singh Ahuja, Ying Zhang, Sanjay G. Rao, Bruno Ribeiro, Mohit Tawarmalani
    SIGCOMM, 2024
  5. AIDA: Accelerating Root Cause Analysis for Multi-Vendor Device Failures with LLM-Powered Reasoning
    Haoran Xu, Xuan Zeng, Xumiao Zhang, Xiaoxi Zhang, Yang Lv, Peng Zhang, Deke Guo, Ennan Zhai
    SIGCOMM, 2026
  6. Hattrick: Solving Multi-Class TE using Neural Models
    Abd AlRhman AlQiam, Zhuocong Li, Satyajeet Singh Ahuja, Zhaodong Wang, Ying Zhang, Sanjay G. Rao, Bruno Ribeiro, Mohit Tawarmalani
    SIGCOMM, 2025

Satellite Communication

  1. LeoCC: Making Internet Congestion Control Robust to LEO Satellite Dynamics
    Zeqi Lai, Zonglun Li, Qian Wu, Hewu Li, Jihao Li, Xin Xie, Yuanjie Li, Jun Liu, Jianping Wu
    SIGCOMM, 2025
  2. SaTE: Low-Latency Traffic Engineering for Satellite Networks
    Hao Wu, Yizhan Han, Mohit Rajpal, Qizhen Zhang, Jingxian Wang
    SIGCOMM, 2025
  3. StarCDN: Moving Content Delivery Networks to Space
    William X. Zheng, Aryan Taneja, Maleeha Masood, Anirudh Sabnis, Ramesh K. Sitaraman, Deepak Vasisht
    SIGCOMM, 2025
  4. Direct-to-Cell Satellite Network without Satellite Navigation
    Wei Liu, Yuanjie Li, Jingyi Lan, Hewu Li, Yimei Chen, Lixin Liu, Jiabo Yang, Xi Long, Li Ouyang, Minghao Tang, Jianping Wu, Qian Wu, Jun Liu, Zeqi Lai
    SIGCOMM, 2025
  5. Earth+: On-Board Satellite Imagery Compression Leveraging Historical Earth Observations
    Kuntai Du, Yihua Cheng, Peder A. Olsen, Shadi A. Noghabi, Junchen Jiang
    ASPLOS, 2025
  6. DeepSpace: Super Resolution Powered Efficient and Reliable Satellite Image Data Acquistion
    Chuanhao Sun, Yu Zhang, Bill Tao, Deepak Vasisht, Mahesh Marina
    SIGCOMM, 2025
  7. B2LoRa: Boosting LoRa Transmission for Satellite-IoT Systems with Blind Coherent Combining
    Yimin Zhao, Weibo Wang, Xiong Wang, Linghe Kong, Jiadi Yu, Yifei Zhu, Shiyuan Li, Chong He, Guihai Chen
    MobiCom, 2025

5G/6G and Mobile Networks

  1. Dissecting Carrier Aggregation in 5G Networks: Measurement, QoE Implications and Prediction
    Wei Ye, Xinyue Hu, Steven Sleder, Anlan Zhang, Udhaya Kumar Dayalan, Ahmad Hassan, Rostand A. K. Fezeu, Akshay Jajoo, Myungjin Lee, Eman Ramadan, Feng Qian, Zhi-Li Zhang
    SIGCOMM, 2024
  2. Application-Level Service Assurance with 5G RAN Slicing
    Arjun Balasingam, Manikanta Kotaru, Paramvir Bahl
    NSDI, 2024
  3. Towards Energy Efficient 5G vRAN Servers
    Anuj Kalia, Nikita Lazarev, Leyang Xue, Xenofon Foukas, Bozidar Radunovic, Francis Y. Yan
    NSDI, 2025
  4. How to Update Your 5G vRAN
    Xin Zhe Khooi, Anuj Kalia, Mun Choon Chan
    MobiCom, 2025
  5. RANBooster: Democratizing advanced cellular connectivity through fronthaul middleboxes
    Xenofon Foukas, Tenzin Samten Ukyab, Bozidar Radunovic, Sylvia Ratnasamy, Scott Shenker
    SIGCOMM, 2025
  6. Unveiling the 5G Mid-Band Landscape: From Network Deployment to Performance and Application QoE
    Rostand A. K. Fezeu, Claudio Fiandrino, Eman Ramadan, Jason Carpenter, Lilian Coelho de Freitas, Faaiq Bilal, Wei Ye, Joerg Widmer, Feng Qian, Zhi-Li Zhang
    SIGCOMM, 2024

Edge Computing

  1. ARISE: High-Capacity AR Offloading Inference Serving via Proactive Scheduling
    Z. Jonny Kong, Qiang Xu, Y. Charlie Hu
    MobiSys, 2024
  2. CoActo: CoActive Neural Network Inference Offloading with Fine-grained and Concurrent Execution
    Kyungmin Bin, Jongseok Park, Chanjeong Park, Seyeon Kim, Kyunghan Lee
    MobiSys, 2024
  3. EdgeLoRA: An Efficient Multi-Tenant LLM Serving System on Edge Devices
    Zheyu Shen, Yexiao He, Ziyao Wang, Yuning Zhang, Guoheng Sun, Wanghao Ye, Ang Li
    MobiSys, 2025
  4. Totoro: A Scalable Federated Learning Engine for the Edge
    Cheng-Wei Ching, Xin Chen, Taehwan Kim, Bo Ji, Qingyang Wang, Dilma Da Silva, Liting Hu
    EuroSys, 2024
  5. NeRFHub: A Context-Aware NeRF Serving Framework for Mobile Immersive Applications
    Bo Chen, Zhisheng Yan, Bo Han, Klara Nahrstedt
    MobiSys, 2024
  6. A Greener Edge: A Framework on Carbon-aware Edge ML System Design
    Xuesi Chen, Ilan Mandel, Eren Yildiz, Josiah D. Hester, Udit Gupta
    MobiSys, 2026