-
Accelerating Million-scale In-network Lock Management using Lock Fissio
Author: Zhang, Hanze; Chen, Rong; Tang, Zihan; Cheng, Ke; Chen, Haibo
Journal: ACM TRANSACTIONS ON COMPUTER SYSTEMS. 2026; Vol. 44, Issue 1, pp. -. DOI: 10.1145/3774945
-
Unified and Near-optimal Multi-GPU Cache for Embedding-based Deep Learnin
Author: Song, Xiaoniu; Chen, Rong; Song, Haitao; Zhang, Yiwen; Chen, Haibo
Journal: ACM TRANSACTIONS ON COMPUTER SYSTEMS. 2026; Vol. 44, Issue 1, pp. -. DOI: 10.1145/3767725
-
A Comprehensive Study on Solving Memory Bloat Under Virtualizatio
Author: Li, Chuandong; Tang, Zhe; Liu, Dong; Xue, Zhihong; Wang, Xiaolin; Wang, Zhenlin; Luo, Yingwei; Zhou, Diyu
Journal: ACM TRANSACTIONS ON COMPUTER SYSTEMS. 2026; Vol. 44, Issue 1, pp. -. DOI: 10.1145/3769429
-
RAGCache Efficient Knowledge Caching for Retrieval-Augmented Generatio
Author: Jin, Chao; Zhang, Zili; Jiang, Xuanlin; Liu, Fangyue; Liu, Shufan; Liu, Xuanzhe; Jin, Xin
Journal: ACM TRANSACTIONS ON COMPUTER SYSTEMS. 2026; Vol. 44, Issue 1, pp. -. DOI: 10.1145/3768628
-
Real-time, Work-conserving GPU Scheduling for Concurrent DNN Inferenc
Author: Han, Mingcong; Chen, Rong; Shen, Weihang; Zhang, Hanze; Yang, Jinrong; Chen, Haibo
Journal: ACM TRANSACTIONS ON COMPUTER SYSTEMS. 2026; Vol. 44, Issue 1, pp. -. DOI: 10.1145/3768622