Accepted Papers
The following papers have been accepted to appear at the 32nd ACM SIGOPS Symposium on Operating Systems Principles (SOSP), conditional on the approval of each paper's shepherd:
Note: For each accepted paper, at least one author must have a full registration.
- A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with CrystalLLM
Shaoke Xi, ChonLam Lao (Alibaba Group), Boyi Jia (Shanghai Jiao Tong University and Alibaba Group), Jiaqi Gao, Zhipeng Zhang, Jiamin Cao (Alibaba Group), Brian Sutioso (Harvard University), Erci Xu (Shanghai Jiao Tong University), Minlan Yu (Harvard University), Kui Ren (Zhejiang University), Yong Li, Zhengping Qian, Ennan Zhai, Jingren Zhou (Alibaba Group) - Ahead-of-time Analysis of Shell Program Effects
Lukas Lazarek, Evangelos Lamprou, George Kapetanakis, Eric Zhao, Zhiwen Zheng (Brown University), Michael Greenberg (Stevens Institute of Technology), Konstantinos Kallas (University of California, Los Angeles), Nikos Vasilakis (Brown University) - Anchor: Mitigating Shallow Disruptions with Decoupled Memory
Haoyi Ma, Shiwei Gao (Tsinghua University), Youmin Chen (Shanghai Jiao Tong University), Junrong Huang, Youyou Lu, Jiwu Shu (Tsinghua University) - LLM-42: Enabling Determinism in LLM Inference with Verified Speculation
Raja Gond (Microsoft Research), Aditya K Kamath (University of Washington), Ramachandran Ramjee, Ashish Panwar (Microsoft Research) - Batched in Back: Characterizing and Optimizing Offline LLM Inference in Production with ACDC
Leping Yang (Shanghai Jiao Tong University), Xue Li, Kun Qian (Alibaba Group), Erci Xu (Shanghai Jiao Tong University), Mingzhen Han, Haoran Zhu, Tao He, Zuolong Yin, Ennan Zhai, Wenyuan Yu, Jingren Zhou (Alibaba Group), Guangtao Xue (Shanghai Jiao Tong University) - Beyond Utilization: Energy-Conscious GPU Sharing for Inference Serving
Prasoon Sinha, Dimitrios Liakopoulos, Nathan Lemma, Neeraja J. Yadwadkar (The University of Texas at Austin) - Borges: A Low-Latency Distributed Shared Log on a CXL Memory/SSD Hybrid
Haowei Chen, Yiming Xiang (The University of Texas at Austin), Zhipeng Jia (Anthropic PBC), Yan Sun, Nam Sung Kim (UIUC), Emmett Witchel (The University of Texas at Austin) - Bug-finding and proofs for platform configurations and hardware based on reference manuals
Ben Fiedler, Sedan Abdelgawad, Teymour Aldridge, Viktor Fukala, Jan Häussermann, Gamal Hassan, Lars Leuthold, Konstantin Lucny, Max Wierse, Samuel Gruetter, Timothy Roscoe (ETH Zurich) - Cardamom: A Multi-GPU Framework for TB-Scale Encrypted Inference
Siddharth Jayashankar (Carnegie Mellon University), Joshua Kim (University of Texas at Austin), Michael Sullivan (NVIDIA), Wenting Zheng, Dimitrios Skarlatos (Carnegie Mellon University) - Cohort: Decentralized PIR
Jonathan Weiss, Yossi Gilad (Hebrew University of Jerusalem) - Compositional Verification of Cluster Control Planes
Zhizhen Cai, Nikhil Date, Jiawei Tyler Gu (University of Illinois Urbana-Champaign), Cody Rivera, Tej Chajed (University of Wisconsin-Madison), Oded Padon (Weizmann Institute of Science), Tianyin Xu (University of Illinois Urbana-Champaign), Xudong Sun (University of Wisconsin–Madison) - Computation is Fast, Use Threadlet!
Yiming Yao, Xiaohe Qin, Yi Fan (Peking University), Yuanlong Li (EPFL), Kang Hu, Liujia Li, Yingwei Luo, Xiaolin Wang (Peking University), Zhenlin Wang (Michigan Technological University), Yuval Tamir (UCLA), Diyu Zhou (Peking University) - DDB: Source-Level Interactive Debugging for Distributed Applications
Yibo Yan, Junzhou He, Seo Jin Park (University of Southern California) - Democratizing MoE LLM Decoding via Barrier-Free Expert Parallelism
Yizhuo Liang, Shaoyu Wang, Jaeyong Song (University of Southern California), Yanqi Zhou (Google Deepmind), Geon-Woo Kim (The University of Texas at Austin), Guangrong He, Seo Jin Park (University of Southern California) - DiFlow: A System for Micro-Serving Text-to-Image Diffusion Workflows
Lingyun Yang (Alibaba Group), Suyi Li, Tianyu Feng, Xiaoxiao Jiang (Hong Kong University of Science and Technology), Zhipeng Di, Weiyi Lu, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang (Alibaba Group), Wei Wang (Hong Kong University of Science and Technology) - DISCO*: DIstributed and SCalable Oblivious Joins and Oblivious Primitives
Apostolos Mavrogiannakis (University of California, Santa Cruz), Xian Wang (Hong Kong University of Science and Technology), Ioannis Demertzis (University of California, Santa Cruz), Dimitrios Papadopoulos (Hong Kong University of Science & Technology), Minos Garofalakis (ATHENA Research Center & Technical University of Crete) - Disk-Based LSMs: An Unexpectedly Good Index for Partly Coherent CXL Memory
Kiran Hombal, Jiyu Hu (University of Illinois Urbana-Champaign), Marcos K. Aguilera (NVIDIA), Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign) - Efficient GPU Multitasking with Morphable Kernels
Tingxu Ren, Ruwen Fan, Hao Guo, Minhui Xie, Shiwei Gao, Jiwu Shu, Youyou Lu (Tsinghua University) - RPCShield: Defending Microservices Against Cascading Failures
Milind Chabbi, Sonal Mahajan (Uber Technologies), Ivan Beschastnikh (University of British Columbia), René Just (University of Washington), Yuxin Wang, Yufan Xu (Uber Technologies), Elton Pinto (Georgia Institute of Technology), Seemanta Saha (Uber Technologies), Manu Sridharan (University of California, Riverside), Abhishek Jha, Sandeep Koushik Sheshadri, Mayank Bansal (Uber Technologies) - Flux: Unleashing Linux as a High-Performance Application Kernel
Kaifu Tian, Youjie Zheng, Yiren Zhang, Yuyang You, Keyang Hu (Tsinghua University), Kang Chen (Tsinghua University, Peking University), Yu Chen (Tsinghua University) - GAZE: Rearchitecting Log-Structured Filesystem for Garbage Collection on Zoned Namespace Flash Storage
Juwon Kim, Hwanseok Yoo, Seung Won Yoo, Youjip Won (Korea Advanced Institute of Science and Technology) - Guiding Agentic GPU Kernel Optimization with Data Flow Invariants
Haohui Mai (HKUST), Xiaoyan Guo (University of Chinese Academy of Sciences, China), Xiangyun Ding (University of California, Riverside), Daifeng Li (University of Science and Technology of China), Qiuchu Yu (University of Chinese Academy of Sciences, China), Chenzhun Guo (Xi'an jiaotong university, China), Cong Wang (Tsinghua University), Jiacheng Zhao (University of Chinese Academy of Sciences, China), Christos Kozyrakis (Stanford University), Binhang Yuan (HKUST) - I3DP: Neuro-symbolic Inductive Invariant Inference for Distributed Protocols
Weining Cao, Guangyuan Wu, Yuan Yao (Nanjing University), Hengfeng Wei (Hunan University), Taolue Chen (Birkbeck, University of London), Xiaoxing Ma (Nanjing University) - Information and Control in Agent-Native Filesystems
Shawn (Wanxiang) Zhong, Junxuan Liao (University of Wisconsin-Madison), Jing Liu (Microsoft Research), Mai Zheng (Iowa State University), Andrea Arpaci-Dusseau (University of Wisconsin-Madison), Remzi Arpaci-Dusseau (University of Wisconsin–Madison) - It's the Kernel's Fault! Custom Page Fault Handling With bpf_fault
Tal Zussman, Riju Dey, Hasan Zengin, Yiming Fang (Columbia University), David Hildenbrand (Technical University of Munich and Arm Germany GmbH), Asaf Cidon (Columbia University) - Linux AGX: An Adaptive GPU eXtension to Linux Fair Scheduling for Physical AI and Robotic Systems
Soheil Shirvani, Cong Liu (University of California - Riverside) - Lion: Modular Verification of Async Runtime Liveness
Ti Zhou, Zihao Zhang, Omar Chowdhury, Shuai Mu (Stony Brook University) - LMTracer: Fine-Grained and Real-Time Performance Profiling for Production LLM Systems
Wei Liu, Yongchao He, Bohan Zhao (SCITIX (SGP) TECH PTE. LTD.), Hongyi Wang, Zhenhua Li (Tsinghua University), Junping Zhao (SCITIX (SGP) TECH PTE. LTD.) - M2K: Making the Model-Kernel Interface Explicit for Reliable CUDA Kernel Verification
Mengting He, Shihao Xia (The Pennsylvania State University), Haomin Jia (SKLP, Institute of Computing Technology, Chinese Academy of Sciences), Wenfei Wu (Peking University), Linhai Song (SKLP, Institute of Computing Technology, Chinese Academy of Sciences) - MCon: Building an Elastic Cloud for Android Applications with Framework Consolidation
Jiaxing Qiu, Zijie Zhou, Zhenhua Li, Hongyi Wang, Zizhang Liu (Tsinghua University), Yumeng Liang (China Telecom Cloud Computing Research Institute), Jie Wu (China Telecom Cloud Computing Research Institute & Temple University), Tianyin Xu (University of Illinois Urbana-Champaign) - MeshRT: Compile-Time Governed Wafer-Scale Runtime for Low-Latency High-Throughput Inference
Congjie He, Le Xu, Zhan Lu, Yeqi Huang, Haocheng Xiao, Cheng Deng (University of Edinburgh), Lingxiao Ma, Ziming Miao, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh) - Multi-LLM Serving at Production Scale
Tianbao Zhou (Peking University), Yi Wang (JD Company), Yu Zhou (UCAS), Zirui Liu, Zhiming Wang, Yebo Peng (Peking University), Yongfu Wang (USTC), Yi Zhang, Jinrun Yin, Kemeng Tian (Peking University), Fangcheng Fu (SJTU), Tongxuan Liu, Tao Peng (JD Company), Tong Yang, Bin Cui, Xupeng Miao (Peking University), Ke Zhang (JD Company) - Observability-Driven Tiered Memory for Colocated Workloads
Hanchen Xu, Berkay Inceisci, Hao Li, Zhenyu Zhang, Huaicheng Li (Virginia Tech) - On-site, Non-speculative Failure Diagnosis with CLODS
Rishikesh Devsot (YScope), Yi Fan Yu, ChenXing Yang, Ellen Shi (University of Toronto), Ding Yuan (University of Toronto and YScope) - Oscar: Resilient Privacy Budgeting Across Untrusted Web Domains
Pierre Tholoniat, Alison Caulfield, Giorgio Cavicchioli, Mark Chen (Columbia University), Benjamin Case (Meta Inc.), Asaf Cidon, Roxana Geambasu (Columbia University), Mathias Lécuyer (University of British Columbia), Martin Thomson (Mozilla) - PirateShip: Append-Only Ledgers for (Mostly) Trusted Execution Environments
Shubham Mishra (University of California, Berkeley), João Gonçalves (INESC-ID & IST U. Lisboa), Chawinphat Tankuranand, Natacha Crooks, Neil Giridharan (UC Berkeley), Heidi Howard, Chris Jensen (Azure Research, Microsoft) - ProbeFS: Hierarchical DNA File Systems via Biochemical Content Addressability and Parallelism
Ruihan Li, Yuankun Zhang, Mingkai Dong, Yaya Hao, Fei Wang, Chunhai Fan, Haibo Chen (Shanghai Jiao Tong University) - QProf: Fleetwide Transitive Cost Profiling of Warehouse-Scale Services
Sam (Likun) Xi, Ali Sheikh, Alexey Alexandrov, Ning Wang, Vance Lankhaar, Tipp Moseley, Parthasarathy Ranganathan (Google) - SANDHI: Fine-grained Merging for Memory Efficient Multi-Model Serving
Vima Gupta, Oytun Kuday Duran, Nandan Suresh Meda, Ikhyun An (Georgia Institute of Technology), Ganesh Ananthanarayanan (Microsoft), Anand Iyer (Georgia Institute of Technology) - Scalable Context Orchestration for Serving LLMs Over Voice
Linyi Jiang (Shanghai Jiao Tong University, AgenticSys), Silvery D. Fu (AgenticSys), Yifei Zhu (Shanghai Jiao Tong University) - Scaling Weight Transfer in LLM RL Training with Reference-Oriented Storage
Chenhao Ye (University of Wisconsin–Madison), Huaizheng Zhang, Mingcong Han, Baoquan Zhong, Xiang Li, Qixiang Chen, Xinyi Zhang, W. Zhang, Kaihua Jiang, Wang Zhang, Sun He, Wencong Xiao (ByteDance Seed), Andrea Arpaci-Dusseau, Remzi Arpaci-Dusseau (University of Wisconsin–Madison) - Scheduling Linux Threads under I/O Chiplet Wall Using cSwitch
Seunghyun An, Joontaek Oh, Ming Liu (University of Wisconsin-Madison) - Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients
Austin Li, Daniel Lee (Cornell University), Florian Suri-Payer (Cornell University / Databricks), Lorenzo Alvisi (Cornell University), Natacha Crooks (UC Berkeley) - Skill VM: Write Once, Run Everywhere Efficiently
Le Chen, Erhu Feng, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University) - Smaran: Serving Authenticated Time Travel Queries
Asim Nepal, Shistata Subedi (University of Oregon), Shubham Mishra (University of California, Berkeley), Suyash Gupta (University of Oregon), Aniket Kate (Purdue University), Hein Meling (University of Stavanger) - StarfishOS: Revisiting Single System Image on CXL with State-partitioned Microkernel
Fangnuo Wu, Jingsheng Yan, Mingkai Dong, Wenjun Cai, Jingwei Xu, Tong Xin, Haibo Chen (Shanghai Jiao Tong University) - State-Aware Fuzzing of JavaScript Engines with LLM-Guided Instrumentation
Wai Kin Wong, Dongwei Xiao (Hong Kong University of Science and Technology), Anthony Cheuk Tung LAI (VX Research Limited), Ping Fan Ke (Singapore Management University), Shuai Wang (Hong Kong University of Science and Technology) - Supporting Agents on Streaming Data via a Forkable Shared Log
Shreesha G. Bhat, Tony Hong, Michael A Noguera, Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign) - SysX: A unified analytics engine for secure multiparty computation
Muhammad Faisal, Alessandra Lanz, Sam Buxbaum, Adam Godel, Vasiliki Kalavri, Mayank Varia, John Liagouris (Boston University) - Tamias: Feedback-Guided Systematic Concurrency Exploration for Transparent Distributed System Fuzzing
Congyu Liu, Yaoxu Song, Pedro Fonseca, Yongle Zhang (Purdue University) - Taming Dynamism on GPUs: Cross-SM Kernel Fusion via SM Cooperation and Just-in-Time Reduction
Jingkai He, Guangda Sun, TianJian Li, Dong Du, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University) - Taming Inference Workloads at Global Scale: Foundation Model Serving in SystemX
Pratik Pankaj Raichura, Somasundaram Perianayagam, Rama Krishna Sandeep Pokkunuri, Divya Jain, Christopher Greenwood (Amazon Web Services) - TensorDex: A Compact, Tensor-Centric Storage System for Modern AI Models
Tingfeng Lan, Zirui Wang (University of Virginia), Yunjia Zheng (Harvard University), Zhaoyuan Su (University of Virginia), Juncheng Yang (Harvard University), Yue Cheng (University of Virginia) - Testing Custom Control Planes Without the Cluster
Tim Goodwin, Lindsey Kuper, Andi Quinn (University of California, Santa Cruz) - TuxBot: Semantic-Aware Online OS Tuning with LLMs
Georgios Liargkovas, Mihir Nitin Joshi (Columbia University), Hubertus Franke (IBM Research), Kostis Kaffes (Columbia University) - Validating a Production Cloud Object Store with Lightweight Formal Methods
Rajeev Joshi, Bernhard Kragl, Vimuth Fernando, Sarek Skotam, Jake Wires, Matthew Russo, Colin Walker (Amazon Web Services) - Validating Rust Compilers with Trait-Type Constraint Graph
Xin Lai, Ming WEN, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology) - Verifying a high-performance distributed transaction system using permissioned state machines
Yun-Sheng Chang (MIT), Joseph Tassarotti (New York University), Frans Kaashoek, Nickolai Zeldovich (MIT) - VoliStorM: A crash-consistent I/O cache with two kernels instead of two caches
Jana Toljaga (Inria Saclay, Télécom SudParis - Institut Polytechnique de Paris), Nicolas Derumigny (Télécom SudParis), Tara Aggoun (Télécom SudParis, Inria Saclay, Institut Polytechnique de Paris), Mathieu Bacou (Samovar, Télécom SudParis, Institut Polytechnique de Paris), Gaël Thomas (Inria Saclay) - Wavel: A Fast and Efficient Compilation System for Wafer-Scale Accelerators
Yeqi Huang, Congjie He, Haocheng Xiao, Yanwei Ye, Yi-Chieh Wang, Boyao Song, Yangshen Deng (University of Edinburgh), Ziming Miao, Lingxiao Ma, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh) - XTRA: Unifying Cache Coherence and Concurrency Control for Distributed Transactions in a CXL Pod
Zhijun Yang, Yu Hua, Ming Zhang, Menglei Chen, Xumin Chen, Aoyang Tong (Huazhong University of Science and Technology) - You Can Always Get What You Want: CPU Virtualization Made Fast and Free
Yun Wang (Shanghai Jiao Tong University), Xingguo Jia (Alibaba Cloud), Ben Luo (Alibaba Group), Kenan Liu, Shengdong Dai, Jingdong Han, Weihao Chen (Alibaba Cloud), Xingzi Yu, Chenggang Wu (Shanghai Jiao Tong University), Yibin Shen, Jiesheng Wu (Alibaba Cloud), Tao Song, Zhengwei Qi, Haibing Guan (Shanghai Jiao Tong University)