Accepted Papers

The following papers have been accepted to appear at the 32nd ACM SIGOPS Symposium on Operating Systems Principles (SOSP), conditional on the approval of each paper's shepherd:

Note: For each accepted paper, at least one author must have a full registration.

  • A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with CrystalLLM
    Shaoke Xi, ChonLam Lao (Alibaba Group), Boyi Jia (Shanghai Jiao Tong University and Alibaba Group), Jiaqi Gao, Zhipeng Zhang, Jiamin Cao (Alibaba Group), Brian Sutioso (Harvard University), Erci Xu (Shanghai Jiao Tong University), Minlan Yu (Harvard University), Kui Ren (Zhejiang University), Yong Li, Zhengping Qian, Ennan Zhai, Jingren Zhou (Alibaba Group)
  • Ahead-of-time Analysis of Shell Program Effects
    Lukas Lazarek, Evangelos Lamprou, George Kapetanakis, Eric Zhao, Zhiwen Zheng (Brown University), Michael Greenberg (Stevens Institute of Technology), Konstantinos Kallas (University of California, Los Angeles), Nikos Vasilakis (Brown University)
  • Anchor: Mitigating Shallow Disruptions with Decoupled Memory
    Haoyi Ma, Shiwei Gao (Tsinghua University), Youmin Chen (Shanghai Jiao Tong University), Junrong Huang, Youyou Lu, Jiwu Shu (Tsinghua University)
  • LLM-42: Enabling Determinism in LLM Inference with Verified Speculation
    Raja Gond (Microsoft Research), Aditya K Kamath (University of Washington), Ramachandran Ramjee, Ashish Panwar (Microsoft Research)
  • Batched in Back: Characterizing and Optimizing Offline LLM Inference in Production with ACDC
    Leping Yang (Shanghai Jiao Tong University), Xue Li, Kun Qian (Alibaba Group), Erci Xu (Shanghai Jiao Tong University), Mingzhen Han, Haoran Zhu, Tao He, Zuolong Yin, Ennan Zhai, Wenyuan Yu, Jingren Zhou (Alibaba Group), Guangtao Xue (Shanghai Jiao Tong University)
  • Beyond Utilization: Energy-Conscious GPU Sharing for Inference Serving
    Prasoon Sinha, Dimitrios Liakopoulos, Nathan Lemma, Neeraja J. Yadwadkar (The University of Texas at Austin)
  • Borges: A Low-Latency Distributed Shared Log on a CXL Memory/SSD Hybrid
    Haowei Chen, Yiming Xiang (The University of Texas at Austin), Zhipeng Jia (Anthropic PBC), Yan Sun, Nam Sung Kim (UIUC), Emmett Witchel (The University of Texas at Austin)
  • Bug-finding and proofs for platform configurations and hardware based on reference manuals
    Ben Fiedler, Sedan Abdelgawad, Teymour Aldridge, Viktor Fukala, Jan Häussermann, Gamal Hassan, Lars Leuthold, Konstantin Lucny, Max Wierse, Samuel Gruetter, Timothy Roscoe (ETH Zurich)
  • Cardamom: A Multi-GPU Framework for TB-Scale Encrypted Inference
    Siddharth Jayashankar (Carnegie Mellon University), Joshua Kim (University of Texas at Austin), Michael Sullivan (NVIDIA), Wenting Zheng, Dimitrios Skarlatos (Carnegie Mellon University)
  • Cohort: Decentralized PIR
    Jonathan Weiss, Yossi Gilad (Hebrew University of Jerusalem)
  • Compositional Verification of Cluster Control Planes
    Zhizhen Cai, Nikhil Date, Jiawei Tyler Gu (University of Illinois Urbana-Champaign), Cody Rivera, Tej Chajed (University of Wisconsin-Madison), Oded Padon (Weizmann Institute of Science), Tianyin Xu (University of Illinois Urbana-Champaign), Xudong Sun (University of Wisconsin–Madison)
  • Computation is Fast, Use Threadlet!
    Yiming Yao, Xiaohe Qin, Yi Fan (Peking University), Yuanlong Li (EPFL), Kang Hu, Liujia Li, Yingwei Luo, Xiaolin Wang (Peking University), Zhenlin Wang (Michigan Technological University), Yuval Tamir (UCLA), Diyu Zhou (Peking University)
  • DDB: Source-Level Interactive Debugging for Distributed Applications
    Yibo Yan, Junzhou He, Seo Jin Park (University of Southern California)
  • Democratizing MoE LLM Decoding via Barrier-Free Expert Parallelism
    Yizhuo Liang, Shaoyu Wang, Jaeyong Song (University of Southern California), Yanqi Zhou (Google Deepmind), Geon-Woo Kim (The University of Texas at Austin), Guangrong He, Seo Jin Park (University of Southern California)
  • DiFlow: A System for Micro-Serving Text-to-Image Diffusion Workflows
    Lingyun Yang (Alibaba Group), Suyi Li, Tianyu Feng, Xiaoxiao Jiang (Hong Kong University of Science and Technology), Zhipeng Di, Weiyi Lu, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang (Alibaba Group), Wei Wang (Hong Kong University of Science and Technology)
  • DISCO*: DIstributed and SCalable Oblivious Joins and Oblivious Primitives
    Apostolos Mavrogiannakis (University of California, Santa Cruz), Xian Wang (Hong Kong University of Science and Technology), Ioannis Demertzis (University of California, Santa Cruz), Dimitrios Papadopoulos (Hong Kong University of Science & Technology), Minos Garofalakis (ATHENA Research Center & Technical University of Crete)
  • Disk-Based LSMs: An Unexpectedly Good Index for Partly Coherent CXL Memory
    Kiran Hombal, Jiyu Hu (University of Illinois Urbana-Champaign), Marcos K. Aguilera (NVIDIA), Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign)
  • Efficient GPU Multitasking with Morphable Kernels
    Tingxu Ren, Ruwen Fan, Hao Guo, Minhui Xie, Shiwei Gao, Jiwu Shu, Youyou Lu (Tsinghua University)
  • RPCShield: Defending Microservices Against Cascading Failures
    Milind Chabbi, Sonal Mahajan (Uber Technologies), Ivan Beschastnikh (University of British Columbia), René Just (University of Washington), Yuxin Wang, Yufan Xu (Uber Technologies), Elton Pinto (Georgia Institute of Technology), Seemanta Saha (Uber Technologies), Manu Sridharan (University of California, Riverside), Abhishek Jha, Sandeep Koushik Sheshadri, Mayank Bansal (Uber Technologies)
  • Flux: Unleashing Linux as a High-Performance Application Kernel
    Kaifu Tian, Youjie Zheng, Yiren Zhang, Yuyang You, Keyang Hu (Tsinghua University), Kang Chen (Tsinghua University, Peking University), Yu Chen (Tsinghua University)
  • GAZE: Rearchitecting Log-Structured Filesystem for Garbage Collection on Zoned Namespace Flash Storage
    Juwon Kim, Hwanseok Yoo, Seung Won Yoo, Youjip Won (Korea Advanced Institute of Science and Technology)
  • Guiding Agentic GPU Kernel Optimization with Data Flow Invariants
    Haohui Mai (HKUST), Xiaoyan Guo (University of Chinese Academy of Sciences, China), Xiangyun Ding (University of California, Riverside), Daifeng Li (University of Science and Technology of China), Qiuchu Yu (University of Chinese Academy of Sciences, China), Chenzhun Guo (Xi'an jiaotong university, China), Cong Wang (Tsinghua University), Jiacheng Zhao (University of Chinese Academy of Sciences, China), Christos Kozyrakis (Stanford University), Binhang Yuan (HKUST)
  • I3DP: Neuro-symbolic Inductive Invariant Inference for Distributed Protocols
    Weining Cao, Guangyuan Wu, Yuan Yao (Nanjing University), Hengfeng Wei (Hunan University), Taolue Chen (Birkbeck, University of London), Xiaoxing Ma (Nanjing University)
  • Information and Control in Agent-Native Filesystems
    Shawn (Wanxiang) Zhong, Junxuan Liao (University of Wisconsin-Madison), Jing Liu (Microsoft Research), Mai Zheng (Iowa State University), Andrea Arpaci-Dusseau (University of Wisconsin-Madison), Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
  • It's the Kernel's Fault! Custom Page Fault Handling With bpf_fault
    Tal Zussman, Riju Dey, Hasan Zengin, Yiming Fang (Columbia University), David Hildenbrand (Technical University of Munich and Arm Germany GmbH), Asaf Cidon (Columbia University)
  • Linux AGX: An Adaptive GPU eXtension to Linux Fair Scheduling for Physical AI and Robotic Systems
    Soheil Shirvani, Cong Liu (University of California - Riverside)
  • Lion: Modular Verification of Async Runtime Liveness
    Ti Zhou, Zihao Zhang, Omar Chowdhury, Shuai Mu (Stony Brook University)
  • LMTracer: Fine-Grained and Real-Time Performance Profiling for Production LLM Systems
    Wei Liu, Yongchao He, Bohan Zhao (SCITIX (SGP) TECH PTE. LTD.), Hongyi Wang, Zhenhua Li (Tsinghua University), Junping Zhao (SCITIX (SGP) TECH PTE. LTD.)
  • M2K: Making the Model-Kernel Interface Explicit for Reliable CUDA Kernel Verification
    Mengting He, Shihao Xia (The Pennsylvania State University), Haomin Jia (SKLP, Institute of Computing Technology, Chinese Academy of Sciences), Wenfei Wu (Peking University), Linhai Song (SKLP, Institute of Computing Technology, Chinese Academy of Sciences)
  • MCon: Building an Elastic Cloud for Android Applications with Framework Consolidation
    Jiaxing Qiu, Zijie Zhou, Zhenhua Li, Hongyi Wang, Zizhang Liu (Tsinghua University), Yumeng Liang (China Telecom Cloud Computing Research Institute), Jie Wu (China Telecom Cloud Computing Research Institute & Temple University), Tianyin Xu (University of Illinois Urbana-Champaign)
  • MeshRT: Compile-Time Governed Wafer-Scale Runtime for Low-Latency High-Throughput Inference
    Congjie He, Le Xu, Zhan Lu, Yeqi Huang, Haocheng Xiao, Cheng Deng (University of Edinburgh), Lingxiao Ma, Ziming Miao, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)
  • Multi-LLM Serving at Production Scale
    Tianbao Zhou (Peking University), Yi Wang (JD Company), Yu Zhou (UCAS), Zirui Liu, Zhiming Wang, Yebo Peng (Peking University), Yongfu Wang (USTC), Yi Zhang, Jinrun Yin, Kemeng Tian (Peking University), Fangcheng Fu (SJTU), Tongxuan Liu, Tao Peng (JD Company), Tong Yang, Bin Cui, Xupeng Miao (Peking University), Ke Zhang (JD Company)
  • Observability-Driven Tiered Memory for Colocated Workloads
    Hanchen Xu, Berkay Inceisci, Hao Li, Zhenyu Zhang, Huaicheng Li (Virginia Tech)
  • On-site, Non-speculative Failure Diagnosis with CLODS
    Rishikesh Devsot (YScope), Yi Fan Yu, ChenXing Yang, Ellen Shi (University of Toronto), Ding Yuan (University of Toronto and YScope)
  • Oscar: Resilient Privacy Budgeting Across Untrusted Web Domains
    Pierre Tholoniat, Alison Caulfield, Giorgio Cavicchioli, Mark Chen (Columbia University), Benjamin Case (Meta Inc.), Asaf Cidon, Roxana Geambasu (Columbia University), Mathias Lécuyer (University of British Columbia), Martin Thomson (Mozilla)
  • PirateShip: Append-Only Ledgers for (Mostly) Trusted Execution Environments
    Shubham Mishra (University of California, Berkeley), João Gonçalves (INESC-ID & IST U. Lisboa), Chawinphat Tankuranand, Natacha Crooks, Neil Giridharan (UC Berkeley), Heidi Howard, Chris Jensen (Azure Research, Microsoft)
  • ProbeFS: Hierarchical DNA File Systems via Biochemical Content Addressability and Parallelism
    Ruihan Li, Yuankun Zhang, Mingkai Dong, Yaya Hao, Fei Wang, Chunhai Fan, Haibo Chen (Shanghai Jiao Tong University)
  • QProf: Fleetwide Transitive Cost Profiling of Warehouse-Scale Services
    Sam (Likun) Xi, Ali Sheikh, Alexey Alexandrov, Ning Wang, Vance Lankhaar, Tipp Moseley, Parthasarathy Ranganathan (Google)
  • SANDHI: Fine-grained Merging for Memory Efficient Multi-Model Serving
    Vima Gupta, Oytun Kuday Duran, Nandan Suresh Meda, Ikhyun An (Georgia Institute of Technology), Ganesh Ananthanarayanan (Microsoft), Anand Iyer (Georgia Institute of Technology)
  • Scalable Context Orchestration for Serving LLMs Over Voice
    Linyi Jiang (Shanghai Jiao Tong University, AgenticSys), Silvery D. Fu (AgenticSys), Yifei Zhu (Shanghai Jiao Tong University)
  • Scaling Weight Transfer in LLM RL Training with Reference-Oriented Storage
    Chenhao Ye (University of Wisconsin–Madison), Huaizheng Zhang, Mingcong Han, Baoquan Zhong, Xiang Li, Qixiang Chen, Xinyi Zhang, W. Zhang, Kaihua Jiang, Wang Zhang, Sun He, Wencong Xiao (ByteDance Seed), Andrea Arpaci-Dusseau, Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
  • Scheduling Linux Threads under I/O Chiplet Wall Using cSwitch
    Seunghyun An, Joontaek Oh, Ming Liu (University of Wisconsin-Madison)
  • Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients
    Austin Li, Daniel Lee (Cornell University), Florian Suri-Payer (Cornell University / Databricks), Lorenzo Alvisi (Cornell University), Natacha Crooks (UC Berkeley)
  • Skill VM: Write Once, Run Everywhere Efficiently
    Le Chen, Erhu Feng, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
  • Smaran: Serving Authenticated Time Travel Queries
    Asim Nepal, Shistata Subedi (University of Oregon), Shubham Mishra (University of California, Berkeley), Suyash Gupta (University of Oregon), Aniket Kate (Purdue University), Hein Meling (University of Stavanger)
  • StarfishOS: Revisiting Single System Image on CXL with State-partitioned Microkernel
    Fangnuo Wu, Jingsheng Yan, Mingkai Dong, Wenjun Cai, Jingwei Xu, Tong Xin, Haibo Chen (Shanghai Jiao Tong University)
  • State-Aware Fuzzing of JavaScript Engines with LLM-Guided Instrumentation
    Wai Kin Wong, Dongwei Xiao (Hong Kong University of Science and Technology), Anthony Cheuk Tung LAI (VX Research Limited), Ping Fan Ke (Singapore Management University), Shuai Wang (Hong Kong University of Science and Technology)
  • Supporting Agents on Streaming Data via a Forkable Shared Log
    Shreesha G. Bhat, Tony Hong, Michael A Noguera, Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign)
  • SysX: A unified analytics engine for secure multiparty computation
    Muhammad Faisal, Alessandra Lanz, Sam Buxbaum, Adam Godel, Vasiliki Kalavri, Mayank Varia, John Liagouris (Boston University)
  • Tamias: Feedback-Guided Systematic Concurrency Exploration for Transparent Distributed System Fuzzing
    Congyu Liu, Yaoxu Song, Pedro Fonseca, Yongle Zhang (Purdue University)
  • Taming Dynamism on GPUs: Cross-SM Kernel Fusion via SM Cooperation and Just-in-Time Reduction
    Jingkai He, Guangda Sun, TianJian Li, Dong Du, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
  • Taming Inference Workloads at Global Scale: Foundation Model Serving in SystemX
    Pratik Pankaj Raichura, Somasundaram Perianayagam, Rama Krishna Sandeep Pokkunuri, Divya Jain, Christopher Greenwood (Amazon Web Services)
  • TensorDex: A Compact, Tensor-Centric Storage System for Modern AI Models
    Tingfeng Lan, Zirui Wang (University of Virginia), Yunjia Zheng (Harvard University), Zhaoyuan Su (University of Virginia), Juncheng Yang (Harvard University), Yue Cheng (University of Virginia)
  • Testing Custom Control Planes Without the Cluster
    Tim Goodwin, Lindsey Kuper, Andi Quinn (University of California, Santa Cruz)
  • TuxBot: Semantic-Aware Online OS Tuning with LLMs
    Georgios Liargkovas, Mihir Nitin Joshi (Columbia University), Hubertus Franke (IBM Research), Kostis Kaffes (Columbia University)
  • Validating a Production Cloud Object Store with Lightweight Formal Methods
    Rajeev Joshi, Bernhard Kragl, Vimuth Fernando, Sarek Skotam, Jake Wires, Matthew Russo, Colin Walker (Amazon Web Services)
  • Validating Rust Compilers with Trait-Type Constraint Graph
    Xin Lai, Ming WEN, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology)
  • Verifying a high-performance distributed transaction system using permissioned state machines
    Yun-Sheng Chang (MIT), Joseph Tassarotti (New York University), Frans Kaashoek, Nickolai Zeldovich (MIT)
  • VoliStorM: A crash-consistent I/O cache with two kernels instead of two caches
    Jana Toljaga (Inria Saclay, Télécom SudParis - Institut Polytechnique de Paris), Nicolas Derumigny (Télécom SudParis), Tara Aggoun (Télécom SudParis, Inria Saclay, Institut Polytechnique de Paris), Mathieu Bacou (Samovar, Télécom SudParis, Institut Polytechnique de Paris), Gaël Thomas (Inria Saclay)
  • Wavel: A Fast and Efficient Compilation System for Wafer-Scale Accelerators
    Yeqi Huang, Congjie He, Haocheng Xiao, Yanwei Ye, Yi-Chieh Wang, Boyao Song, Yangshen Deng (University of Edinburgh), Ziming Miao, Lingxiao Ma, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)
  • XTRA: Unifying Cache Coherence and Concurrency Control for Distributed Transactions in a CXL Pod
    Zhijun Yang, Yu Hua, Ming Zhang, Menglei Chen, Xumin Chen, Aoyang Tong (Huazhong University of Science and Technology)
  • You Can Always Get What You Want: CPU Virtualization Made Fast and Free
    Yun Wang (Shanghai Jiao Tong University), Xingguo Jia (Alibaba Cloud), Ben Luo (Alibaba Group), Kenan Liu, Shengdong Dai, Jingdong Han, Weihao Chen (Alibaba Cloud), Xingzi Yu, Chenggang Wu (Shanghai Jiao Tong University), Yibin Shen, Jiesheng Wu (Alibaba Cloud), Tao Song, Zhengwei Qi, Haibing Guan (Shanghai Jiao Tong University)