| 08:00 |
Registration desk opens |
| 08:30 – 08:50 |
Opening remarks |
| 08:50 – 10:10 |
Chair: Shivaram Venkataraman (University of Wisconsin -- Madison)
- Janus: Multi-LLM Serving at Production Scale [paper]
Tianbao Zhou (Peking University), Yi Wang (JD Company), Yu Zhou (UCAS), Zirui Liu, Zhiming Wang, Yebo Peng (Peking University), Yongfu Wang (USTC), Yi Zhang, Jinrun Yin, Kemeng Tian (Peking University), Fangcheng Fu (SJTU), Tongxuan Liu, Tao Peng (JD Company), Tong Yang, Bin Cui, Xupeng Miao (Peking University), Ke Zhang (JD Company)
- SANDHI: Fine-grained Merging for Memory Efficient Multi-Model Serving [paper]
Vima Gupta, Oytun Kuday Duran, Nandan Suresh Meda, Ikhyun An (Georgia Institute of Technology), Ganesh Ananthanarayanan (Microsoft), Anand Iyer (Georgia Institute of Technology)
- Batched in Back: Characterizing and Optimizing Offline LLM Inference in Production with ACDC [paper]
Leping Yang (Shanghai Jiao Tong University and Alibaba Group), Xue Li, Kun Qian (Alibaba Group), Erci Xu (Shanghai Jiao Tong University), Mingzhen Han, Haoran Zhu, Tao He, Zuolong Yin, Ennan Zhai, Wenyuan Yu, Jingren Zhou (Alibaba Group), Guangtao Xue (Shanghai Jiao Tong University)
- Taming Inference Workloads at Global Scale: Foundation Model Serving in Amazon Bedrock [paper]
Pratik Pankaj Raichura, Somu Perianayagam, Rama Krishna Sandeep Pokkunuri, Divya Jain (Amazon Web Services)
- Beyond Utilization: Energy-Conscious GPU Sharing for Inference Serving [paper]
Prasoon Sinha, Dimitrios Liakopoulos, Nathan Lemma, Neeraja J. Yadwadkar (The University of Texas at Austin)
|
| 10:10 – 10:40 |
Coffee break |
| 10:40 – 12:00 |
Chair: Emmett Witchel (The University of Texas at Austin)
- Big Bird: Resilient Privacy Budgeting Across Untrusted Web Domains [paper]
Pierre Tholoniat, Alison Caulfield, Giorgio Cavicchioli, Mark Chen (Columbia University), Benjamin Case (Meta Inc.), Asaf Cidon, Roxana Geambasu (Columbia University), Mathias Lécuyer (University of British Columbia), Martin Thomson (Mozilla)
- Cohort: Decentralized PIR [paper]
Jonathan Weiss, Yossi Gilad (The Hebrew University of Jerusalem)
- CryptDough: A unified analytics engine for secure multiparty computation [paper]
Muhammad Faisal, Alessandra Lanz, Sam Buxbaum, Adam Godel, Vasiliki Kalavri, Mayank Varia, John Liagouris (Boston University)
- DISCO*: DIstributed and SCalable Oblivious Joins and Oblivious Primitives [paper]
Apostolos Mavrogiannakis (University of California, Santa Cruz), Xian Wang (Hong Kong University of Science and Technology), Ioannis Demertzis (University of California, Santa Cruz), Dimitrios Papadopoulos (Hong Kong University of Science & Technology), Minos Garofalakis (ATHENA Research Center & Technical University of Crete)
- Cerium: A Multi-GPU Framework for Terabyte-Scale Encrypted Inference [paper]
Siddharth Jayashankar (Carnegie Mellon University), Joshua Kim (University of Texas at Austin), Michael B. Sullivan (NVIDIA), Wenting Zheng, Dimitrios Skarlatos (Carnegie Mellon University)
|
| 12:00 – 13:30 |
Lunch break (Veduta Restaurant) |
| 13:30 – 15:10 |
Chair: Sara McAllister (University of Wisconsin -- Madison)
- Borges: A Low-Latency Distributed Shared Log on a CXL Memory/SSD Hybrid [paper]
Haowei Chen, Yiming Xiang (The University of Texas at Austin), Zhipeng Jia (Anthropic PBC), Yan Sun, Nam Sung Kim (UIUC), Emmett Witchel (The University of Texas at Austin)
- Disk-Based LSMs: An Unexpectedly Good Index for Partly Coherent CXL Memory [paper]
Kiran Hombal, Jiyu Hu (University of Illinois Urbana-Champaign), Marcos K. Aguilera (NVIDIA), Ramnatthan Alagappan, Aishwarya Ganesan (University of Illinois Urbana-Champaign)
- StarfishOS: Revisiting Single System Image on CXL with State-partitioned Microkernel [paper]
Fangnuo Wu (Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University), Jingsheng Yan, Mingkai Dong, Wenjun Cai (Shanghai Jiao Tong University), Jingwei Xu (Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University), Tong Xin, Haibo Chen (Shanghai Jiao Tong University)
- XTRA: Unifying Cache Coherence and Concurrency Control for Distributed Transactions in a CXL Pod [paper]
Zhijun Yang, Yu Hua, Ming Zhang, Menglei Chen, Xumin Chen, Aoyang Tong (Huazhong University of Science and Technology)
- Scheduling Linux Threads under I/O Chiplet Wall Using cSwitch [paper]
Seunghyun An, Joontaek Oh, Ming Liu (University of Wisconsin-Madison)
- Tierce: Observability-Driven Tiered Memory Management for Colocated Workloads [paper]
Hanchen Xu, Berkay Inceisci, Hao Li, Zhenyu Zhang, Huaicheng Li (Virginia Tech)
|
| 15:10 – 15:40 |
Coffee break |
| 15:40 – 17:30 |
Chair: Hayley LeBlanc (Microsoft Research)
- GAZE: Rearchitecting Log-Structured Filesystem for Garbage Collection on Zoned Namespace Flash Storage [paper]
Juwon Kim, Hwanseok Yoo, Seung Won Yoo (KAIST), Youjip Won (Korea Advanced Institute of Science and Technology)
- ProbeFS: Hierarchical DNA File Systems via Biochemical Content Addressability and Parallelism [paper]
Ruihan Li, Yuankun Zhang, Mingkai Dong, Yaya Hao, Fei Wang, Chunhai Fan, Haibo Chen (Shanghai Jiao Tong University)
- Don't Let AI Agents YOLO Your Files: Information and Control in Agent-Native Filesystems [paper]
Shawn (Wanxiang) Zhong, Junxuan Liao (University of Wisconsin-Madison), Jing Liu (Microsoft Research), Mai Zheng (Iowa State University), Andrea Arpaci-Dusseau (University of Wisconsin-Madison), Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
- TensorDex: A Compact, Tensor-Centric Storage System for Modern AI Models [paper]
Tingfeng Lan, Zirui Wang (University of Virginia), Yunjia Zheng (Harvard University), Zhaoyuan Su (University of Virginia), Juncheng Yang (Harvard University), Yue Cheng (University of Virginia)
- VoliStorM: A Crash-Consistent I/O Cache with Two Kernels Instead of Two Caches [paper]
Jana Toljaga, Nicolas Derumigny, Tara Aggoun, Mathieu Bacou, Gaël Thomas (Samovar, Inria, Télécom SudParis, Institut Polytechnique de Paris)
- AgileLog: A Forkable Shared Log for Agents on Data Streams [paper]
Shreesha G. Bhat, Tony Hong, Michael A Noguera, Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign)
|
| 17:30 – 19:30 |
(SRC) Posters + Drinks + Finger food
Chairs: David Schall and Lluis Vilanova
|
| 08:00 |
Registration desk opens |
| 08:30 – 10:10 |
Chair: Malte Schwarzkopf (Brown University)
- Computation is Fast, Use Threadlet! [paper]
Yiming Yao, Xiaohe Qin (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)), Yi Fan (Peking University), Yuanlong Li (EPFL), Kang Hu, Liujia Li (Peking University), Xiaolin Wang, Tao Xie (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)), Zhenlin Wang (Michigan Technological University), Yuval Tamir (UCLA), Yingwei Luo, Diyu Zhou (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC))
- It's the Kernel's Fault! Custom Page Fault Handling With bpf_fault [paper]
Tal Zussman, Riju Dey, Hasan Zengin, Yiming Fang (Columbia University), David Hildenbrand (Technical University of Munich and Arm Germany GmbH), Asaf Cidon (Columbia University)
- MCon: Building an Elastic Cloud for Android Applications with Framework Consolidation [paper]
Jiaxing Qiu, Zijie Zhou, Zhenhua Li, Hongyi Wang, Zizhang Liu, Yunhao Liu (Tsinghua University), Yumeng Liang (China Telecom Cloud Computing Research Institute), Jie Wu (China Telecom Cloud Computing Research Institute & Temple University), Wen Xia (Harbin Institute of Technology, Shenzhen), Tianyin Xu (University of Illinois Urbana-Champaign)
- Skill VM: Write Once, Run Everywhere Efficiently [paper]
Le Chen, Erhu Feng, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
- Turning Linux into a High-Performance Library OS with Flux [paper]
Kaifu Tian, Youjie Zheng, Yiren Zhang, Yuyang You, Keyang Hu (Tsinghua University), Kang Chen (Peking University, Tsinghua University), Yu Chen (Tsinghua University)
- You Can Always Get What You Want: CPU Virtualization Made Fast and Free [paper]
Yun Wang (Shanghai Jiao Tong University), Xingguo Jia, Ben Luo, Kenan Liu, Shengdong Dai, Jingdong Han, Weihao Chen (Alibaba Group), Xingzi Yu, Chenggang Wu (Shanghai Jiao Tong University), Yibin Shen, Jiesheng Wu (Alibaba Group), Tao Song, Zhengwei Qi, Haibing Guan (Shanghai Jiao Tong University)
|
| 10:10 – 10:40 |
Coffee break |
| 10:40 – 12:00 |
Chair: Yubin Xia (Shanghai Jiaotong University)
- DiFlow: A System for Micro-Serving Text-to-Image Diffusion Workflows [paper]
Lingyun Yang (Hong Kong University of Science and Technology & Alibaba Group & Shanghai Jiao Tong University), Suyi Li, Tianyu Feng, Xiaoxiao Jiang (Hong Kong University of Science and Technology), Zhipeng Di, Weiyi Lu, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang (Alibaba Group), Wei Wang (Hong Kong University of Science and Technology)
- LMTracer: Fine-Grained and Real-Time Performance Profiling for Production LLM Systems [paper]
Wei Liu (Rank Computing and Tsinghua University), Yongchao He, Bohan Zhao, Hongyi Wang, Zhenhua Li (Tsinghua University), Junping Zhao (Rank Computing)
- Scalable Context Orchestration for Serving LLMs Over Voice [paper]
Linyi Jiang (Shanghai Jiao Tong University, AgenticSys), Silvery D. Fu (AgenticSys), Yifei Zhu (Shanghai Jiao Tong University)
- TuxBot: Semantic-Aware Online OS Tuning with LLMs [paper]
Georgios Liargkovas, Mihir Nitin Joshi (Columbia University), Hubertus Franke (IBM Research), Kostis Kaffes (Columbia University)
- StreamEP: Straggler-Tolerant MoE Decoding without Communication Barriers [paper]
Yizhuo Liang, Shaoyu Wang (University of Southern California), Jaeyong Song (Seoul National University), Yanqi Zhou (Google DeepMind), Geon-Woo Kim (The University of Texas at Austin), Guangrong He, Seo Jin Park (University of Southern California)
|
| 12:00 – 13:30 |
Lunch break (Veduta Restaurant) |
| 13:30 – 15:10 |
Chair: Nickolai Zeldovich (MIT)
- I3DP: Neuro-symbolic Inductive Invariant Inference for Distributed Protocols [paper]
Weining Cao, Guangyuan Wu, Yuan Yao (Nanjing University), Hengfeng Wei (Hunan University), Taolue Chen (Birkbeck, University of London), Xiaoxing Ma (Nanjing University)
- Lion: Modular Verification of Async Runtime Liveness [paper]
Ti Zhou, Zihao Zhang, Omar Chowdhury, Shuai Mu (Stony Brook University)
- Sockeye: Bug-finding and proofs for platform configurations and hardware based on reference manuals [paper]
Ben Fiedler, Sedan Abdelgawad, Teymour Aldridge, Viktor Fukala, Jan Häussermann, Gamal Hassan, Lars Leuthold, Konstantin Lucny, Max Wierse, Samuel Gruetter, Timothy Roscoe (ETH Zurich)
- Verifying a high-performance distributed transaction system using permissioned state machines [paper]
Yun-Sheng Chang (MIT), Joseph Tassarotti (New York University), Frans Kaashoek, Nickolai Zeldovich (MIT)
- Validating a Production Cloud Object Store with Lightweight Formal Methods [paper]
Vimuth Fernando, Rajeev Joshi, Bernhard Kragl (Amazon Web Services), Julien Mascart (Meta), Matthew Russo, Sarek Skotåm, Colin Walker, Jake Wires (Amazon Web Services)
- Welder: Compositional Liveness Verification of Cluster Control Planes [paper]
Zhizhen Cathy Cai, Nikhil Date, Jiawei Tyler Gu (University of Illinois Urbana-Champaign), Cody Rivera, Tej Chajed (University of Wisconsin-Madison), Oded Padon (Weizmann Institute of Science), Tianyin Xu (University of Illinois Urbana-Champaign), Xudong Sun (University of Toronto)
|
| 15:10 – 15:40 |
Coffee break |
| 15:40 – 16:40 |
Chairs: Michal Friedman and Ana Klimovic
|
| 16:45 – 17:30 |
Invited talks from TOCS (45 mins)
- CCKit: An Open-Source Toolkit for Cache Coherent Accelerators
Abishek Ramdas, David Cock, Michael Giardino, Dario Korolija, Anastasiia Ruzhanskaia, Daniel Schwyn, Adam Turowski, Gustavo Alonso, Timothy Roscoe (ETH Zürich)
- EIDS: A Cloud Intrusion Detection System with HighPerformance and Maintainability
Xiaokang Hu (Alibaba Group), Zhichao Hua (Shanghai Jiao Tong University), Naixuan Guan, Yun Xu, Yibin Shen (Alibaba Group), Yang Yu, Zeyu Mi, Yubin Xia (Shanghai Jiao Tong University), Ming Wang, Jiesheng Wu (Alibaba Group)
- Making Hardware Features Bespoke: Operating SystemSupport for Bes-Mode Processes
Bicheng Yang, Yuanpei Wu, Rongchuan Liu, Dong Du, Yubin Xia, Binyu Zang, Haibo Chen(Institute of Parallel and Distributed Systems, Shanghai Jiaotong University)
|
| 17:30 – 18:30 |
Business Meeting (60 mins)
|
| 19:00 – 22:00 |
Banquet (Smetana Hall) |
| 08:00 |
Registration desk opens |
| 08:30 – 10:10 |
Chair: Rodrigo Rodrigues (Instituto Superior Técnico [ULisboa] / INESC-ID)
- PirateShip: Append-Only Ledgers for (Mostly) Trusted Execution Environments [paper]
Shubham Mishra (University of California, Berkeley), João Gonçalves (INESC-ID & IST U. Lisboa), Chawinphat Tankuranand, Natacha Crooks, Neil Giridharan (UC Berkeley), Heidi Howard, Chris Jensen (Azure Research, Microsoft)
- DDB: Source-Level Interactive Debugging for Distributed Applications [paper]
Yibo Yan, Junzhou He, Seo Jin Park (University of Southern California)
- Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients [paper]
Austin T. Li, Daniel H. Lee, Lorenzo Alvisi (Cornell University), Natacha Crooks (UC Berkeley), Florian Suri-Payer (Cornell University / Databricks)
- Smaran: Serving Authenticated Time Travel Queries [paper]
Asim Nepal, Shistata Subedi (University of Oregon), Shubham Mishra (University of California, Berkeley), Suyash Gupta (University of Oregon), Aniket Kate (Purdue University), Hein Meling (University of Stavanger)
- RPCShield: Defending Microservices Against Cascading Failures [paper]
Milind Chabbi, Sonal Mahajan (Uber Technologies), Ivan Beschastnikh (University of British Columbia), René Just (University of Washington), Yuxin Wang, Yufan Xu (Uber Technologies), Elton Pinto (Georgia Institute of Technology), Seemanta Saha (Uber Technologies), Manu Sridharan (University of California, Riverside), Abhishek Jha, Sandeep Koushik Sheshadri, Mayank Bansal (Uber Technologies)
- QProf: Fleetwide Transitive Cost Profiling of Warehouse-Scale Services [paper]
Sam (Likun) Xi, Alexey Alexandrov, Ali Sheikh, Ning Wang, Vance Lankhaar, Tipp Moseley, Parthasarathy Ranganathan (Google)
|
| 10:10 – 10:40 |
Coffee break |
| 10:40 – 12:00 |
Chair: Peter Pietzuch (Imperial College London)
- Anchor: Mitigating GPU Shallow Disruptions with Decoupled Memory [paper]
Haoyi Ma, Shiwei Gao (Tsinghua University), Youmin Chen (Shanghai Jiao Tong University), Junrong Huang, Youyou Lu, Jiwu Shu (Tsinghua University)
- Linux AGX: An Adaptive GPU eXtension to Linux Fair Scheduling for Physical AI and Robotic Systems [paper]
Soheil Shirvani, Cong Liu (University of California - Riverside)
- TensorHub: Scalable and Elastic Weight Transfer for LLM RL Training [paper]
Chenhao Ye (University of Wisconsin–Madison), Huaizheng Zhang, Mingcong Han, Baoquan Zhong, Xiang Li, Qixiang Chen, Xinyi Zhang, Weidong Zhang, Kaihua Jiang, Wang Zhang, Sun He, Wencong Xiao (ByteDance Seed), Andrea Arpaci-Dusseau, Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
- A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with CrystalLLM [paper]
Shaoke Xi, ChonLam Lao (Alibaba Group), Boyi Jia (Shanghai Jiao Tong University and Alibaba Group), Jiaqi Gao, Zhipeng Zhang, Jiamin Cao (Alibaba Group), Brian Sutioso (Harvard University), Erci Xu (Shanghai Jiao Tong University), Minlan Yu (Harvard University), Kui Ren (Zhejiang University), Yong Li, Zhengping Qian, Ennan Zhai, Jingren Zhou (Alibaba Group)
- LLM-42: Enabling Determinism in LLM Inference with Verified Speculation [paper]
Raja Gond (Microsoft Research), Aditya K Kamath (University of Washington), Ramachandran Ramjee, Ashish Panwar (Microsoft Research)
|
| 12:00 – 13:30 |
Lunch break (Veduta Restaurant) |
| 13:30 – 15:10 |
Chair: Andi Quinn (University of California Santa Cruz)
- Ahead-of-time Analysis of Shell Program Effects [paper]
Lukas Lazarek, Evangelos Lamprou, George Kapetanakis, Anirudh Narsipur, Eric Zhao, Zhiwen Zheng (Brown University), Michael Greenberg (Stevens Institute of Technology), Konstantinos Kallas (University of California, Los Angeles), Nikos Vasilakis (Brown University)
- Testing Custom Control Planes Without the Cluster [paper]
Tim Goodwin, Lindsey Kuper, Andi Quinn (University of California, Santa Cruz)
- On-site, Non-speculative Failure Diagnosis with CLODS [paper]
Rishikesh Devsot (YScope); Yi Fan Yu (University of Toronto); ChenXing Yang (University of Toronto and YScope); Ellen Shi (University of Toronto); Ding Yuan (University of Toronto and YScope)
- State-Aware Fuzzing of JavaScript Engines with LLM-Guided Instrumentation [paper]
Wai Kin Wong (Hong Kong University of Science and Technology), Dongwei Xiao (The Hong Kong University of Science and Technology), Anthony Cheuk Tung Lai (VX Research Limited), Ping Fan Ke (Singapore Management University), Shuai Wang (Hong Kong University of Science and Technology)
- Tamias: Feedback-Guided Systematic Concurrency Exploration for Transparent Distributed System Fuzzing [paper]
Congyu Liu, Yaoxu Song, Pedro Fonseca, Yongle Zhang (Purdue University)
- Validating Rust Compilers with Trait-Type Constraint Graph [paper]
Xin Lai, Ming Wen, Xiaofei Liao, Hai Jin (Huazhong University of Science and Technology)
|
| 15:10 – 15:40 |
Coffee break |
| 15:40 – 17:20 |
Chair: Jing Liu (Microsoft Research Asia)
- Efficient GPU Multitasking with Morphable Kernels [paper]
Tingxu Ren, Ruwen Fan, Hao Guo, Minhui Xie, Shiwei Gao, Jiwu Shu, Youyou Lu (Tsinghua University)
- Ave: Guiding Agentic GPU Optimization Using Data-Flow Invariants [paper]
Haohui Mai (HKUST), Xiaoyan Guo (University of Chinese Academy of Sciences, China), Xiangyun Ding (University of California, Riverside), Daifeng Li (University of Science and Technology of China), Qiuchu Yu, Chenzhun Guo (University of Chinese Academy of Sciences, China), Cong Wang (Tsinghua University), Jiacheng Zhao (University of Chinese Academy of Sciences, China), Christos Kozyrakis (Stanford University), Binhang Yuan (HKUST)
- Taming Dynamism on GPUs: Cross-SM Kernel Fusion via SM Cooperation and Just-in-Time Reduction [paper]
Jingkai He, Guangda Sun, TianJian Li, Dong Du, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
- M2K: Making the Model-Kernel Interface Explicit for Reliable CUDA Kernel Verification [paper]
Mengting He, Shihao Xia (The Pennsylvania State University), Haomin Jia (SKLP, Institute of Computing Technology, Chinese Academy of Sciences), Wenfei Wu (Peking University), Linhai Song (SKLP, Institute of Computing Technology, Chinese Academy of Sciences)
- Wavel: A Fast and Efficient Compilation System for Wafer-Scale Accelerators [paper]
Yeqi Huang, Congjie He, Haocheng Xiao, Yanwei Ye, Yi-Chieh Wang, Boyao Song, Yangshen Deng (University of Edinburgh), Ziming Miao, Lingxiao Ma, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)
- MeshRT: Compile-Time Governed Wafer-Scale Runtime for Low-Latency High-Throughput Inference [paper]
Congjie He, Le Xu, Zhan Lu, Yeqi Huang, Haocheng Xiao, Cheng Deng (University of Edinburgh), Lingxiao Ma, Ziming Miao, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)
|