001 Encryption-Compatible Clustered Federated Learning via Distributed Expectation-Maximization over Metadata arXiv Paper Michael Ben Ali et al. Yesterday 002 Learning Color Grading, No Photo Sharing: Federated Aesthetic Preference Learning for Personalized Image Enhancement arXiv Paper Chuanzhi Xu, Ziyuan Tao et al. Yesterday 003 Secure Aggregation for Privacy-Preserving Federated Learning on Clinical EEG Data arXiv Paper Pouya Rajabi et al. Yesterday 004 InferScale: GPU-Native KV Injection for Personalized LLM Serving arXiv Paper Peter Li, Prashant Pandey 2 days ago 005 ServerlessT2I: Efficient Text-to-Image Workflow Serving on a Serverless Platform arXiv Paper Xiaoxiao Jiang, Suyi Li et al. 2 days ago 006 Hermes: Low Tail-Latency Via Prefix Consensus arXiv Paper Alejandro Ranchal-Pedrosa, D. Kang et al. 3 days ago 007 Incast-Free MoE Rate-Based Scheduling arXiv Paper Evyatar Cohen, Jose Yallouz et al. 3 days ago 008 MDTransformer: A Hardware-Software Co-Design of Mode-Division Photonic Transformer Accelerator with Inverse-Designed Coherent Crossbar arXiv Paper S. Serunjogi, Rachmad Vidya Wicaksana Putra et al. 3 days ago 009 Optimistic Verifiable Claims: A Blockchain Protocol for Conditionally Confidential Bidding in Decentralized Manufacturing arXiv Paper Marko Corn, N. Rožman et al. 3 days ago 010 Specula: Scaling formal specifications for autonomous model checking of system code arXiv Paper Q. Cheng, Saad Mohammad Rafid Pial et al. 3 days ago 011 A Sustainable Remote Access Architecture for Digital Inclusion through the Reuse of Discredited TV-BOX Devices arXiv Paper Ítalo Santos, Carlos Eduardo Correa Queiroz et al. 4 days ago 012 Agentic Cloud Decoys: A Deception-Driven Framework for Autonomous Intrusion Investigation arXiv Paper Mohan Manivannan, Dalal N. Alharthi 4 days ago 013 Amortising Trajectory Optimisation for Residual MPC via Implicit Contact Differentiation arXiv Paper Daniel Layeghi, Thomas Corbéres et al. 4 days ago 014 Certified Parallel-in-Time Sinkhorn for Dynamic Entropic Optimal Transport arXiv Paper Xinyang Wen 4 days ago 015 Denial of Deadline: Network-Driven Accuracy Collapse in Distributed Inference Pipelines arXiv Paper Jhonatan Tavori, Gur-Eyal Sela et al. 4 days ago 016 Framework Implementation Maturity in Blockchain-Based Third-Party Compliance Assessment arXiv Paper Jemima Owusu-Tweneboah, Amani Altarawneh et al. 4 days ago 017 SpecBox: Speculative Sandbox Scheduling for Efficient LLM Agent Serving arXiv Paper Yihui Zhang, Tianyu Wo et al. 4 days ago 018 The SpiNNaker2 chip: a many-core platform for flexible and scalable brain-inspired computing arXiv Paper Stefan Scholze, Johannes Partzsch et al. 4 days ago 019 A scalable online machine learning approach for Stock Recommendation arXiv Paper Harsh Nagarkar 6 days ago 020 Gleam: Adaptive Network-Efficient CUDA API Remoting for Cross-Device GPU Sharing over LANs arXiv Paper Zhihao Xu, Hao Zhong et al. 6 days ago 021 X-Stage: An Overlooked Pipeline Stage for Communication-Computation Overlap in DiT Inference arXiv Paper Jianwen Xian, Zhiyuan Xu et al. 6 days ago 022 FusionML: Prefill, Not Decode - Mechanism and Boundaries of CPU+GPU Co-Execution on Unified-Memory Apple Silicon arXiv Paper Om Mohite 7 days ago 023 Optimizing Transformer Neural Network for Real-Time Outlier Detection on FPGAs arXiv Paper Ilia Sobakinskikh, P. Bilokon 7 days ago 024 SLA-Constrained Carbon-Aware Routing in Geo-Distributed Serverless Clouds arXiv Paper Anmol Chaudhary, Rahul Mishra 7 days ago 025 Unified Static-Dynamic Pruning for Efficient LLM Inference arXiv Paper Deyu Yang, Rundong Wei et al. 7 days ago 026 Clustered Edge Intelligence: Beyond Just Convergence of Edge Computing and AI arXiv Paper C. Dehury, Boris Sedlak et al. Jul 23 027 Decentralized Compute on Untrusted Hardware Using Intel TDX and Encrypted CVMs arXiv Paper J. Hurtado Jul 23 028 GLP: A Grassroots, Multiagent, Concurrent, Logic Programming Language for AI arXiv Paper Ehud Shapiro Jul 23 029 Spectral Transformation for Layer-wise Global Rank Discovery in Federated LoRA for Vision Transformers arXiv Paper Hariharan Ramesh, Jyotikrishna Dass Jul 23 030 The Consensus Number of Untraceable Cryptocurrencies arXiv Paper Christian Cachin, David Lehnherr et al. Jul 23 031 A Framework for Reputation Aware Uninorm-driven Consensus Algorithms for Blockchain Networks arXiv Paper Bruno Ramos-Cruz, Javier Andreu-Pérez et al. Jul 22 032 DQAOA-GPT: AI-Accelerated Distributed Quantum Optimization for Combinatorial Problems arXiv Paper Seongmin Kim, A. Rijal et al. Jul 22 033 Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning arXiv Paper Jian Hu, Huiying Li et al. Jul 22 034 BaseRT: Advancing Best-in-Class LLM Inference with Apple M5 Neural Accelerators arXiv Paper Fabian Waschkowski, Prabod Rathnayaka et al. Jul 21 035 Fine-grained Computation-Communication Overlap via Tile-level Signaling and Scheduling for Mixture-of-Experts arXiv Paper Minyu Cui, Anna Wingkvist et al. Jul 21 036 SynPre-FL: Synthetic data-driven pretraining integrated Federated Learning training framework arXiv Paper Akarsh K. Nair, Muhammad Arifur Rahman et al. Jul 21 037 AutoEncoder-Compressed Parallel Split Learning for Pre-trained Model Fine-Tuning arXiv Paper Bas Meuwissen, Vasileios Tsouvalas et al. Jul 20 038 Entanglement geometry separates circuit cutting, classical hardness, and trainability arXiv Paper Maria Gragera Garces, Sabin V. Dragoi et al. Jul 20 039 Mobius Learning: Cyclic Depth Folding in Transformers arXiv Paper Tongtian Zhu Jul 20 040 PRISM: Sensitivity-Aware PolynoMial PRuning for EffIcient Neural Network Encryption arXiv Paper Sahaj Majavdia, Mahdi Taheri Jul 20 041 OrderMoE: An expert similarity driven distributed edge MoE inference arXiv Paper Xin Yuan, Ning Li et al. Jul 19 042 Talaria: Session-Aware Serverless Serving of Hundred-Billion-Parameter LLMs arXiv Paper Utopia Meng, Unicornt Zhao et al. Jul 19 043 Taurus: Accelerating Out-of-Core Graph Neural Network Inference on Billion-Scale Graphs arXiv Paper Pranjal Naman, Yogesh L. Simmhan Jul 19 044 ThAME: 3D Memory-Enabled Heterogeneous Accelerator for LLM Mixture of Experts arXiv Paper Pratyush Dhingra, Pramit Kumar Pal et al. Jul 19 045 The Optimization Trilemma: Efficiency, Comfort and Fairness in Decentralized Multi-agent Coordination arXiv Paper Jovan Nikolic, M. Zuziak et al. Jul 19 046 JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models arXiv Paper Haoran Sun, Wentao Zhang et al. Jul 17 047 Rendering 3D Gaussians on a Graph Processor arXiv Paper Nicholas Fry, Ignacio Alzugaray et al. Jul 17 048 Scalable LLM Agent Tool Access in the Cloud arXiv Paper Mingxin Li, Enge Song et al. Jul 17 049 The Honest Quorum Problem: Epistemic Byzantine Fault Tolerance for Agentic Infrastructure arXiv Paper Junfei He, Deying Yu Jul 17 050 An Auto-Scaling Approach for Serverless Environments Based on a Multi-Expert Consensus Mechanism arXiv Paper Mobina Kashaniyan, M. Ashtiani et al. Jul 16 051 EdgeFaaS: A Function-based Framework for Edge Computing arXiv Paper N. Vadnere, Yu-Ting Wang et al. Jul 16 052 LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget arXiv Paper Changhai Zhou, Kieran Liu et al. Jul 16 053 Stop Means Stop: Measuring and Repairing the Enforcement Gap in Agent-Framework Control Primitives arXiv Paper Sajjad Khan Jul 15 054 The Cost and Network Limits of Space-Based AI Compute arXiv Paper Kees van Berkel Jul 15 055 The Environmental Cost of Digital Sovereignty: Water, Energy, and Emissions Impacts of Sovereign AI Infrastructure in the Global South arXiv Paper Muntaser M Syed, Marius Silaghi et al. Jul 15 056 Agora: Collective and Permissionless Internet-Scale Pretraining of Large Language Models arXiv Paper Gil Avraham, Violetta Shevchenko et al. Jul 14 057 Hybrid multi-objective evolutionary algorithms for service placement in the computing continuum: a comparative study with genetic traceability arXiv Paper Sergi Vivó, Carlos Guerrero et al. Jul 14 058 Less Experts, Faster Decoding: Cost-Aware Speculative Decoding for Mixture-of-Experts arXiv Paper Jincheng Xie, Runheng Liu et al. Jul 14 059 Mixed-Timescale Differential Coding for Downlink Model Broadcast in Wireless Federated Learning arXiv Paper Chung-Hsuan Hu, Zheng Chen et al. Jul 14 060 Privacy Attacks on Stable Marriage arXiv Paper Stephan A. Fahrenkrog-Petersen, Aleksander Figiel et al. Jul 14