001 ARES: Adaptive Reasoning-Effort Steering for PPA- and Cost-Aware RTL Optimization with LLM Agents arXiv Paper Stef Cuyckens et al. Yesterday 002 Demystifying DRAM Read Disturbance: Bridging the Gap Between Experimental Characterization and Device-Level Modeling of RowHammer and RowPress Phenomena arXiv Paper Haocong Luo et al. Yesterday 003 GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference arXiv Paper Sangjin Kim et al. Yesterday 004 LightRot: A Light-Weighted Rotation Scheme and Architecture for Accurate Low-Bit Large Language Model Inference arXiv Paper Sangjin Kim et al. Yesterday 005 Nanoparticle Networks for Neuromorphic Computing arXiv Paper Jonas Mensing et al. Yesterday 006 Investigating reservoir computing for branch predictionin pipelined processors using emerging CMOS memristor devices arXiv Paper Harvey Samuel George Johnson et al. 2 days ago 007 LLMET: Enabling Cross-Layer Evaluation of Emerging M3D Memories for Energy-Efficient LLM Serving arXiv Paper Ming-Yen Lee et al. 2 days ago 008 At-the-Roofline Sparse Tensor Contractions on Vector Processors for Transformer Inference arXiv Paper Bowen Wang et al. 3 days ago 009 ContractHIL-HLS: Contract-Aligned Multi-Agent Workflow with Hardware-in-the-Loop Feedback for HLS Design arXiv Paper Jingbo Zhang, Haoxiang Sun et al. 3 days ago 010 MDTransformer: A Hardware-Software Co-Design of Mode-Division Photonic Transformer Accelerator with Inverse-Designed Coherent Crossbar arXiv Paper S. Serunjogi, Rachmad Vidya Wicaksana Putra et al. 3 days ago 011 Behavior-Driven Explainability arXiv Paper Caroline Dominik et al. 4 days ago 012 The SpiNNaker2 chip: a many-core platform for flexible and scalable brain-inspired computing arXiv Paper Stefan Scholze et al. 4 days ago 013 ADVERSARIAL: And-Inverter Graph-Assisted Hardware Trojan Detection At Scale arXiv Paper Yaroslav Popryho et al. 5 days ago 014 SPARC: Automated Root-Cause Analysis of Pre-Silicon Power Side-Channel Leakage in the Processor Design Flow arXiv Paper Andrija Nešković et al. 6 days ago 015 FusionML: Prefill, Not Decode - Mechanism and Boundaries of CPU+GPU Co-Execution on Unified-Memory Apple Silicon arXiv Paper Om Mohite 7 days ago 016 HiKV: Hierarchical Importance-Aware KV Cache with Hardware Acceleration for LLM Decoding arXiv Paper Chao Fang, Jun Yin et al. 7 days ago 017 Multi-primitive in-memory computing for Monte Carlo tree search arXiv Paper Tergel Molom-Ochir et al. 7 days ago 018 Optimizing Transformer Neural Network for Real-Time Outlier Detection on FPGAs arXiv Paper Ilia Sobakinskikh et al. 7 days ago 019 Sparse by Command: Task-Conditional Compute Skipping for Multi-Task Inference Accelerators arXiv Paper Afzal Ahmad, Gaoyu Mao et al. 7 days ago 020 Unified Static-Dynamic Pruning for Efficient LLM Inference arXiv Paper Deyu Yang, Rundong Wei et al. 7 days ago 021 Benchmarking LLMs for Verilog Design Flows arXiv Paper Angshuman Chakravertty et al. Jul 23 022 DRC-Aid: Design-Rule Correction via Agentic Framework utilizing Inference-Time Large Language Models arXiv Paper Anushka Mukherjee et al. Jul 23 023 Hardware-Software Co-Design for Float16 On-Device Training on RISC-V Single-Core arXiv Paper Benjamin Hubinet, P. Moellic et al. Jul 23 024 RED-PIM: Reducing Data Movement for Transformers using Processing-in-Memory arXiv Paper Alexandru Meterez, Pranav Ajit Nair et al. Jul 23 025 AlphaRoute: Large Language Models as Semantic Optimizers for Multi-Objective Routing arXiv Paper Kabir Murjani, Mishri Bhavsar et al. Jul 22 026 Formal Foundations for Known Good Reliable Die Screening in Chiplet-Based AI Systems-on-Chip arXiv Paper Prashanthi Metku, Chandra Gandu Jul 22 027 Leveraging ECRAM for Edge Continual Learning arXiv Paper Nabila Tasnim, Haoran Liu et al. Jul 22 028 WaveformQA: Benchmarking LLM Temporal Reasoning on Digital Waveforms arXiv Paper Yichuan Liu, Daniel G Cummings et al. Jul 22 029 BaseRT: Advancing Best-in-Class LLM Inference with Apple M5 Neural Accelerators arXiv Paper Fabian Waschkowski, Prabod Rathnayaka et al. Jul 21 030 From Bit-Position Sensitivity to Unequal Error Protection for DNN Inference Memory arXiv Paper Muhammad Husnain Mubarik, Karthik Mohan Kumar et al. Jul 21 031 BRIM: Workload-Balanced Dual-Sided Bit-Serial Sparse Inference Accelerator arXiv Paper Varun Manjunath, Ruokai Yin et al. Jul 20 032 Can AI Agents Really Complete RTL-to-GDS? Lessons from Benchmarking Tool-Interactive EDA Workflows arXiv Paper Jinyuan Deng, Zhengrui Chen et al. Jul 20 033 D-NOVA: In-Storage Retrieval Accelerator via Dual-Bound 3D NAND-Optimized Similarity Search with Vector Adaptation arXiv Paper Chang Eun Song, Sumukh Pinge et al. Jul 20 034 Empowering On-Device Model Adaptation with an Edge AI Inference Accelerator arXiv Paper M. Piechocki, Alessandro Capotondi et al. Jul 20 035 Hardware Mechanisms to Dynamically Throttle AI Performance arXiv Paper Haiyue Ma, Lauren Malek et al. Jul 20 036 Isolation Failure From Shared Storage: Characterizing and Exploiting Page-Cache SCA Leakage Across Containers and VMs arXiv Paper Alon Abudraham, Xingyu Chen et al. Jul 20 037 Opto-ViT-v2: Noise-Resilient On-Chip Fine-Tuning for Photonic Near-Sensor Vision Transformer Accelerators arXiv Paper Xuming Chen et al. Jul 20 038 PIP-NTT: Towards a Scalable Memory-Parallelized Accelerator for Iterative NTT in PQC arXiv Paper Malik Imran, A. Khalid et al. Jul 20 039 PRISM: Sensitivity-Aware PolynoMial PRuning for EffIcient Neural Network Encryption arXiv Paper Sahaj Majavdia, Mahdi Taheri Jul 20 040 ThAME: 3D Memory-Enabled Heterogeneous Accelerator for LLM Mixture of Experts arXiv Paper Pratyush Dhingra, Pramit Kumar Pal et al. Jul 19 041 ThRIve: Thermally Robust CNN Inference via Low-Rank Adaptation in Heterogeneous PIM Architectures arXiv Paper Vibhanshu Sharma, Pratyush Dhingra et al. Jul 19 042 SABLE: Minimalist Instruction-Level Authenticated Encryption for Constrained Confidential Computing arXiv Paper Hamid Noori, Carlton Shepherd Jul 18 043 CoG-Guided Weight Correction for Fault-Tolerant Deep Neural Networks arXiv Paper Bahram Parchekani, Samira Nazari et al. Jul 17 044 Mitigating Compiler Fusion-Induced Power Bursts in Mobile NPU Inference as the Battery Depletes arXiv Paper Ryoga Yuzawa, Masayoshi Tomizuka Jul 17 045 RTL-Sequencer: Towards Scalable RTL Timing Prediction with the Sequence-based Paradigm arXiv Paper Ziyan Guo, Wenji Fang et al. Jul 17 046 Vogls: a Fast Interactive Full-timing Simulator for Pre-silicon Power Side-Channel Analysis arXiv Paper Gijs Burghoorn, I. Buhan et al. Jul 17 047 ExaGEMM: Exploration Framework for CPU-Driven ML Inference via Associative In-Register Computing for Low-Bit GEMM arXiv Paper Hyunwoo Oh, Suyeon Jang et al. Jul 16 048 Lazy Arithmetic using Systolic Arrays for Closing the Verification Gap on Embedded Systems arXiv Paper Taisa Kushner, Ryan McCleeary et al. Jul 16 049 NIFA: Nonlinear IMC enhanced FPGA for efficient ML inference arXiv Paper Jiajun Hu, R. Sunketa et al. Jul 16 050 PolyQ: Codesigning End-to-End Quantization Framework for Scalable Edge CPU LLM Inference arXiv Paper Hyunwoo Oh, Suyeon Jang et al. Jul 16 051 Toward Energy-Efficient and Low-Power Arrhythmia Detection for Wearable Devices arXiv Paper F. Bulten, Yawar Rasheed et al. Jul 16 052 CODA: How to Mitigate ColumnDisturb for (Almost) Free? arXiv Paper Moinuddin K. Qureshi Jul 15 053 Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations arXiv Paper Wenxuan Miao, Haosong Liu et al. Jul 15 054 Lighthouse RL: Sample-Efficient Circuit Optimization via Strategic Reset Points arXiv Paper Mustafa Emre Gursoy, Stefan Uhlich et al. Jul 15 055 Towards Reliable AI-Assisted Analog Design: Template-Constrained LLM Agents for SAR ADC Generation arXiv Paper D. Kochar, Hae-Seung Lee et al. Jul 15 056 A 32-channel event-based bio-signal analog front-end with adaptive delta and pulse frequency encoding arXiv Paper Narayanan Shyam et al. Jul 14 057 Emulated Integrity Replica: Enabling Self-Healing on FPGA SoCs via Hierarchical Twins arXiv Paper Arsalan Ali Malik, Ali Suvizi et al. Jul 14 058 Full-Pipeline Inference Optimization for MiMo-V2.5 Series: Pushing Hybrid SWA Efficiency to the Limit arXiv Paper Xiaomin Liu, Aoxin Ma et al. Jul 14 059 Can LLMs Perform Deep Technical Comprehension of Computer Architecture Papers? arXiv Paper Nishant Aggarwal, A. Dubal et al. Jul 13 060 HiFi-LLP: High-Fidelity, Low-Cost Latency Predictors with Confidence for Robust HW-NAS arXiv Paper Shambhavi Balamuthu Sampath, Behzad Shomali et al. Jul 13