001 Motion Planning in Urban Environments via Self-Play Reinforcement Learning OpenAlex Paper Islem Kobbi, Rocha Gonçalves, Tiago et al. Sep 15 002 When to Parallelize Stochastic Exploration of Rare Rewards in Reinforcement Learning OpenAlex Paper Ernesto García, Daniel Mastropietro et al. Aug 31 003 Evaluating Trajectories in Agentic Systems OpenAlex Paper Nagraj Naidu Aug 15 004 Mathematical Foundations of Reinforcement Learning and Control Theory OpenAlex Paper Dr.J. Nagaraj 4 days ago 005 ROEP: A Robotics-Oriented Evaluation Protocol for Deployment-Facing Vision–Language–Action Manipulation Policies OpenAlex Paper Sangwoo Han, Hyunguk Choi 4 days ago 006 Squirrel OS: A Deterministically Governed Probabilistic Neural Mesh (DGPNM) — Technical Paper Suite OpenAlex Paper Leon Long 4 days ago 007 Squirrel OS: A Deterministically Governed Probabilistic Neural Mesh (DGPNM) — Technical Paper Suite OpenAlex Paper Leon Long 4 days ago 008 The Weight of Silence: A Causal Case for Weights Over the Scratchpad in Latent Chess Reasoning OpenAlex Paper Kshirsagar Ishan 4 days ago 009 The Weight of Silence: A Causal Case for Weights Over the Scratchpad in Latent Chess Reasoning OpenAlex Paper Kshirsagar Ishan 4 days ago 010 A Hybrid Owl Search Algorithm with Lévy Flights, Opposition-Based Learning, and Adaptive Memory for Continuous Optimization OpenAlex Paper Awaz Ahmed Shaban, Subhi R. M. Zeebaree 5 days ago 011 Deterministic Spiral-Time Execution Filtering for LLM-Assisted Legged Robots: A MuJoCo Quadruped Proof of Concept OpenAlex Paper Marcel Krüger, Don Feeney 5 days ago 012 Narsi Regression and Narsi Intelligence: A Unified Theoretical Framework for Dynamic Representation Evolution, Recursive Cognitive Adaptation, and Self-Evolving Artificial Intelligence OpenAlex Paper A Chaudhary 5 days ago 013 Narsi Regression and Narsi Intelligence: A Unified Theoretical Framework for Dynamic Representation Evolution, Recursive Cognitive Adaptation, and Self-Evolving Artificial Intelligence OpenAlex Paper A Chaudhary 5 days ago 014 Reinforcement Learning with Verifiable Rewards (RLVR) and GRPO for Reasoning OpenAlex Paper Dheiver Francisco Santos 5 days ago 015 Reinforcement Learning with Verifiable Rewards (RLVR) and GRPO for Reasoning OpenAlex Paper Dheiver Francisco Santos 5 days ago 016 ActionShift: A Benchmark for Hidden Compositional Action-Interface Adaptation in Manipulation OpenAlex Paper Krishi Attri 6 days ago 017 Addressing the Sim-to-Real Gap in Reinforcement Learning for UAVs by Recovering Markovian Properties with Applications to Moving Window Traversal OpenAlex Paper Norhan Mohsen Elocla, Mohamad Chehadeh et al. 6 days ago 018 Impact of Architectural Heterogeneity and Reward Design on Coordination in IPPO-Based Multi-Agent Systems for Sequential SAR Tasks OpenAlex Paper Julia Wróbel, Wojciech Owczarek et al. 6 days ago 019 P3LA: P-Gated Predictive-Policy-Language Architecture OpenAlex Paper Christopher D. Pang 6 days ago 020 P3LA: P-Gated Predictive-Policy-Language Architecture OpenAlex Paper Christopher D. Pang 6 days ago 021 Agreement Without Progress: A Preregistered Null for Multi-Agent Drift Detection OpenAlex Paper Diego Rincon 7 days ago 022 Agreement Without Progress: A Preregistered Null for Multi-Agent Drift Detection OpenAlex Paper Diego Rincon 7 days ago 023 DFGP: Computational framework for makespan-aware multi-robot task allocation in obstacle-rich environments OpenAlex Paper JangHo Seo, Joonwoo Lee 7 days ago 024 Hayula Research Paper OpenAlex Paper Yahya Saqban 7 days ago 025 Hayula Research Paper OpenAlex Paper Yahya Saqban 7 days ago 026 Orchestration Over Scale: Five Strategies for Frontier-Level AI Without Trillion-Parameter Models OpenAlex Paper Yahya Saqban 7 days ago 027 Orchestration Over Scale: Five Strategies for Frontier-Level AI Without Trillion-Parameter Models OpenAlex Paper Yahya Saqban 7 days ago 028 Reinforcement learning OpenAlex Paper Jae-yoon Choi 7 days ago 029 Runtime Invariant Supervision OpenAlex Paper Yashvi Patel 7 days ago 030 AI & Decision Making in Game Scenarios OpenAlex Paper Xinyi Li Jul 23 031 Fate-Coupling: A Runtime Governance Primitive for AI Alignment OpenAlex Paper Gabriel Cassady Jul 23 032 Filtro de Realidad v5 + Anti-Sycophancy: A model-agnostic conduct protocol for AI coding assistants OpenAlex Paper Itan Homero Ruiz-Hernandez Jul 23 033 Filtro de Realidad v5 + Anti-Sycophancy: A model-agnostic conduct protocol for AI coding assistants OpenAlex Paper Itan Homero Ruiz-Hernandez Jul 23 034 History-Aware C-FAME: Context-Aligned Frontier Assignment for Multi-Robot Exploration OpenAlex Paper Xueyan Yao, Matilda Isaac et al. Jul 23 035 Infinite Ends From Finite Samples: Open‐Ended Goal Inference as Top‐Down Bayesian Filtering of Bottom‐Up Proposals OpenAlex Paper Tan Zhi-Xuan, Gloria Kang et al. Jul 23 036 Robustness-Aware Physical AI for Multi-Functional Humanoid Robot Team Concurrency Control Under Imperfect Digital Twin Information OpenAlex Paper Rubab Anwar, Won-Tae Kim Jul 23 037 Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks OpenAlex Paper Annie Wong, Jacob de Nobel et al. Jul 23 038 State-Fraction Coupled Quantile Network Based Distributional Reinforcement Learning for Uncertainty-Aware Decision-Making of Autonomous Driving OpenAlex Paper Yu Qiu, Zhicheng He et al. Jul 23 039 When Mamba Needs Attention OpenAlex Paper Umar Aslam Jul 23 040 When Mamba Needs Attention OpenAlex Paper Umar Aslam Jul 23 041 Beyond imitation: Robots that learn to work in the real world OpenAlex Paper Johannes A. Stork Jul 22 042 Continuous-Time Reinforcement Learning for $N$-Player Stochastic Differential Games with Exploratory Policies OpenAlex Paper Jisheng Liu, Jing Zhang Jul 22 043 Decoupling what, how, and when for observing decision-making context in autonomous robots OpenAlex Paper Johannes Ernst, David Lennart Risch et al. Jul 22 044 Filtro de Realidad v5 + Anti-Sycophancy: A model-agnostic conduct protocol for AI coding assistants OpenAlex Paper Itan Homero Ruiz-Hernandez Jul 22 045 Fold Go: Exact Counted Legality, Certified Solves, and Zero-Parameter Competitive Play OpenAlex Paper Maria Smith Jul 22 046 From the Self-Proven Theorem to Master-Level Chess - and the Law Inside Neural Networks OpenAlex Paper Maria Smith Jul 22 047 Hierarchical Multi-Agent Systems with Dynamic Task Decomposition: A Novel Adaptive Framework OpenAlex Paper Ahmed Anifowose, Oluwole Ilesanmi et al. Jul 22 048 Hierarchical Multi-Agent Systems with Dynamic Task Decomposition: A Novel Adaptive Framework OpenAlex Paper Ahmed Anifowose, Oluwole Ilesanmi et al. Jul 22 049 Kilo Code におけるカスタムAI エージェントの作成方法 OpenAlex Paper Katsuhiko Kawai Jul 22 050 Kilo Code におけるカスタムAI エージェントの作成方法 OpenAlex Paper Katsuhiko Kawai Jul 22 051 Performant robotic manipulation with real-world reinforcement learning OpenAlex Paper Kun Lei, Hui Li et al. Jul 22 052 Proximal Policy Optimization in Autonomous Driving: A Systematic Review of Methods, Imitation Learning, and Evaluation Practices OpenAlex Paper Anas Bayu Kusuma, Yogiek Indra Kurniawan et al. Jul 22 053 Safe Reinforcement Learning under Regularized Probabilistic Counterexample Guidance OpenAlex Paper Xiaotong Ji, Antonio Filieri Jul 22 054 WARA: A Closed-Loop Multi-Agent Framework for Wireless Optimization Autoresearch OpenAlex Paper Yuan Guo, Yilong Chen et al. Jul 22 055 Adaptive self-supervised learning for real-time problem solving in autonomous systems OpenAlex Paper Nagunuri Rajender, Girish Reddy Ginni et al. Jul 21 056 Model-Based Prior for Model-Free Reinforcement Learning in Process Control: An Offline Methodology for Semiconductor Manufacturing OpenAlex Paper Yanrong Li, Fugee Tsung et al. Jul 21 057 Modeling network evolution by multi-agent reinforcement learning OpenAlex Paper Dan Li, Tianwei Lin et al. Jul 21 058 ORBIT: Robust Offline Reinforcement Learning via Integrated Observation Recovery with Belief-Based Decision-Making Under Observation Corruption and Delay OpenAlex Paper Yibo Zhao, Zijian Cao et al. Jul 21 059 Reinforcement Learning Method for Large Language Models: A Comparative Study and Empirical Analysis OpenAlex Paper Jie Zhou Jul 21 060 Safety-Aware Event-Triggered Intervention for Motion Planning and Decision Making in Diffusion-Based Autonomous Driving OpenAlex Paper Xuerui Fang, Hui Li et al. Jul 21