Library

Subject
Tags

10,754 matches · cs.SE

#
001Agentic Metaverse Services: A New As-a-Service ParadigmarXivPaperXiaofei Xu et al.Yesterday
002Agentic Method for Deterministic Validation of Legacy Code MigrationarXivPaperAndras Ferenczi et al.Yesterday
003Change2Task: From Repository Changes to Executable Coding Agent Tasks and EnvironmentsarXivPaperHaomin Qi et al.Yesterday
004Checking Information Flow in Cloud-based IoT Access Control Policies (Extended Version)arXivPaperLorenzo Ceragioli et al.Yesterday
005Emerging Challenges in Threat Modeling for GenAI-Augmented Systems: A View from the TrenchesarXivPaperNicolás E. Díaz Ferreyra et al.Yesterday
006From Textual Requirements to Microservice Architectures - A Comprehensive Evaluation of LLM-Based Design SynthesisarXivPaperDanyllo Albuquerque et al.Yesterday
007HALO: Heterogeneous Admission through Localized Obligations for Safe Agentic ExecutionarXivPaperTaewoo Park et al.Yesterday
008Integrating AI into Requirements Quality Learning in Software Engineering Education: A TPACK-Guided Empirical StudyarXivPaperHansika Ekanayake Mudiyanselage et al.Yesterday
009ORCA-bench: How Ready Are Language Model Agents for Oncall?arXivPaperAlbert Gong et al.Yesterday
010Old Tricks, New Models: How Simple Image Transformations Break Modern AI-based Content ModerationarXivPaperMarco Alecci et al.Yesterday
011PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like BenchmarksarXivPaperManyi Wang et al.Yesterday
012Specification-Guided Synthesis of Deadlock-Free Communication Protocol Refinements with Large Language ModelsarXivPaperYang Li et al.Yesterday
013A First Look at Coding Agents' Compliance with AI Contribution Rules in Open-Source CommunitiesarXivPaperWenhao Yang et al.2 days ago
014Benchmarking the Residual: What Long-Horizon Evaluations Add Beyond Matched Short-Task PerformancearXivPaperChao Peng et al.2 days ago
015From Backlog Items to Security Guidance: Towards Continuous Security CompliancearXivPaperIgnacio García Núñez et al.2 days ago
016From Tokens to Watt-hours: Analytical Energy Estimation for LLM Inference on Modern GPUsarXivPaperTina Vartziotis et al.2 days ago
017Graph Is the Verifier: Agentic Reinforcement Learning for Interprocedural Vulnerability DetectionarXivPaperYikun Li et al.2 days ago
018MediaWiki Code2Code Search: Neural Retrieval for the Semantic Discovery of Open-Source Software EntitiesarXivPaperFrancesco Tosoni2 days ago
019MindForge: Teaching Small Language Models Whole-Life-Cycle Software Engineering via Source-Free Program SynthesisarXivPaperYihao Chen et al.2 days ago
020Not In My Git Yard: Catching Backdoors at Commit and Release TimearXivPaperDimitri Kokkonis et al.2 days ago
021RLPF: Reinforcement Learning from Performance Feedback for Code GenerationarXivPaperHuihao Jing et al.2 days ago
022SWE-NFI: Studying and Benchmarking Coding Agents for Non-Functional ImprovementsarXivPaperPengyu Xue et al.2 days ago
023SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from ScratcharXivPaperYihao Chen et al.2 days ago
024ThreatForest: Multi-Agent Attack Tree Generation with Pluggable TTP Framework MappingarXivPaperCristian Leo et al.2 days ago
025A Machine-Learning-Based Gas Lift Optimization Workflow for Unconventional FieldsarXivPaperShan Miao, Alexandra Vendetti et al.3 days ago
026Do Context Files Help Coding Agents? A Two-Agent Ablation Study on Real RepositoriesarXivPaperPrakhar Khatri3 days ago
027Explanation-Bound Tool Execution for AI Agents: Server-Verified Action Claims Without Trusting Model RationalesarXivPaperGenliang Zhu et al.3 days ago
028How Do LLMs Read Bug Reports? An Empirical Study of Attention in LLMs for Automated Program RepairarXivPaperRamtin Ehsani, Irene Manotas et al.3 days ago
029IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM ApplicationsarXivPaperConor McCauley, Zeliang Kan et al.3 days ago
030KQFuzz: Knowledge-Guided Fuzzing for Quantum Libraries via Large Language ModelsarXivPaperFuyuan Xia et al.3 days ago
031Model-Driven Requirements Configuration with Three-Valued Uncertainty ScoringarXivPaperAhmed Ibrahim3 days ago
032Multi-Agent Debate Strategies: Survey, Taxonomy, and ChallengesarXivPaperQuim Motger et al.3 days ago
033Position: Evaluation Scores Are Perishable Knowledge ClaimsarXivPaperSankalp Gilda et al.3 days ago
034RSIBench-Data: Benchmarking Data-Centric Research for Recursive Self-ImprovementarXivPaperFanqing Meng, Lingxiao Du et al.3 days ago
035SARC-DQ: Runtime Data-Quality Gating for Agentic AI: Silent Evidence Defects, the Incompetence Shield, and Downstream-Only RemediationarXivPaperGaston Besanson3 days ago
036SecDrift: Measuring Sector-Conditioned Security Drift in AI-Generated CodearXivPaperNarayanaswami Natraj Bharadwaj et al.3 days ago
037SkillGate: Cost Efficient Runtime Malicious Skill File Detection in Coding AgentsarXivPaperRui Yang et al.3 days ago
038Specula: Scaling formal specifications for autonomous model checking of system codearXivPaperQian Cheng et al.3 days ago
039The LAIA Dataset: Labelled Attention for Intelligent AutomobilesarXivPaperA. Contreras, D. Porres et al.3 days ago
040TraceCoder: Explainable and Auditable Code Generation with Position-Key Snippet VersioningarXivPaperRwaida Alssadi et al.3 days ago
041Try Again, Don't Look Back: Blind Resampling Outperforms Self-Repair in Small Code ModelsarXivPaperYuvraj Verma3 days ago
042Authoring Agent Skills: A Software-Engineering ApproacharXivPaperGiuseppe Destefanis4 days ago
043Behavior-Driven ExplainabilityarXivPaperCaroline Dominik et al.4 days ago
044Beyond "What to Retrieve": Uncertainty in Retrieval-Augmented Code GenerationarXivPaperChandan Kumar Sah et al.4 days ago
045Chart-Supported or Model-Supplied? Examining MLLM-Generated Claims for Accessible VisualizationarXivPaperIshrat Jahan Eliza et al.4 days ago
046Evaluating Fuzz Testing for Reinforcement Learning AgentsarXivPaperZhibin Kang et al.4 days ago
047Evaluating the Impact of Explainable AI on Trust in AI-Assisted Code ReviewarXivPaperZhenhan Gao et al.4 days ago
048Learning from 53.6K Real-World Developer Edits of AI-Generated CodearXivPaperJenny T. Liang et al.4 days ago
049Preliminary Guidelines for Using and Evaluating GenAI Tools to Support Systematic Literature ReviewsarXivPaperBarbara Kitchenham et al.4 days ago
050SAFAARI: Schema-Aware Framework for Accelerated Advertiser Response IntelligencearXivPaperBhanu Teja Rangaraju et al.4 days ago
051Trusting-Trust Attack against an Entire Linux Distribution through Binary ManipulationarXivPaperJulien Malka et al.4 days ago
052Plans Work in Mysterious Ways: Evaluating a Plan Mode for Spreadsheet AgentsarXivPaperAayush Kumar et al.5 days ago
053TLA$^{+}$-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA+ Specification GenerationarXivPaperArslan Bisharat et al.5 days ago
054Where Is the Cost of Third-Party API Routers in Agentic Software Development?arXivPaperDonghao Fu et al.5 days ago
055Adversarial Test-Hardening for AI-Written Code: An Instrument Autopsy and a Pre-Registered Causal Estimate of the Critic LooparXivPaperJeff Otterson6 days ago
056From Signals to Behaviors: Evidence-Based Android Malware DetectionarXivPaperShiwen Song et al.6 days ago
057Metamorphic Testing for Clinical ML Models: A Framework Proposal and Pilot StudyarXivPaperJie JW Wu et al.6 days ago
058On AI Safety and Security Technical Debt in Engineering AI-Enabled SystemsarXivPaperMuhammad Tukur et al.6 days ago
059AssumptionMiner: Extracting, Tracing, and Revising Implicit Assumptions in LLM Code GenerationarXivPaperJie "JW" Wu7 days ago
060DeFiScreener: Efficient DeFi Attack Pre-screening in Smart Contracts via Historical Case MatchingarXivPaperRui Cao, Shaojing Fan et al.7 days ago

Showing 60 of 10,754 documents · scroll for more