Automated Software Testing

Latest papers 96

All topics
CardsList
  1. QuSema: Detecting Silent Bugs in Quantum Libraries via Quantum-knowledge-enhanced Agents

    Oct 7, 2026Yujin Song, Kaining Zhang, Qixin Zhang +3Fault DetectionAutomated Software Testing

  2. TestGRAD: Evolving Test Suites via Failure Pattern Momentum for SWE-Agent Ensemble

    Oct 7, 2026Pengfei He, Jiayuan Zhou, Shaowei Wang +1Automated Test GenerationAutomated Software Testing

  3. Multi-Label Perceptual Bug Detection in Video Games using Deep Learning on Gameplay Footage

    Oct 6, 2026Nahian Rifaat, Felix Morosov, Loutfouz ZamanAutomated Software TestingMulti-Label Classification

  4. FastCI: Efficient GPU-Intensive CI for LLM Training Frameworks

    Oct 1, 2026Tianshuo Qiao, Naiqian Zheng, Xiaopeng Liu +4Automated Software Testing

  5. Do Agent Benchmarks Do What They Say? An Executable-Contract Audit of Tool-Using Agent Environments

    Sep 29, 2026Rohith Reddy Bellibatlu, Zichong Wang, Wenbin ZhangTool-Use EvaluationAutomated Software Testing

  6. Scenario-Driven Neuroevolution: Using Models to Guide Test Generation for Games

    Sep 23, 2026Gijs van Cuyck, Patric Feldmeier, Jan Tretmans +1Automated Software TestingAutomated Test Generation

  7. FairTest: Search-Based Fairness Testing for Multi-Agent Reinforcement Learning Systems

    Sep 23, 2026Xiaotong Wang, Xuan XieAutomated Software TestingAlgorithmic Fairness

  8. IWC-Bench: Evaluating Web Application Generation from a Software Testing Perspective

    Sep 14, 2026Chenxu Liu, Zilu Zou, Peizhong Gao +9Automated Software TestingWeb Application Generation

  9. LLM-Assisted Dynamic Threat Analysis for Attacker-Reachable Software Weaknesses in Autonomous Vehicles

    Aug 13, 2026Md Wasiul Haque, Sagar Dasgupta, Mizanur Rahman +1Automated Software TestingSoftware Vulnerability Detection

  10. Directed Neuro-Symbolic Stochastic Execution for Verification of Distributed Parallel AI Programs

    Aug 8, 2026Gautham Koorma, Vikas Sharma, George Edwards +1Automated Software TestingFormal Verification

  11. WebGrader: Training LLMs for Web Development with Self-Evolving Programmatic Grader

    Aug 6, 2026Boshui Chen, Huiping Liu, Shaolei ZhangRL for Code GenerationAutomated Software Testing

  12. IcFuzz: Fuzzing Isaac Sim with Semantic Stage Guidance and Multi-level Mutation

    Aug 6, 2026Zhixiang Chen, Zhuangbin Chen, Ruoxi Jia +4Automated Software TestingRobotics Simulation

  13. Can LLMs Test Terminal User Interfaces?

    Aug 4, 2026Chao Peng, Ruida Hu, Ajitha Rajan +3Automated Software TestingAutomated Test Generation

  14. Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch

    Aug 3, 2026Shuyang Xie, Shuxiao Xie, Feng Zhu +2Automated Software TestingBenchmark Auditing

  15. Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug?

    Jul 30, 2026Xiaonan Xu, Wenjing WuAutomated Software TestingAutomated Program Repair

  16. DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing

    Jul 30, 2026Sowjanya Puligadda, Mengdie Zhang, Ali Zamani +3Mobile GUI AutomationAutomated Software Testing

  17. Agentic Method for Deterministic Validation of Legacy Code Migration

    Jul 30, 2026Andras Ferenczi, Jordan Docherty, Mariya Bessonov +2Code TranslationAutomated Software Testing

  18. Evaluating VLMs for Autonomous Agent-Driven Geometry Clipping Detection in Video Game QA

    Jul 28, 2026Carlos Celemin, Benedict Wilkins, Adrián Barahona-Ríos +2VLM EvaluationVLM Robustness

  19. KQFuzz: Knowledge-Guided Fuzzing for Quantum Libraries via Large Language Models

    Jul 28, 2026Fuyuan Xia, Qixin Zhang, Chenhao Ying +5Automated Software TestingLLMs for Cybersecurity

  20. Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)

    Jul 24, 2026Junda Zhao, Shurui Zhou, Eldan CohenLLM EvaluationAutomated Software Testing

  21. Test Case Prioritization for DNNs via Neural Collapse Instability

    Jul 22, 2026Chunyu Liu, Mingyuan Li, Yang Li +4Automated Software Testing

  22. Beyond Fail-to-Pass: Iterative Hardening of Co-Generated Bug Reproduction Tests and Fixes

    Jul 22, 2026Yuhao Tan, Zhibang Yang, Fangkai Yang +9Automated Software TestingAutomated Program Repair

  23. Integrating High-Level Requirements to Low-Level Tests with Machine-Readable V&V Specifications

    Jul 20, 2026Mansur Arief, Nur Ahmad Khatim, Ali Akarma +1Requirements EngineeringAutomated Software Testing

  24. Faithful Autoformalization of Natural Language Assertions

    Jul 14, 2026Hongyi Liu, Madhusudan Parthasarathy, Adithya MuraliAutomated Software TestingLLM-Based Program Synthesis