Safety Claims

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 46

All topics
CardsList
  1. Safe-by-Design Learning via Energy-based Neural Networks

    Sep 29, 2026Simone Betteti, Morteza Lahijanian, Luca LaurentiProbabilistic SafetyLearning-Based Control

  2. The Safety Operator: Modulating the Expression of Safety Instructions via Spectral Optimization

    Sep 29, 2026Benoit Dherin, Michael Munn, Xavier Gonzalvo +14Safety ClaimsInstruction Tuning

  3. AdaGuard: An Adaptive Guard Model with User-defined Policies

    Sep 28, 2026Yunhao Feng, Yifan Ding, Yuxiang Xie +4Safety ClaimsAdversarial Evaluation

  4. Beyond Safe Answers: Segment-Aware Listwise Alignment for Reasoning Safety in Large Reasoning Models

    Sep 14, 2026JungMin Yun, Junehyoung Kwon, Hayeong Ryu +3Large Reasoning ModelsReasoning Skills

  5. Scene Graph-Driven Haptic Feedback for Safety Enhancement in Robotic Ophthalmic Surgery via Physically Simulated iOCT

    Sep 7, 2026Danial Arbabi, Korab Hoxha, Angelo Henriques +2Surgical RobotsHaptic Feedback

  6. From Safety Documentation to Safety Knowledge Support: An Evidence-Grounded LLM Framework for Medical Devices

    Aug 12, 2026Tuhinangshu Gangopadhyay, Rasmus Adler, Peter Liggesmeyer +1Safety ClaimsLarge Language Model Safety

  7. Removing Infrastructure Barriers in Human-Robot Collaboration Through Wireless Reconfigurable Cells

    Aug 10, 2026Emma Takács, Mátyás Hajós, Ádám Juniki +7Human-Robot CollaborationBarriers

  8. Failing Gracefully: Mitigating Impact of Inevitable Robot Failures

    Aug 5, 2026Duc M. Nguyen, Saad A. Ghani, Andrew Marshall +3Robot SystemsMotion Planning

  9. Traceable LLM-Generated Hazard Scenarios for Operational Safety Analysis of Aviation Systems Using ASRS Reports

    Aug 5, 2026Cristian Mascia, Roberto Pietrantuono, Daniel Rodriguez +1HazardAir Traffic Control

  10. ADMITBench: A Safety-Governed Reference Framework for Evaluating the Admissibility of Industrial LLM Advisories

    Aug 4, 2026Yash Misra, Javal Vyas, Siddharth Gutta +1Safety BenchmarksSafety Claims

  11. Initiation Safety: A Missing Dimension in Generalist-Robot Safety

    Jul 8, 2026Zhijin Meng, Francisco CruzSafety ClaimsAuthorization

  12. A Tutorial on Autonomous Fault-Tolerant Control Using Knowledge-Grounded LLM Agents

    Jun 30, 2026Javal Vyas, Milapji Singh Gill, Artan Markaj +2Fault ToleranceLanguage-Model Agents

  13. EmbodiedUS-FS: Fast Slow Intelligence for Ultrasound Robotics

    Jun 21, 2026Fangzhuo Zhang, Xinyu Wang, Xiao Yang +1Robotic UltrasoundRobotic Systems

  14. Beyond Safe Data: Pretraining-Stage Alignment with Regular Safety Reflection

    Jun 17, 2026Jinhan Li, Kexian Tang, Yihan Xu +2Large Language Model SafetySafety Alignment

  15. OSGuard: A Benchmark for Safety in Computer-Use Agents

    Jun 13, 2026Mina Mohammadmirzaei, Jeffrey FlaniganSafety BenchmarksComputer-Use Agents

  16. SafeLLM: Extraction as a Hallucination-Resistant Alternative to Rewriting in Safety-Critical Settings

    Jun 11, 2026Julia Ive, Felix Jozsa, Evridiki Georgaki +6Large Language Model SafetyLarge Language Model Hallucination

  17. Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs

    Jun 8, 2026Yanyan Luo, Xue Han, Ruiqiao Bai +10Large Language Model PersonalizationLarge Language Model Safety

  18. Safe, Fluent and Acceptable Motion Generation and Execution for Human--Robot Interaction in Manufacturing Environments

    Jun 7, 2026Thibaut Lopez, Olivier Aycard, Pierre-Brice Wieber +2Human-Robot InteractionHuman-Centered Framework

  19. Listening to the Workforce: Measuring Construction Worker Safety Attitudes from Social Media Discourse Using LLMs

    Jun 3, 2026Farouq Sammour, Yuxin Zhang, Zhenyu ZhangSafety ClaimsAttitude

  20. Enhancing Operational Safety via Agentic Dialogue Hazard Identification Analysis

    Jun 2, 2026Sanjay Das, Ran Elgedawy, Ethan Seefried +2HazardSafety Claims

  21. Two to Tango: Coupled Task-Reference Selection for Safe LLM Fine-tuning

    Jun 1, 2026Xinrui Chen, Jianhao Zhang, Ou Wu +1Large Language Model SafetyLarge Language Model Fine-Tuning

  22. Lost in Delusion: Examining LLM Safety Under User Delusions and Distress

    May 31, 2026Andrew Aquilina, Chetna Nihalani, Vasudha Varadarajan +3Large Language Model SafetyDistress

  23. A study on a Real-Time VR-Based Teleoperation Framework for Manipulator in Dynamic Environment

    May 29, 2026InGyu Choi, GeonYeong Go, SunWoo Ahn +2TeleoperationRobotic Manipulator

  24. Detecting Is Not Resolving: The Monitoring Control Gap in Retrieval Augmented LLMs

    May 26, 2026Zhe Yu, Wenpeng Xing, Chen Ye +4Agentic Retrieval-Augmented Generation SystemsEpistemic Asymmetry

  25. An Analysis Focused on Womens Safety: Can VAD Models Be Enhanced by a Multi-modal Dataset?

    May 25, 2026Sangeeta ., Maddikuntla Sai Prajwal, Debi Prosad Dogra +4Training-Free Video Anomaly DetectionMultimodal Dataset

  26. Preferred, Not Safer: Pairwise Preference Is a Poor Proxy for Clinical Safety

    May 25, 2026Fay Elhassan, David Sasu, Alexandra Kulinkina +2Large Language Model EvaluationSafety Claims

  27. SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks

    May 25, 2026Yanhang Li, Zhichao Fan, Zexin ZhuangReverseDisagreement

  28. A Subjective Logic-based method for runtime confidence updates in safety arguments

    May 21, 2026Benjamin Herd, Jessica Kelly, Clarissa Heinemann +1Probabilistic SafetySafety Claims

  29. Remembering More, Risking More: Longitudinal Safety Risks in Memory-Equipped LLM Agents

    May 18, 2026Ahmad Al-Tawaha, Shangding Gu, Peizhi Niu +2Safety Claims

  30. DriveSafe: A Framework for Risk Detection and Safety Suggestions in Driving Scenarios

    May 16, 2026Sainithin Artham, Shankar Gangisetty, Avijit Dasgupta +1Autonomous DrivingHazard

  31. SafeManip: A Property-Driven Benchmark for Temporal Safety Evaluation in Robotic Manipulation

    May 12, 2026Chengyue Huang, Khang Vo Huynh, Mellon M. Zhang +3Robotic ManipulationSafety Claims

  32. Internalizing Safety Understanding in Large Reasoning Models via Verification

    May 9, 2026Yi Zhang, Yuxin Chen, Leheng Sheng +4Safety ClaimsLarge Reasoning Models

  33. Mental Health AI Safety Claims Must Preserve Temporal Evidence

    May 9, 2026Srimonti Dutta, Ratna KandalaArtificial Intelligence SafetySafety Claims

  34. Towards Neuro-symbolic Causal Rule Synthesis, Verification, and Evaluation Grounded in Legal and Safety Principles

    Apr 30, 2026Zainab Rehan, Christian Medeiros Adriano, Sona Ghahremani +1Neuro-Symbolic FrameworkSafety-Critical Scenarios

  35. Grammar-Constrained Refinement of Safety Operational Rules Using Language in the Loop: What Could Go Wrong

    Apr 26, 2026Khouloud Gaaloul, Zaid Ghazal, Madhu Latha Pulimi +1Safety ClaimsCyber-Physical System

  36. Vision-Based Human Awareness Estimation for Enhanced Safety and Efficiency of AMRs in Industrial Warehouses

    Apr 18, 2026Maximilian Haug, Christian Stippel, Lukas Pscherer +5Human-Robot CollaborationWarehouse Automation

  37. The Alignment Flywheel: A Governance-Centric Hybrid MAS for Architecture-Agnostic Safety

    Feb 28, 2026Elias Malomgré, Pieter SimoensGovernanceSafety Claims

  38. A User-driven Design Framework for Robotaxi

    Feb 22, 2026Yue Deng, Changyang HeSafety Claims

  39. SafetyFlow: An Agent-Flow System for Automated LLM Safety Benchmarking

    Aug 21, 2025Xiangyang Zhu, Yuan Tian, Chunyi Li +3Large Language Model SafetySafety Claims

  40. Decoding One Safety Trigger Token for Balancing Safety and Usability in Large Language Models

    May 12, 2025Haoran Gu, Handing Wang, Yi Mei +2Large Language Model SafetyJailbreak Attacks