Behavioral Divergence

Momentum

2 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 24

All topics
CardsList
  1. When Reasoning Helps Action: Monitoring and Steering Chain-of-Thought in Vision-Language-Action Policies

    Sep 30, 2026Sathwik Karnik, Joseph JR. Lee, Aryaman Gupta +1Reasoning TrajectoryChain-of-Thought Reasoning

  2. SkillCome: Group Contrast Skill Optimization with Dual Memory

    Sep 29, 2026Haolin Li, Feng Hong, Ang Li +6SkillsLarge Language Model Agents

  3. When the Score Becomes the Target: Rethinking Metric Validity in Autonomous Driving

    Sep 28, 2026Morui Zhu, Deyuan Qu, Qi Chen +2Autonomous DrivingScoring

  4. Safety Nudges: User-Facing Interventions for Real-Time AI Risk Awareness

    Sep 22, 2026Varshini Elangovan, James Wedgwood, Chhavi Yadav +3Artificial Intelligence SafetyNudges

  5. Behaviorally Effective LoRA Writes Are Sparse and Structured

    Sep 1, 2026Haruto Sato, Yuki Tanaka, Ren Nakamura +2Behavioral DivergenceContinuation

  6. Mapping and Measuring the Behavioral Evolution of Large Language Models

    Aug 11, 2026Dong Qiao, Chris Ding, Jicong FanBehavioral DivergenceMaximum Mean Discrepancy

  7. A Fair Objective for Human-Empowerment-Preserving AI: Desiderata, Design, and Likely Behavioral Consequences

    Aug 8, 2026Jobst Heitzig, Ram PothamHuman-Centered FrameworkArtificial Intelligence Safety

  8. Cross-Benchmark Generalization in Long-Horizon Agents

    Jul 31, 2026Sushant Mehta, Logan Ritchie, Liudas Panavas +1Long-Horizon AgentsAgentic Benchmarks

  9. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

    Jul 9, 2026Baha Rababah, Cuneyt Gurcan Akcora, Carson K. LeungLarge Language Model QuantizationPost-Training Quantization

  10. CBD: API-Only LLM Black-Box Unlearning through Controlled Behavioral Divergence

    Jun 26, 2026Zhiqiang Xie, Yijing Lin, Zhipeng Gao +1Large Language Model UnlearningUnlearning Method

  11. Objective-Behavior Alignment: Diagnostics for MORL Policy Selection

    Jun 19, 2026Antonio Mone, Zuzanna Osika, Florian Felten +4Multi-Objective Reinforcement LearningBehavioral Divergence

  12. Bounded Behavioral Indistinguishability for Black-Box LLM Distillation

    May 28, 2026Munawar HasanDataset DistillationBehavioral Divergence

  13. By Their Fruits You Will Know Them: Comparing Formalizations of Law by the Decisions They Encode

    May 24, 2026Julius Vernie, Matthias GrabmairLegal Reasoning TasksFormalization

  14. Behavior-Consistent Deep Reinforcement Learning

    May 20, 2026Marcel Hussing, Liv G. d'Aliberti, Claas Voelcker +2Distributional Reinforcement LearningBoltzmann Policies

  15. Same Signal, Different Semantics: A Cross-Framework Behavioral Analysis of Software Engineering Agents

    May 18, 2026Wei Ma, Zhi Chen, Jingxu Gu +3Behavioral Divergence

  16. Patients With Personality: Realistic Patient Simulation through Controlled Diversity and Selective Disclosure

    May 13, 2026Moritz Schlager, Friederike Jungmann, Samuel Schmidgall +12Simulated PatientsPersonality

  17. Counterfactual Trace Auditing of LLM Agent Skills

    May 12, 2026Xiaolin Zhou, Jinbo Liu, Li Li +2SkillsBehavioral Divergence

  18. Automatically Finding and Validating Unexpected Side-Effects of Interventions on Language Models

    May 6, 2026Quintin Pope, Ajay Hayagreeve Balaji, Jacques Thibodeau +1Behavioral DivergenceEvaluation Agent

  19. Value-Conflict Diagnostics Reveal Widespread Alignment Faking in Language Models

    Apr 22, 2026Inderjeet Nair, Jie Ruan, Lu WangFake NewsInference-Time Defense

  20. When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning

    May 21, 2025Rongzhi Zhu, Yi Liu, Jiancheng Wang +6Large Reasoning ModelsBehavioral Divergence