Inference-Time Intervention

Momentum

3 papers in the last four weeks, down 25% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 24

All topics
CardsList
  1. PASTABench: Proactive Assessment of Sequential Trajectories for Agent Safety

    Sep 23, 2026Jiapeng Sun, Yujin Zhou, Han Zhu +4AI Agent Safety BenchmarksInference-Time Intervention

  2. First Token Matters: Understanding Safety Collapse in Large Reasoning Models

    Sep 16, 2026Yizheng Yang, Haining Yu, Yuechen Wang +4LLM Safety AlignmentInference-Time Intervention

  3. Beyond Training: A Feasibility Taxonomy for Inference-Time AI Governance

    Sep 9, 2026Samar AnsariAI GovernanceInference-Time Intervention

  4. Mitigating LLM Over-Refusal via Dynamic Semantic Routing Calibration

    Sep 6, 2026Zixuan Wang, Bingjie Zhang, He Zhao +1Mechanistic InterpretabilityLLM Refusal Behavior

  5. OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment Prediction

    Sep 2, 2026Jaehoon Jeong, Jay-Yoon LeeLegal Judgment PredictionLegal Reasoning

  6. Low-Rank Dynamics-Effective Latent Carriers for Counterfactual Rollout in Learned World Models

    Aug 15, 2026Yang Liu, Yuming ChenWorld Model LearningLatent World Models

  7. Learned Interventions in Lean 4 grind

    Jul 25, 2026Evan Wang, Simon Chess, Sophie Szeto +1Automated Theorem ProvingLean Theorem Proving

  8. Uni-AdaVD: Universal Concept Erasure for Visual Generation via Orthogonal Value Decomposition

    Jul 16, 2026Qifan Zhou, Yuan Wang, Yanbin Hao +4Diffusion Model UnlearningInference-Time Intervention

  9. HyperSafe: Inference-Time Safety Recovery for Fine-Tuned Language Models

    Jul 13, 2026Aznaur Aliev, Carlos Hinojosa, Abdelrahman Eldesokey +3LLM Fine-TuningLLM Safety Alignment

  10. ScaleErasure: Inference-Time Minimal Intervention for Precise Concept Erasure in Next-Scale Autoregressive Image Generation

    Jun 28, 2026Cong Wang, Haiyu Wu, Zhiwei Jiang +4Image GenerationSafe T2I Generation

  11. DeSRPA: Decoupled Speech Role-Playing Agent via Inference-Time Intervention

    Jun 16, 2026Wenqiu Tang, Zhen Wan, Takahiro Komamizu +1Large Language Model-Based Role-Play SimulationSpoken Dialogue Systems

  12. Inference-Time Decision Calibration for Temporal Classification

    Jun 14, 2026Arthur Chagas, Arthur Buzelin, Yan Aquino +4Post-Hoc CalibrationTime Series Classification

  13. GITCO: Gated Inference-Time Context Optimization in TSFMs

    Jun 3, 2026Manya Pandey, Dhruv Kumar, Murari Mandal +1Zero-Shot Time Series ForecastingInference-Time Optimization

  14. Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time

    Jun 1, 2026Mingkuan Zhao, Yide Gao, Wentao Hu +6Contextual FaithfulnessHallucination in Language Models

  15. Senses Wide Shut: A Representation-Action Gap in Omnimodal LLMs

    May 13, 2026Trung Nguyen Quang, Yiming Gao, Fanyi Pu +3Multimodal GroundingMultimodal Large Language Models

  16. SafeSteer: A Decoding-level Defense Mechanism for Multimodal Large Language Models

    May 12, 2026Xinyi Zeng, Xue Yang, Jingyuan Zhang +5Adversarial Attacks on VLMsMultimodal Robustness

  17. Defusing the Trigger: Plug-and-Play Defense for Backdoored LLMs via Tail-Risk Intrinsic Geometric Smoothing

    Apr 27, 2026Kaisheng Fan, Weizhe Zhang, Yishu Gao +2LLM Backdoor AttacksBackdoor Defense in LLMs

  18. Altered Thoughts, Altered Actions: Reasoning Chain as Control Surface for a Vision-Language-Action Policy

    Mar 13, 2026Tuan Duong Trinh, Basim Azam, Mohammed Ishaq Ansari +2Language-Conditioned Robot ManipulationVision-Language-Action Models

  19. Poodle: Seamlessly Scaling Down Large Language Models with Just-in-Time Model Replacement

    Dec 5, 2025Nils Strassenburg, Boris Glavic, Tilmann RablCost-Aware InferenceSmall Language Models