Large Language Model Backbones

Latest papers 62

All topics
CardsList
  1. Topology-Conditioned Backdoors: Language Models That Insert Vulnerabilities When They Infer They Are in a Multi-Agent System

    Oct 5, 2026Keegan Wang, Anantika MannbyLarge Language Model Backbones

  2. Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

    Oct 1, 2026Yu Luo, Jiamin Jiang, Yimin Zuo +9Long-Horizon AgentsLong-Horizon Task Planning

  3. SKILLLITE: Evidence-Guided Malicious Skill Auditing with Compact LLMs

    Sep 29, 2026Haoran Ou, Gelei Deng, Xuanye Zhang +3Malicious AgentsSkills

  4. MAADBench: The Refreshable Paradigm for Anomaly Detection in Multi-Agent Systems

    Sep 29, 2026Lei Ma, Dennis Hofmann, Haowen Xu +4Multimodal Anomaly DetectionAgentic Benchmarks

  5. ZeroGAR: Benchmarking the Adversarial Robustness of Zero-Shot Graph Models

    Sep 27, 2026Zhongjian Zhang, Xiao Wang, Busheng Zhang +5Zero-Shot RobustnessLLM Defense Mechanisms

  6. Not Too Hard, Not Too Easy: Learning from Intermediate States for LLM Structured Reasoning

    Sep 27, 2026Hongbo Chen, Guohua Lu, Ting Dang +1LLM Reasoning StrategiesIntermediate States

  7. Multi-modal Knowledge Preserving Adapter for Embedding Backward Compatibility

    Sep 15, 2026Jaeseok Byun, Gukyeong Kwon, Han-Kai Hsu +4Multimodal EmbeddingsLarge Language Model Adaptation

  8. Parameter-Efficient Adaptation of Pretrained Language Models for Time-Series Forecasting

    Sep 14, 2026Tamanna Kumavat, Georg Brunner, Kyriakos FlourisForecasting BackboneTime Series Forecasting

  9. EMR: Self-Evolving Medical Multi-Agent System via Experience Mining and Reuse

    Sep 14, 2026Dongsheng Shi, Yue Li, Xin Yi +1Clinical Reasoning TrainingElectronic Health Records

  10. CRAFT: LLM-Based Iterative Refinement for Temporal Reasoning over Clinical Narratives

    Aug 13, 2026Chengyang He, Tahreem Arif, Marko Zivkovic +3Temporal ReasoningPatient Trajectories

  11. CARVE: Cross-Slice Anisotropic Reallocation of Visual Evidence for Efficient 3D Medical Volume Understanding

    Aug 5, 2026Zhenyu Yi, Qiang Hu, Zhenhao Li +3Medical Visual Question AnsweringVisual Evidence

  12. An Actionable Diagnosis of Multilingual, Multi-Agent Planning Failures

    Aug 4, 2026Vikas Pahuja, Jonathan Brokman, Omer Hofman +6Multilingual AgentsLarge Language Model Planning

  13. AgentAntibody: An Adaptive Immune System for Defending LLM Agents against Prompt Injection

    Aug 4, 2026Shihao Weng, Yang Feng, Xiaofei Xie +1Multi-Llm AgentsPrompt Engineering

  14. SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents

    Aug 3, 2026Yue Yao, Shengyuan Wang, Xin Chen +4SkillsLarge Language Model Agents

  15. When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty

    Aug 1, 2026Nicolas Leins, Nico Pelleriti, Jana Gonnermann-Müller +1Large Language Model WorkflowsInference Cost

  16. AdaMTP: An Adaptive Training Paradigm for Multi-Token Prediction

    Aug 1, 2026Ziqiang Cui, Han Shi, Bowei He +8Multi-Token PredictionLarge Language Model Backbones

  17. PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks

    Jul 30, 2026Manyi Wang, Junjielong Xu, Pinjia HeSwe-Bench VerifiedMisalignment Persona

  18. Beyond Frame Selection: Generative Latent Evidence Aggregation for Long-Video Understanding

    Jul 30, 2026Bowen Liu, Shuning Wang, Xinpeng Ding +3Large Language Model Backbones

  19. VeriSkill: A Self-Evolution Framework for Program Verification Skills

    Jul 30, 2026Changguo Jia, Tianqi Zhao, Zhiyou Xiao +2Skill EvolutionSkills

  20. Architectural Backdoors in Vision-Language Model Supply Chains via Representation Steering

    Jul 28, 2026Maria Rosaria Briglia, Igor Maljkovic, Antonio Emanuele Cinà +3Vision-Language Foundation ModelsLarge Language Model Backbones

  21. IssueTrojanBench: Benchmarking AI Coding Agents Against Malicious Issue Requests

    Jul 22, 2026Ankur Singh, Jinqiu Yang, Tse-Hsun ChenCoding AgentsVulnerable Code

  22. Stochastic Meta-Unlearning: Bridging Language Backbone and Multimodal Unlearning

    Jul 21, 2026Zijie Liu, Jinhao Duan, Gaowen Liu +2Large Language Model UnlearningUnlearnable Examples

  23. SmartRAG: Native Graph-Based RAG for Mobile Device

    Jul 16, 2026Zhihan Jiang, Meng Li, Shenghao Liu +5Graph-Based Retrieval Augmented GenerationMulti-Hop Reasoning

  24. Cross-Layer Misalignment Detection in Agent Skills: A Progressive Loading-Aware Contrastive Learning Approach

    Jul 12, 2026Chengjun Zhang, Yang Gao, Jianna Hur +2Large Language Model AlignmentCross-Layer Interactions

  25. When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems

    Jul 7, 2026Haowen Xu, Xue Tan, Lei Ma +6Malicious AgentsLarge Language Model Backbones

  26. FlipGuard: Defending Large Language Models Against Quantization-Conditioned Backdoor Attacks

    Jun 27, 2026Aoying Zheng, Anqi Du, Zizhuang Deng +1Large Language Model BackbonesLLM Defense Mechanisms

  27. Closing the Quality Gap in Low-Resource Text-to-Speech: LoRA Fine-Tuning of VoxCPM2 for Khmer and Korean

    Jun 25, 2026Phannet Pov, Hyun Woo Park, Voneat Pen +3Flow-Matching Text-To-SpeechLarge Language Model Adaptation

  28. BitNet Text Embeddings

    Jun 24, 2026Zhen Li, Xin Huang, Liang Wang +8Text EmbeddingsEmbedder

  29. SCOPE: Sequential Conformal Probing for Reliable OOD Rejection in LLM Services

    Jun 19, 2026Zhuoyun Li, Boxuan Wang, Changshun Wu +2Out-Of-DistributionLarge Language Model Backbones

  30. Uncertainty Decomposition for Clarification Seeking in LLM Agents

    Jun 17, 2026Gregory MatsnevLarge Language Model UncertaintyClarification

  31. Rescaling MLM-Head for Neural Sparse Retrieval

    Jun 17, 2026Youngjoon Jang, Seongtae Hong, Jonah Turner +1Retrieval LayerLarge Language Model Backbones

  32. Dummy Backdoor as a Defense: Removing Unknown Backdoors via Shared Internal Mechanisms for Generative LLMs

    Jun 10, 2026Kazuki Iwahana, Masaru Matsubayashi, Takuma Koyama +3Attacker Large Language ModelLarge Language Model Backbones

  33. Closing the Prior-Posterior Loop: Self-Reflective Molecular Design with Analysis-Driven LLM Iteration

    Jun 8, 2026Junyi Gong, Zijie Qiu, Ben Zhong TangMolecular DesignLarge Language Model Backbones

  34. Shared Latent Structures Enable Unified Backdoor Detection and Mitigation in LLMs

    Jun 6, 2026Omar Mahmoud, Aly M. Kassem, Thommen George Karimpanal +4Large Language Model BackbonesLatent Variable

  35. Learning Design Skills as Memory Policies for Agentic Photonic Inverse Design

    May 28, 2026Shengchao Chen, Ting Shu, Sufen RenNanophotonicInverse Design

  36. CP-Agent: A Calibrated Risk-Controlled Agent for Feedback-Driven Competitive Programming

    May 23, 2026Peisong Wang, Bowen Liu, Zehua Li +4Raw Judge OutputsCp-Agent

  37. Conflict-Resilient Multi-Agent Reasoning via Signed Graph Modeling

    May 19, 2026Longgang He, Longzhu He, Daojing He +1Multi-Agent ReasoningGraph Representations

  38. CasualSynth: Generating Structurally Sound Synthetic Data

    May 17, 2026Zehua Cheng, Wei Dai, Jiahao Sun +1Synthetic DataLocal Causal Structures

  39. EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy

    May 15, 2026Xuanyu Ge, Zhongqi Wang, Jie Zhang +2Clean Label Backdoor AttackLarge Language Model Backbones

  40. MetaBackdoor: Exploiting Positional Encoding as a Backdoor Attack Surface in LLMs

    May 14, 2026Rui Wen, Mark Russinovich, Andrew Paverd +2Fewer Surprising BackdoorsAttacker Large Language Model

  41. Efficient and Adaptive Human Activity Recognition via LLM Backbones

    May 12, 2026Aleksandr Bredikhin, Philippe Lalanda, German VegaHuman Activity RecognitionLarge Language Model Backbones

  42. BadSKP: Backdoor Attacks on Knowledge Graph-Enhanced LLMs with Soft Prompts

    May 12, 2026Xiaoting Lyu, Yufei Han, Hangwei Qian +6Attacker Large Language ModelLarge Language Model Backbones

  43. On Problems of Implicit Context Compression for Software Engineering Agents

    May 11, 2026Kirill Gelvan, Igor Slinko, Felix Steinbauer +3Context LengthLarge Language Model Backbones

  44. Personalizing LLMs with Binary Feedback: A Preference-Corrected Optimization Framework

    May 11, 2026Xilai Ma, Liye Zhao, Weijun Yao +3Large Language Model PersonalizationPersonalization

  45. Trust or Abstain? A Self-Aware RAG Approach

    May 11, 2026Xi Zhu, Ziqi Wang, Kai Mei +5Large Language Model ReliabilityLarge Language Model Backbones

  46. Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers

    Apr 23, 2026Jiali Wei, Ming Fan, Guoheng Sun +3Attacker Large Language ModelClean Label Backdoor Attack

  47. Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning

    Apr 17, 2026Livia Qian, Gabriel SkantzeDialogue BenchmarksLarge Language Model Backbones

  48. ScheMatiQ: From Research Question to Structured Data through Interactive Schema Discovery

    Apr 10, 2026Shahar Levy, Eliya Habba, Reshef Mintz +3SchemaScholar Information Database

  49. BrepLLM: Enabling Large Language Models to Understand Boundary Representations

    Dec 18, 2025Liyuan Deng, Hao Guo, Yongkang Dai +5Large Language Model BackbonesBoundaries

  50. Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks

    Oct 1, 2025Shoumik Saha, Jifan Chen, Sam Mayers +3Jailbreak AttacksSecurity Evaluation