Transformer-Based RL

RL: Reinforcement Learning

Momentum

4 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 22

All topics
CardsList
  1. Decision Titan: Test-Time Training for Long-Term Memory in Offline Reinforcement Learning

    Oct 1, 2026Jude Waide, Robert LieckReinforcement LearningTransformer-Based RL

  2. Q-learning Penalized Transformer for Safe Offline Reinforcement Learning

    Sep 28, 2026Shengchao Hu, Peng Wang, Jifeng Hu +5Reinforcement LearningTransformer-Based RL

  3. Trust Guided Decision Transformer

    Sep 25, 2026Chainesh Gautam, Raghuram Bharadwaj Diddigi, Chandramouli Kamanchi +3Transformer-Based RLDecision Transformer

  4. Statistical Convergence of Transformer Encoder-Accelerated Robust Reinforcement Learning

    Sep 20, 2026Suman Banerjee, Hiroyasu TsukamotoReinforcement LearningTransformer-Based RL

  5. Learning-Based Collaborative MEC for LLM Inference with Soft-Deadline Awareness via Transformer-Enhanced PPO

    Aug 3, 2026Ngoc Hung Nguyen, Bjorn LandfeldtReinforcement LearningTransformer-Based RL

  6. Is One Layer Enough? Training A Single Transformer Layer Can Match Full-Parameter RL Training

    Jul 1, 2026Zijian Zhang, Rizhen Hu, Athanasios Glentis +4RL for Language ModelsFine-Tuning

  7. Revealing Safety-Critical Scenarios for UTM via Transformer

    Jun 30, 2026Huaze Tang, Bill Zeng, Chao Wang +3Reinforcement LearningIntelligent Transportation Systems

  8. Neuro-Symbolic Injection of LTLf Constraints in Autoregressive Reinforcement Learning Policies

    Jun 6, 2026Ashkan Ansarifard, Matteo Mancanelli, Elena Umili +1Reinforcement LearningTransformer-Based RL

  9. Agentic Transformers Provably Learn to Search via Reinforcement Learning

    May 29, 2026Tong Yang, Yu Huang, Yingbin Liang +1Policy GradientAgentic RL

  10. ESPO: Early-Stopping Proximal Policy Optimization

    May 28, 2026Zihang Li, Rui Zhou, Yingcheng Shi +8Early StoppingReinforcement Learning

  11. Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks

    May 26, 2026Nguyen Cong Luong, Shaohan Feng, Nguyen Duc Hai +10Reinforcement LearningTransformer-Based RL

  12. Heterogeneous AAV Logistics Task Allocation: A Reinforcement Learning Enhanced Overlapping Coalition Formation Game Approach

    May 26, 2026Yuze Zhou, Jingliang Sun, Junzhi Li +3Reinforcement LearningTransformer-Based RL

  13. Identifiable Token Correspondence for World Models

    May 15, 2026Youngin Kim, Ray Sun, Inho Kim +2World Model LearningTransformer-Based RL

  14. Beyond Linear Attention: Softmax Transformers Implement In-Context Reinforcement Learning

    May 8, 2026Zixuan Xie, Xinyu Liu, Claire Chen +3Reinforcement LearningTransformer-Based RL

  15. Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer

    May 7, 2026Yongyi Wang, Hanyu Liu, Lingfeng Li +6Efficient Transformer InferenceReinforcement Learning

  16. Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement

    May 7, 2026Haodong Liang, Lifeng LaiReinforcement LearningTransformer-Based RL

  17. Higher Embedding Dimension Creates a Stronger World Model for a Simple Sorting Task

    Oct 21, 2025Brady Bhalla, Honglu Fan, Nancy Chen +1Transformer InterpretabilityRepresentation Learning