Autoregressive Rollout

Latest papers 88

All topics
CardsList
  1. ReFold: Training-Free Reversible Inter-Turn Context Folding for Long-Horizon Agents

    Oct 6, 2026Yupeng Su, Jiayi Tian, Zheng Zhang +1Interaction HistoryAutoregressive Rollout

  2. Flash-OPD: Fast On-Policy Distillation

    Oct 5, 2026Wei Chen, Junle Chen, Yitong Yang +6Student-Generated TrajectoriesAutoregressive Rollout

  3. Network World Models as Environments for Algorithm Design on Complex Systems

    Oct 1, 2026Rishab Alagharu, Hongji Pu, Zeeshan Memon +3Efficient World-Action ModelAgent-Based Model

  4. Self-Aligned Forcing: Streaming Video Diffusion with Differentiable Noisy History

    Sep 29, 2026Weiqiang Wang, Zhuokun Chen, Yusheng Dai +5Autoregressive Video Diffusion ModelsVideo Diffusion Models

  5. RoXDrive: Closed-Loop Reinforcement Learning for End-to-End Autonomous Driving via Action-Faithful Rollouts

    Sep 29, 2026Hongbin Lin, Chaoda Zheng, Yiming Yang +11Autonomous DrivingDrives

  6. Adapting Context Compression for Long-Horizon Agents with Counterfactual Continuations

    Sep 29, 2026Guanghui Min, Liang Wu, Mingjia Shi +4Long-Horizon AgentsInteraction History

  7. Inductive Feedback for Mixed-Policy Distillation

    Sep 28, 2026Amir Moeini, Huaijiang Zhu, Daniel Havir +1FeedbackAutoregressive Rollout

  8. One Rollout Is All You Get: Fully Test-Time Adaptation for GUI Agents

    Sep 28, 2026Ziqiang Wang, Li Gu, Zhixiang Chi +6Graphical User Interface AgentsTest-Time Adaptation

  9. Opera: A Verbal Critic Framework for Long-horizon Coding Agents

    Sep 27, 2026Kai Mei, Zhiyuan Hu, Yutong Dai +7CriticLong-Horizon Agents

  10. Beyond One-Step Accuracy: State-Affine Latent Transition for Reliable Visual Planning

    Sep 27, 2026Boyuan Zhang, Yingjun Du, Xiantong Zhen +1Low-Latency Latent PlanningLatent World Models

  11. Trust Guided Decision Transformer

    Sep 25, 2026Chainesh Gautam, Raghuram Bharadwaj Diddigi, Chandramouli Kamanchi +3Autoregressive RolloutGoal-Conditioned Value Function

  12. Frozen Flows Forget: Diagnosing and Restoring Lost Motion in a Latent-flow World Model

    Sep 23, 2026Xiwen Chen, Rigaudiere Z. Li, Zhiruo Zhou +2Latent FlowLatent Motion

  13. Faithful Faithfulness Evaluations: Challenges & Pitfalls Learned from a Breast MRI Case Study

    Sep 22, 2026Peachapong Poolpol, Henrik H. J. Detjen, Eike PetersenExplainabilitySaliency

  14. GrowMTP: Can RL Grow Its Own Draft Head?

    Sep 15, 2026Minghua He, Lingzhe Zhang, Yuan Liu +2Autoregressive RolloutDrafts

  15. Semigroup-JEPA: Latent Dynamics Consistency for Zero-Shot Physics Generalization

    Sep 9, 2026Andy Zeyi Liu, Haoran Sun, Lucas Baker +2Joint-Embedding Predictive ArchitecturesS-Jepa

  16. Environment Evolution for Terminal Agents

    Sep 3, 2026Zhiyuan Fan, Tinghao Yu, Yuanjun Cai +9Synthetic EnvironmentsEvolutionary Optimization Methods

  17. MemoryWalker: Stop Training Agents on Contexts They Never Saw

    Sep 1, 2026Zinco J, Xunjie Zhu, Shen Huang +3Autoregressive RolloutParallel Rollouts

  18. Online Self-Weighted Fine-Tuning

    Sep 1, 2026Haiquan Wen, Yiwei He, Bei Peng +1Model Fine-TuningModel Weights

  19. A Model with No Head and Many Thoughts

    Aug 31, 2026Nikita Koriagin, Yaroslav Aksenov, George Bredis +3Latent ThoughtsThoughts

  20. Distillation of Foundation Models for Time-dependent PDEs

    Aug 12, 2026Daniel Musekamp, Boshra Ariguib, Andrei Manolache +1Autoregressive RolloutKnowledge Distillation

  21. GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs

    Aug 12, 2026Kai Yang, Jingwei Xu, Wanyu Wang +4Autoregressive RolloutRollout

  22. Keep the Future, Drop the Rollout: RIFT for World Action Models

    Aug 12, 2026Chushan Zhang, Jinguang Tong, Xuesong Li +2World ModelsAutoregressive Rollout

  23. Scheduling Mixed RL Rollouts Beyond Prefix Locality

    Aug 11, 2026Zetao Hong, Song Yuan, Yuanhao Ding +4Parallel RolloutsAutoregressive Rollout

  24. Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models

    Aug 8, 2026Xuning He, Zinan Sheng, Yongding Tao +4Diffusion Language ModelsDiffusion Models

  25. SpecRoll: Fast-Slow Verifier-Feedback Adaptation for Speculative Reinforcement Learning Rollouts

    Aug 5, 2026Nhat Minh Pham, Duy Tung Doan, Thi Duyen Ngo +2Autoregressive RolloutLarge Language Model Reinforcement Learning

  26. PhyAI: Real-Time Physical AI at the Edge, Scalable Rollouts in the Cloud

    Aug 4, 2026Chenghua Wang, Daliang Xu, Dongqi Cai +21Physics-Aware ModelsArtificial Intelligence Systems

  27. Look Where It Matters: Adaptive Visual Refinement for Vision-Language-Action Models

    Aug 3, 2026Jin Cui, Yanbin Hu, Xinyue Long +3Diffusion-Based Vision-Language-ActionsVision Encoders

  28. Beyond On-Policy Exploration: Integrating External Policy Rollouts for Reinforcement Learning in Diffusion Language Models

    Aug 3, 2026Wonseok Lee, Jimyeong Kim, Jungmin Ko +1Large Language Model Reinforcement LearningAutoregressive Rollout

  29. Reusing Rollouts under Policy Lag: Prefix-Normalized Policy Optimization for LLM Reinforcement Learning

    Aug 2, 2026Wenhao Zhang, Yibo Xie, Rui Wang +9Autoregressive RolloutLarge Language Model Reinforcement Learning

  30. Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation

    Jul 31, 2026Qian Tan, Huaifei Liang, Xuanyu Zhu +2Efficient On-Policy DistillationAutoregressive Rollout

  31. HERO: History-Enriched Rollout Training for Long-Horizon Autoregressive Neural Operators

    Jul 31, 2026Jiaquan Zhang, Shuxu Chen, Haifan Meng +6Autoregressive RolloutNeural Operators

  32. Exact Action Values Are Not Enough: Rollout-Verified Reinforcement Fine-Tuning of a Reasoning Model for Multi-Zone VAV Control

    Jul 30, 2026Takumi Shioda, Kohei Terashima, Tatsuo NagaiHvac ControlReinforcement Fine-Tuning

  33. Q-Steer: Action-Value Guidance for Molecular Policy Optimization

    Jul 29, 2026Xinyu Wang, Jinbo Bi, Minghu SongMolecular OptimizationFrictive Policy Optimization

  34. Diffusion ReRoll: Revisable Denoising for Robotic Sequential Prediction

    Jul 22, 2026Seonsoo Kim, Seongil Hong, Jun-Gill KangDiffusion PoliciesDenoising Trajectory

  35. Process Reward Informed Tree Rollout for Effective Multi-Turn RL

    Jul 17, 2026Xintong Li, Sha Li, Yuwei Zhang +8Autoregressive RolloutRollout

  36. Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning

    Jul 8, 2026Zhenyu Hou, Yujiang Li, Jie Tang +1Agentic LearningAutoregressive Rollout

  37. Point as Skeleton: Accumulated Point Cloud Enhanced Autoregressive Generation for Closed-Loop Autonomous Driving Simulation

    Jul 7, 2026Songbur Wong, Xiaosong Jia, Junqi You +12Autonomous Driving SimulationAutonomous Driving

  38. Deployment-Side Adaptiveness in Multi-Horizon Volatility Forecasting

    Jun 26, 2026Riku Green, Zahraa S. Abdallah, Telmo M Silva FilhoVolatilityPost-Deployment Adaptation

  39. Conformal Orbit-Valid Trust Horizons for Equivariant World Models

    Jun 23, 2026Hongbo WangWorld ModelsHorizon

  40. A Differentiable Atari VCS:A Complex, Fully Known Ground Truth for Explainable AI

    Jun 21, 2026Andreas Maier, Siming Bayer, Patrick KraussExplainable Artificial IntelligenceXai

  41. EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts

    Jun 17, 2026Minseo Kim, Minjae Lee, Seunghyuk Oh +7Autoregressive RolloutParallel Rollouts

  42. Mem-World: Memory-Augmented Action-Conditioned World Models for Persistent Robot Manipulation

    Jun 17, 2026Zirui Zheng, Jiaqian Yu, Xiongfeng Peng +7Efficient World-Action ModelRobotic Manipulation

  43. SC3-Eval: Evaluating Robot Foundation Models via Self-Consistent Video Generation

    Jun 17, 2026Wei-Cheng Tseng, Gashon Hussein, Yuzhu Dong +9Video World ModelsAutoregressive Rollout