Autoregressive Rollout

Latest papers 88

All topics
CardsList
  1. Entropy-Gated Latent Recursion

    Jun 15, 2026Soham Bhattacharjee, Dushyant Singh Chauhan, Salem Lahlou +2Inference-TimeAutoregressive Rollout

  2. BadWorld: Adversarial Attacks on World Models

    Jun 15, 2026Linghui Shen, Mingyue Cui, Xingyi YangVideo World ModelsWorld Models

  3. Speculative Rollback Correction for Quality-Diverse Web Agent Imitation

    Jun 10, 2026Longkun Hao, Hongyu Lin, Hao Li +10Imitation LearningAutoregressive Rollout

  4. When is Your LLM Steerable?

    Jun 10, 2026Chenrui Fan, Yize Cheng, Ming Li +2Linear Activation SteeringSteering

  5. Sparrow: Sparse Rollout for Stable and Efficient Long-context RL of Large Language Models

    Jun 7, 2026Yang Zhou, Ranajoy Sadhukhan, Zhaofeng Sun +7Autoregressive RolloutLarge Language Model Reinforcement Learning

  6. Autoregressive Diffusion World Models for Off-Policy Evaluation of LLM Agents

    Jun 4, 2026Kaixuan Liu, Guojun Xiong, Weinan Zhang +1Large Language Model AgentsAutoregressive Rollout

  7. AutoLab: Can Frontier Models Solve Long-Horizon Auto Research and Engineering Tasks?

    Jun 3, 2026Zhangchen Xu, Junda Chen, Yue Huang +16Long-Horizon Task PlanningAgentic Benchmarks

  8. DARTS: Distribution-Aware Active Rollout Trajectory Shaping for Accelerating LLM Reinforcement Learning

    May 29, 2026Yujie Wang, Siwei Chen, Longzan Luo +4Large Language Model Reinforcement LearningAutoregressive Rollout

  9. ADWIN: Adaptive Windows for Horizon-Aware On-Policy Distillation

    May 27, 2026Kun Liang, Chenming Tang, Clive Bai +3Efficient On-Policy DistillationAutoregressive Rollout

  10. Autoregression-Free Neural Operators for Time-Dependent PDEs

    May 25, 2026Jiaquan Zhang, Caiyan Qin, Haoyu Bian +7Neural OperatorsNeural Partial Differential Equation Solvers

  11. DemoEvolve: Demonstration-Guided Harness Evolution under Sparse Feedback

    May 23, 2026Lirong Che, Yuzhe yang, Peiwen lin +4Agent HarnessAutoregressive Rollout

  12. Frontier: Towards Comprehensive and Accurate LLM Inference Simulation

    May 20, 2026Yicheng Feng, Xin Tan, Yangtao Deng +3LLM Inference OptimizationUser Simulation

  13. Wavelet Flow Matching for Multi-Scale Physics Emulation

    May 15, 2026Gabriele Accarino, Juan Nathaniel, Carla Roesch +4EmulatorsMultiscale Dynamics

  14. HorizonDrive: Self-Corrective Autoregressive World Model for Long-horizon Driving Simulation

    May 12, 2026Conglang Zhang, Yifan Zhan, Qingjie Wang +10Autonomous Driving SimulationAutoregressive Rollout

  15. Low-Cost Labels, Reliable Choices: Rollout-Calibrated Hyper-Heuristics for Job Shop Scheduling

    May 11, 2026Junhao Wei, Yanxiao Li, Yifu Zhao +8Job Shop SchedulingHeuristics

  16. Stable Long-Horizon PDE Forecasting via Latent Structured Spectral Propagators

    May 11, 2026Xiaoxiao Lu, Ye Yuan, Jiahao ShiNeural Partial Differential Equation SolversLong-Horizon Forecasting

  17. Controlling Transient Amplification Improves Long-horizon Rollouts

    May 9, 2026Adeel Pervez, Francesco LocatelloAutoregressive RolloutLong-Horizon Forecasting

  18. Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR

    May 8, 2026Tao Wang, Shuo Li, Yan Sun +2Reinforcement Learning With Verifiable RewardRepair-Based Group-Relative Policy Optimization

  19. RAY-TOLD: Ray-Based Latent Dynamics for Dense Dynamic Obstacle Avoidance with TDMPC

    Apr 30, 2026Seungho Han, Seokju Lee, Jeonguk KangObstacle AvoidanceModel Predictive Path Integral

  20. Efficient Agent Evaluation via Diversity-Guided User Simulation

    Apr 23, 2026Itay Nakash, George Kour, Ateret Anaby-TavorUser SimulationAutoregressive Rollout

  21. EmboAlign: Aligning Video Generation with Compositional Constraints for Zero-Shot Manipulation

    Mar 5, 2026Gehao Zhang, Zhenyang Ni, Payal Mohapatra +3Robotic ManipulationBrain Alignment

  22. TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents

    Feb 12, 2026Aladin Djuhera, Swanand Kadhe, Farhan Ahmed +3Multi-Turn Reinforcement LearningAutoregressive Rollout

  23. Expected flow networks in stochastic environments and two-player zero-sum games

    Oct 4, 2023Marco Jiralerspong, Bilun Sun, Danilo Vucetic +4Generative Flow NetworksImperfect-Information Games