cs.LGAug 25, 2026

Bayesian Flow Networks for Offline Trajectory Planning

Authors: Ludvig Killingberg, Helge Langseth

Abstract

Offline reinforcement learning (RL) leverages static datasets to learn decision policies without real-time environment interaction. While recent sequence-modeling approaches rely on continuous diffusion models for trajectory synthesis, applying these methods to discrete planning tasks requires a categorical formulation rather than the standard Gaussian construction. We present BFN-RL, a unified generative modeling framework for offline RL based on Bayesian Flow Networks (BFNs). By iteratively evolving distribution parameters rather than noisy data instances, BFN-RL natively models both discrete and continuous trajectory spaces within a single probabilistic formulation. The categorical planner generates future state sequences, and a learned inverse-dynamics model converts consecutive generated states into actions. Evaluations in discrete planning and continuous control show that BFN-RL can generate effective trajectories across both categorical and continuous state spaces. Our results establish BFNs as a versatile generative foundation for offline trajectory planning across data modalities.

Explore similar work

CardsList
  1. HorizonFlow: Variable-Length Planning for Offline Goal-Conditioned RL

    Sep 29, 2026JunHyeok Oh, Zian Jang, Byung-Jun LeeHierarchical PlanningTrajectory Generation

  2. Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

    Jul 10, 2026Guanquan Wang, Yoshimasa TsuruokaTrajectory GenerationOffline RL

  3. Discrete Flow Matching for Offline-to-Online Reinforcement Learning

    May 12, 2026Fairoz Nower Khan, Nabuat Zaman Nahim, Peizhong JuFlow MatchingReinforcement Learning