Back to Research papers
Research paper index

Bayesian Flow Networks for Offline Trajectory Planning

Ludvig Killingberg, Helge Langseth

arXiv:2608.25163Published August 25, 20260 citations
  • cs.LG
  • cs.AI
  • action
  • reinforcement learning
  • trajectory

Abstract

Offline reinforcement learning (RL) leverages static datasets to learn decision policies without real-time environment interaction. While recent sequence-modeling approaches rely on continuous diffusion models for trajectory synthesis, applying these methods to discrete planning tasks requires a categorical formulation rather than the standard Gaussian construction. We present BFN-RL, a unified generative modeling framework for offline RL based on Bayesian Flow Networks (BFNs). By iteratively evolving distribution parameters rather than noisy data instances, BFN-RL natively models both discrete and continuous trajectory spaces within a single probabilistic formulation. The categorical planner generates future state sequences, and a learned inverse-dynamics model converts consecutive generated states into actions. Evaluations in discrete planning and continuous control show that BFN-RL can generate effective trajectories across both categorical and continuous state spaces. Our results establish BFNs as a versatile generative foundation for offline trajectory planning across data modalities.

Read the original paper

This page indexes public paper metadata. The manuscript remains with its original publisher and authors.