Preprint · 2026
Stochastic MeanFlow Policies: One-Step Generative Control with Entropic Mirror Descent
Efficient generative policies for exploration and stable off-policy reinforcement learning.
Preprint · 2026
Efficient generative policies for exploration and stable off-policy reinforcement learning.
AAAI 2026
A one-step generative policy for offline and offline-to-online reinforcement learning.
Selected papers co-authored by Da Li. For the full publication list, visit Google Scholar.