Stochastic policies in Bayesian experimental design (and active causal discovery)
2 min read · June 13, 2026
2026 · variational-inference reinforcement-learning