Bernoulli#

statrl.settings.bandits.stochastic.anytime.envs.distributions.Bernoulli(p)[source]#

Bernoulli arm with success probability p, so rewards are 0 or 1.