BernoulliBandit#
- statrl.settings.bandits.stochastic.anytime.envs.parametric.BernoulliBandit(means, name='MAB-Bernoulli')[source]#
Build a Bernoulli bandit from a vector of arm means.
- Parameters:
- Returns:
A bandit whose rewards are in
{0, 1}. Pair it withIMEDusingklBern().- Return type:
Examples
>>> env = BernoulliBandit([0.2, 0.9, 0.5]) >>> env.number_arms, env.optimal_arm (3, 1)