Hva er priori-fordelingen i Thompson Sampling for binær belønning?
Klikk for å snu kortet
Beta(1, 1) = uniform fordeling over [0,1]. Starter uten noen antagelse om belønningssannsynligheten. Etter suksesser og feil: posteriori . Bayesiansk oppdatering via Bayes' teorem.
Space / Enter for å snu