为什么E-GREEDY算法中e越小,性能会更好
为什么E-GREEDY算法中e越小,性能会更好How to understand the following sentences 第一句,讲的是e-贪心方法最终的性能更好的原因在于它持续地探索使得找到最优动作的概率提高了(纯粹的贪心只有1/3的概率找到最优动作)。第二句,当e=0.1时,该方法探索的概率更高,因而能更早地找到最优动作,但它选取该动作的概率不超过91%(因为有10%概率是...