ε-Greedy
سياسة إبسيلون الجشعة
استراتيجية اختيار أفعال توازن بين الاستكشاف والاستغلال: باحتمال (1−ε) يُختار الفعل الأمثل المعروف، وباحتمال ε يُختار فعل عشوائي لضمان تجربة جميع البدائل.
An action selection strategy balancing exploration and exploitation: with probability (1−ε) choose the best known action, with probability ε choose a random action to ensure all alternatives are tried.
Also translated asالاختيار الاحتمالي ε-الجشع، استراتيجية الاستكشاف الإبسيلونية
First appears in this corpus in: Q-Learning (1992)
Appears in these papers