Mathematical Model - MDP
Markov decision processes
S- set of states
A- set of actions
d - Transition probability
R - Reward function
Similar to DFA!
השקופית הקודמת
השקופית הבאה
חזור אל השקופית הראשונה
הצג גירסה גרפית