From c86a2d02b965731911ed6dbca61f3613b651f2fc Mon Sep 17 00:00:00 2001 From: ben-jaynes <1btjaynes@gmail.com> Date: Thu, 4 Jun 2026 18:59:09 -0700 Subject: [PATCH] vault backup: 2026-06-04 18:59:09 --- .../Class 6-4 (Reinforcement Learning).md | 5 ++++- 1 file changed, 4 insertions(+), 1 deletion(-) diff --git a/Running Start/CSB320 - Machine Learning Concepts/Class 6-4 (Reinforcement Learning).md b/Running Start/CSB320 - Machine Learning Concepts/Class 6-4 (Reinforcement Learning).md index 4dce4b2..f7fbed2 100644 --- a/Running Start/CSB320 - Machine Learning Concepts/Class 6-4 (Reinforcement Learning).md +++ b/Running Start/CSB320 - Machine Learning Concepts/Class 6-4 (Reinforcement Learning).md @@ -17,4 +17,7 @@ - markov decision process - future states only depend on the present state, not what came before - trying to maximize reward without knowing entire history - - \ No newline at end of file +- monte-carlo + - updates model after every episode +- temporal difference + - learns after every step, not every episode \ No newline at end of file