<?xml version="1.0" encoding="ISO-8859-1"?>
<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Strict//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-strict.dtd">
<html xmlns="http://www.w3.org/1999/xhtml" xml:lang="en" lang="en">
<head>
<title>Reinforcement Learning</title>
<meta name="AUTHOR" content="Jose M Vidal"></meta>
<meta name="GENERATOR" content="xslides.el, written by J.M. Vidal"></meta>
<link rel="stylesheet" type="text/css" href="../xslides-medwhite.css" title="White" media="all" />
 	    <link rel="alternate stylesheet" type="text/css" href="../xslides-medblue.css" title="Blue" media="all" />
 	    <link rel="alternate stylesheet" type="text/css" href="../xslides-usc.css" title="USCTheme" media="all" />
<script type="text/javascript" src="../scripts/stylehelper.js"></script>
</head>
<body>
<h1 class="slide">Reinforcement Learning</h1><div>
          This talk is based on 
      <ul>
	<li class="index">Tom M. Mitchell. <a title="Machine Learning book at Amazon" href="http://www.amazon.com/exec/obidos/ASIN/0070428077/multiagentcom/">Machine Learning.</a> McGraw Hill. 1997. Chapter 13.</li>
	
	<li class="index">and his <a href="http://www-2.cs.cmu.edu/~tom/mlbook-chapter-slides.html" title="Slides by Tom Mitchell on Machine
	Learning">slides</a>. </li>
	
	<li class="index">An excellent resource is <a href="http://www-anw.cs.umass.edu/~rich/book/the-book.html" title="Sutton and Barto: Reinforcement Learning">Reinforcement
	Learning: An Introduction</a> by Sutton and Barto
	(free!).</li>
      </ul>
    </div>
<hr class="separator"/> <div><ol>
<li class="menu">1 <a href="introduction.1.xml" onclick="javascript:this.href=getURL('introduction.1.xml');return true;">Introduction</a><a href="introduction.xml" onclick="javascript:this.href=getURL('introduction.xml');return true;">*</a>
<ol><li class="menu">1.1 <a href="td-gammon.xml" onclick="javascript:this.href=getURL('td-gammon.xml');return true;">TD-Gammon</a></li>
<li class="menu">1.2 <a href="reinforcementlearningproblem.1.xml" onclick="javascript:this.href=getURL('reinforcementlearningproblem.1.xml');return true;">Reinforcement Learning Problem</a><a href="reinforcementlearningproblem.xml" onclick="javascript:this.href=getURL('reinforcementlearningproblem.xml');return true;">*</a></li>
<li class="menu">1.3 <a href="thelearningtask.xml" onclick="javascript:this.href=getURL('thelearningtask.xml');return true;">The Learning Task</a></li>
<li class="menu">1.4 <a href="valuefunction.xml" onclick="javascript:this.href=getURL('valuefunction.xml');return true;">Value function</a></li>
<li class="menu">1.5 <a href="example.xml" onclick="javascript:this.href=getURL('example.xml');return true;">Example</a></li>
</ol>
</li>
<li class="menu">2 <a href="qlearningmo.1.xml" onclick="javascript:this.href=getURL('qlearningmo.1.xml');return true;">Q-Learning Motivation</a><a href="qlearningmo.xml" onclick="javascript:this.href=getURL('qlearningmo.xml');return true;">*</a>
<ol><li class="menu">2.1 <a href="qfunction.xml" onclick="javascript:this.href=getURL('qfunction.xml');return true;">Q Function</a></li>
<li class="menu">2.2 <a href="learningq.xml" onclick="javascript:this.href=getURL('learningq.xml');return true;">Learning Q</a></li>
<li class="menu">2.3 <a href="q-learningalgorithm.xml" onclick="javascript:this.href=getURL('q-learningalgorithm.xml');return true;">Q-Learning Algorithm</a></li>
<li class="menu">2.4 <a href="q-learningexample.xml" onclick="javascript:this.href=getURL('q-learningexample.xml');return true;">Q-Learning Example</a></li>
<li class="menu">2.5 <a href="q-learningconvergence.xml" onclick="javascript:this.href=getURL('q-learningconvergence.xml');return true;">Q-Learning Convergence</a></li>
<li class="menu">2.6 <a href="howtochooseaction.xml" onclick="javascript:this.href=getURL('howtochooseaction.xml');return true;">How to Choose an Action</a></li>
<li class="menu">2.7 <a href="variations.xml" onclick="javascript:this.href=getURL('variations.xml');return true;">Variations</a></li>
<li class="menu">2.8 <a href="nondeterministicrewardsandactions.xml" onclick="javascript:this.href=getURL('nondeterministicrewardsandactions.xml');return true;">Nondeterministic Rewards and Actions</a>
<ol><li class="menu">2.8.1 <a href="nondeterministicq-learning.xml" onclick="javascript:this.href=getURL('nondeterministicq-learning.xml');return true;">Nondeterministic Q-Learning</a></li>
</ol>
</li>
</ol>
</li>
<li class="menu">3 <a href="temporaldifferencelearning.xml" onclick="javascript:this.href=getURL('temporaldifferencelearning.xml');return true;">Temporal Difference Learning</a>
<ol><li class="menu">3.1 <a href="td.xml" onclick="javascript:this.href=getURL('td.xml');return true;">Temporal Difference</a></li>
</ol>
</li>
<li class="menu">4 <a href="generalizationfromexamples.xml" onclick="javascript:this.href=getURL('generalizationfromexamples.xml');return true;">Generalization from Examples</a></li>
</ol>

<a href="allslides.xml">Entire Presentation with Notes</a> (<a href="allslides.pdf">PDF</a>)<br/><a href="frameindex.xml">Index on left</a>
<hr class="bottom" />
<p class="author">Copyright &copy; 2004 <a href="../../index.html">Jos&eacute; M. Vidal</a>
<a href=" http://validator.w3.org/check?uri=http://jmvidal.cse.sc.edu/talks/reinforcementlearning/index.xml">.</a>
 All rights reserved.</p>
<p class="pagenumber">19 August 2004, 03:11PM</p>
</div>
</body>
</html>