<?xml version="1.0" encoding="UTF-8"?><?xml-stylesheet type="text/xsl" href="static/style.xsl"?><OAI-PMH xmlns="http://www.openarchives.org/OAI/2.0/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/ http://www.openarchives.org/OAI/2.0/OAI-PMH.xsd"><responseDate>2026-09-19T18:36:46Z</responseDate><request verb="GetRecord" identifier="oai:dash.harvard.edu:1/42719543" metadataPrefix="dim">https://dash.harvard.edu/server/oai/request</request><GetRecord><record><header><identifier>oai:dash.harvard.edu:1/42719543</identifier><datestamp>2025-12-11T15:22:14Z</datestamp><setSpec>com_1_1</setSpec><setSpec>col_1_4927603</setSpec></header><metadata><dim:dim xmlns:dim="http://www.dspace.org/xmlns/dspace/dim" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:doc="http://www.lyncode.com/xoai" xsi:schemaLocation="http://www.dspace.org/xmlns/dspace/dim http://www.dspace.org/schema/dim.xsd">
   <dim:field mdschema="dc" element="contributor" qualifier="advisor">Janson, Lucas</dim:field>
   <dim:field mdschema="dc" element="contributor" qualifier="author">Cai, Alexander Dazhen</dim:field>
   <dim:field mdschema="dc" element="contributor" qualifier="committeeMember">Janson, Lucas</dim:field>
   <dim:field mdschema="dc" element="contributor" qualifier="committeeMember">Kakade, Sham M</dim:field>
   <dim:field mdschema="dc" element="date" qualifier="accessioned">2025-09-18T04:32:32Z</dim:field>
   <dim:field mdschema="dc" element="date" qualifier="created">2025</dim:field>
   <dim:field mdschema="dc" element="date" qualifier="issued">2025-05-16</dim:field>
   <dim:field mdschema="dc" element="date" qualifier="submitted">2025</dim:field>
   <dim:field mdschema="dc" element="date" qualifier="available">2025-09-18T04:32:30Z</dim:field>
   <dim:field mdschema="dc" element="identifier" qualifier="citation">Cai, Alexander Dazhen. 2025. An Introduction to Reinforcement Learning. Bachelors Thesis, Harvard University Engineering and Applied Sciences.</dim:field>
   <dim:field mdschema="dc" element="identifier" qualifier="other">31931965</dim:field>
   <dim:field mdschema="dc" element="identifier" qualifier="uri">https://dash.harvard.edu/handle/1/42719543</dim:field>
   <dim:field mdschema="dc" element="identifier" qualifier="orcid">0000-0003-1308-6352</dim:field>
   <dim:field mdschema="dc" element="description" qualifier="abstract">This thesis presents a new course textbook on reinforcement learning (RL) with a focus on algorithms and their properties. The textbook is suitable for a one-semester introductory undergraduate course on RL for students with prior experience in basic probability, linear algebra, and multivariable calculus. We systematically cover the fundamentals of Markov decision processes, optimal control, multi-armed bandits, fitted dynamic programming algorithms, policy gradient methods, imitation learning, and tree search-based planning methods. Our contribution to the RL literature is an approachable and concise presentation of core RL algorithms that balances practical considerations with theoretical rigour. Each chapter includes extensive bibliographic notes that survey recent advances. We hope this textbook will equip the reader with a workable mental model for navigating modern RL research.</dim:field>
   <dim:field mdschema="dc" element="description" qualifier="sponsorship">Computer Science</dim:field>
   <dim:field mdschema="dc" element="format" qualifier="mimetype">application/pdf</dim:field>
   <dim:field mdschema="dc" element="language" qualifier="iso">en</dim:field>
   <dim:field mdschema="dc" element="subject">artificial intelligence</dim:field>
   <dim:field mdschema="dc" element="subject">machine learning</dim:field>
   <dim:field mdschema="dc" element="subject">Markov decision process</dim:field>
   <dim:field mdschema="dc" element="subject">multi-armed bandits</dim:field>
   <dim:field mdschema="dc" element="subject">optimal control</dim:field>
   <dim:field mdschema="dc" element="subject">reinforcement learning</dim:field>
   <dim:field mdschema="dc" element="subject">Artificial intelligence</dim:field>
   <dim:field mdschema="dc" element="subject">Statistics</dim:field>
   <dim:field mdschema="dc" element="subject">Computer science</dim:field>
   <dim:field mdschema="dc" element="title">An Introduction to Reinforcement Learning</dim:field>
   <dim:field mdschema="dc" element="type">Thesis or Dissertation</dim:field>
   <dim:field mdschema="dc" element="type" qualifier="material">text</dim:field>
   <dim:field mdschema="dash" element="license">LAA</dim:field>
   <dim:field mdschema="dash" element="depositing" qualifier="author">Cai, Alexander Dazhen</dim:field>
   <dim:field mdschema="dash" element="author" qualifier="email">alexandercai@outlook.com</dim:field>
   <dim:field mdschema="thesis" element="degree" qualifier="date">2025</dim:field>
   <dim:field mdschema="thesis" element="degree" qualifier="grantor">Harvard University Engineering and Applied Sciences</dim:field>
   <dim:field mdschema="thesis" element="degree" qualifier="level">Bachelor's</dim:field>
   <dim:field mdschema="thesis" element="degree" qualifier="level">Undergraduate</dim:field>
   <dim:field mdschema="thesis" element="degree" qualifier="department">Computer Science</dim:field>
   <dim:field mdschema="dspace" element="entity" qualifier="type">Publication</dim:field>
   <dim:field mdschema="oaire" element="licenseCondition">LAA</dim:field>open.access</dim:dim>
</metadata></record></GetRecord></OAI-PMH>