<?xml version="1.0"?>
<rss version="2.0">
   <channel>
      <title>Aprendizagem por Reforço by </title>
      <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5</link>
      <description></description>
      <language>en-us</language>
      <pubDate>2023-03-22 21:25:58 UTC</pubDate>
      <lastBuildDate>2023-03-22 22:39:01 UTC</lastBuildDate>
      <webMaster>hello@padlet.com</webMaster>
      <image>
         <url></url>
      </image>
      <item>
         <title>1. O que caracteriza a Aprendizagem por Reforço?</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527825272</link>
         <description><![CDATA[<div>Não tem algo pré-programado e tem aprendizado por recompensa.</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:27:22 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527825272</guid>
      </item>
      <item>
         <title>2. Dê um exemplo de aplicação de Aprendizado por Reforço. Como funciona? (Além dos exemplos apresentados no vídeo, você pode encontrar mais aplicações aqui: https://www.davidsilver.uk/applications/)</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826123</link>
         <description><![CDATA[<div>Exemplo: robodog e AlphaZer (aprende a jogar xadrez, shogi e go sem conhecimento humano).</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:27:50 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826123</guid>
      </item>
      <item>
         <title>3. Qual a diferença entre Aprendizado Supervisionado e Aprendizado por Reforço?</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826331</link>
         <description><![CDATA[<div>O Aprendizado Supervisionado ocorre por meio de dados de entrada e saída. O Aprendizado por Reforço ocorre através da atribuição de recompensas com seus respectivos custos ao agente e mapeamento de ações por parte do agente.<br>Basicamente, o agente utilizando o Aprendizado por Reforço tem a autonomia para se guiar pelo resultado otimizado através das recompensas, enquanto o Supervisionado precisa chegar no resultado otimizado através da análise de dados já categorizados por humanos.</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:28:07 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826331</guid>
      </item>
      <item>
         <title>4. Qual a diferença entre Aprendizado Não Supervisionado e Aprendizado por Reforço?</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826451</link>
         <description><![CDATA[<div>O Aprendizado Não Supervisionado aprende sozinho através de dados sem rótulos, visto que a saída não é definida e respostas corretas não são dadas. Ele analisa os dados e os agrupa com base em suas características e padrões em comum. O por Reforço também não recebe respostas corretas, contudo aprende com recompensas, diferente do anterior.</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:28:19 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826451</guid>
      </item>
      <item>
         <title>5. Quais são os elementos envolvidos e o modelo de Aprendizado por Reforço?</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826727</link>
         <description><![CDATA[<div>A imagem acima representa o modelo de Aprendizado por Reforço. Os elementos envolvidos são: Agente, Ambiente, Estado, Recompensa e Ação. O agente realizará uma ação em determinado ambiente num determinado estado de tempo. A recompensa resultará dessa ação, se foi positiva ou negativa.</div>]]></description>
         <enclosure url="https://padlet-uploads.storage.googleapis.com/327238510/6252def8c0b5012ae3a6677844a9f76b/image.png" />
         <pubDate>2023-03-22 21:28:29 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527826727</guid>
      </item>
      <item>
         <title>INTEGRANTES</title>
         <author>nataliaweise</author>
         <link>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527872848</link>
         <description><![CDATA[<div>Natália Sens Weise<br>João Vitor de Oliveira<br>Paulo Rubens de Moraes Leme Júnior</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 22:33:40 UTC</pubDate>
         <guid>https://padlet.com/nataliaweise/toswzaxkzx4iywp5/wish/2527872848</guid>
      </item>
   </channel>
</rss>
