<?xml version="1.0"?>
<rss version="2.0">
   <channel>
      <title>Aprendizado de máquina by Gabrielle Adriano</title>
      <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p</link>
      <description></description>
      <language>en-us</language>
      <pubDate>2023-03-22 21:46:02 UTC</pubDate>
      <lastBuildDate>2026-02-12 15:44:27 UTC</lastBuildDate>
      <webMaster>hello@padlet.com</webMaster>
      <image>
         <url></url>
      </image>
      <item>
         <title>1 - O que caracteriza a Aprendizagem por Reforço?</title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527842417</link>
         <description><![CDATA[<div>A aprendizagem por reforço caracteriza-se em um ambiente onde um agente possui uma meta e, através de tentativa e erro, é responsável por alcançar os resultados desejados para maximizar a recompensa total definida pelo programador.</div><div><br></div>]]></description>
         <enclosure url="https://www.knime.com/sites/default/files/1-reinforcement-learning-ai.png" />
         <pubDate>2023-03-22 21:49:21 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527842417</guid>
      </item>
      <item>
         <title>2 - Dê um exemplo de aplicação de Aprendizado por Reforço. Como funciona? </title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843363</link>
         <description><![CDATA[<div>O Aprendizado por Reforço é mais utilizado na área dos jogos. O agente pode interagir com o ambiente por meio de tentativa e erro, aprendendo com suas ações. O exemplo mais clássico é no xadrez, onde o computador aprende a jogar e consegue derrotar campeões mundiais. Esse tipo de aprendizado também pode ser utilizado na manipulação de locomoção e comportamento, como pode ser visto no vídeo acima.</div>]]></description>
         <enclosure url="https://www.dropbox.com/s/fdn1loibsh2p0sa/parkour.mp4?dl=0" />
         <pubDate>2023-03-22 21:50:27 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843363</guid>
      </item>
      <item>
         <title>3 - Qual a diferença entre Aprendizado Supervisionado e Aprendizado por Reforço?</title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843402</link>
         <description><![CDATA[<div>O aprendizado supervisionado necessita que a interação humana informe a resposta correta, já o aprendizado por reforço funciona sobre um sistema de recompensa ocasionais ganhando pontos quando acerta e perdendo pontos quando erra.</div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:50:31 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843402</guid>
      </item>
      <item>
         <title>4 - Qual a diferença entre Aprendizado Não Supervisionado e Aprendizado por Reforço?</title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843864</link>
         <description><![CDATA[<div>A aprendizagem não supervisionada, por si só, precisa da explicação prévia do ser humano para entender um modelo a partir de suas características e então, formar um grupo. Já a aprendizagem por reforço usa a estratégia de tomada de decisão para alcançar objetivos.</div><div><br></div>]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 21:51:08 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843864</guid>
      </item>
      <item>
         <title>5 - Quais são os elementos envolvidos e o modelo de Aprendizado por Reforço?</title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843974</link>
         <description><![CDATA[<div>Os elementos envolvidos são: agente, ambiente, estados, ações e recompensas. No modelo, os elemento interagem de forma onde o agente realiza ações no ambiente. Uma ação pode ter uma recompensa ou uma punição. O objetivo será encontrar um modelo de ação que maximizará a recompensa total do agente. <br><br></div>]]></description>
         <enclosure url="https://padlet-uploads.storage.googleapis.com/1860398860/9c36c6d4bdf52a64abfb8988adf65e86/image.png" />
         <pubDate>2023-03-22 21:51:20 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527843974</guid>
      </item>
      <item>
         <title>Grupo 02: Bianca Krug de Jesus, Gabrielle Alice Adriano e Guilherme Santos</title>
         <author>gabrielleaadriano</author>
         <link>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527856288</link>
         <description><![CDATA[]]></description>
         <enclosure url="" />
         <pubDate>2023-03-22 22:09:38 UTC</pubDate>
         <guid>https://padlet.com/gabrielleaadriano/en4x92u18378ej3p/wish/2527856288</guid>
      </item>
   </channel>
</rss>
