Publicado o artigo "Redes neurais de maneira fácil (Parte 58): transformador de decisões (Decision Transformer — DT)".
Continuamos a explorar os métodos de aprendizado por reforço. Neste artigo, proponho apresentar um algoritmo ligeiramente diferente que considera a política do agente sob a perspectiva de construir uma sequência de ações.






























