Voltar aos projetos

AWS DeepRacer

AWS DeepRacer

Arquivado

Um modelo de aprendizado por reforço para corrida autônoma que ficou em 37º entre cerca de 3.940 competidores na classificatória aberta da AWS de outubro de 2022.

Quando
2022
Minha parte
Líder da equipe de DeepRacer do Insper Dynamics.
  • Python
  • Reinforcement learning
  • AWS
Um carro AWS DeepRacer renderizado sobre fundo roxo, ao lado do logo da AWS DeepRacer League

37º entre cerca de 3.940 competidores na classificatória aberta de outubro de 2022, com o nome G3mha. Isso é o 1% do topo.

Quase todo o resultado veio da função de recompensa, e não do modelo. A recompensa padrão paga o carro por ficar perto da linha central, o que produz um carro que anda devagar, com segurança, e perde. Pagar, em vez disso, pela velocidade mantida na saída da curva, com uma curva de penalidade íngreme o bastante para mantê-lo na pista, produz uma volta mais rápida e muito mais propensa a falhar. A maior parte da temporada de 2022 foi gasta procurando, entre esses dois extremos, o ponto em que um modelo ainda completa a volta.