AWS DeepRacer
ArquivadoUm modelo de aprendizado por reforço para corrida autônoma que ficou em 37º entre cerca de 3.940 competidores na classificatória aberta da AWS de outubro de 2022.
37º entre cerca de 3.940 competidores na classificatória aberta de outubro de 2022, com o nome G3mha. Isso é o 1% do topo.
Quase todo o resultado veio da função de recompensa, e não do modelo. A recompensa padrão paga o carro por ficar perto da linha central, o que produz um carro que anda devagar, com segurança, e perde. Pagar, em vez disso, pela velocidade mantida na saída da curva, com uma curva de penalidade íngreme o bastante para mantê-lo na pista, produz uma volta mais rápida e muito mais propensa a falhar. A maior parte da temporada de 2022 foi gasta procurando, entre esses dois extremos, o ponto em que um modelo ainda completa a volta.