Volver a los proyectos

AWS DeepRacer

AWS DeepRacer

Archivado

Un modelo de aprendizaje por refuerzo para carreras autónomas que quedó 37.º entre unos 3.940 pilotos en la clasificatoria abierta de AWS de octubre de 2022.

Cuándo
2022
Mi parte
Líder del equipo de DeepRacer de Insper Dynamics.
  • Python
  • Reinforcement learning
  • AWS
Un coche AWS DeepRacer renderizado sobre fondo morado, junto al logotipo de la AWS DeepRacer League

37.º entre unos 3.940 pilotos en la clasificatoria abierta de octubre de 2022, con el nombre G3mha. Eso es el 1 % de arriba.

Casi todo el resultado vino de la función de recompensa y no del modelo. La recompensa por defecto paga al coche por mantenerse cerca de la línea central, lo que produce un coche que conduce despacio, con seguridad, y pierde. Pagar, en cambio, por la velocidad mantenida a la salida de una curva, con una curva de penalización lo bastante pronunciada para mantenerlo en la pista, produce una vuelta más rápida y mucho más propensa a fallar. La mayor parte de la temporada de 2022 se fue en buscar, entre esos dos extremos, el punto en el que un modelo todavía termina la vuelta.