AWS DeepRacer
ArchivadoUn modelo de aprendizaje por refuerzo para carreras autónomas que quedó 37.º entre unos 3.940 pilotos en la clasificatoria abierta de AWS de octubre de 2022.
37.º entre unos 3.940 pilotos en la clasificatoria abierta de octubre de 2022, con el nombre G3mha. Eso es el 1 % de arriba.
Casi todo el resultado vino de la función de recompensa y no del modelo. La recompensa por defecto paga al coche por mantenerse cerca de la línea central, lo que produce un coche que conduce despacio, con seguridad, y pierde. Pagar, en cambio, por la velocidad mantenida a la salida de una curva, con una curva de penalización lo bastante pronunciada para mantenerlo en la pista, produce una vuelta más rápida y mucho más propensa a fallar. La mayor parte de la temporada de 2022 se fue en buscar, entre esos dos extremos, el punto en el que un modelo todavía termina la vuelta.