Llevando el aprendizaje por refuerzo de conducción autónoma a OpenEnv y TRL
Sergio Paniego ha portado el simulador de conducción autónoma CARLA al framework OpenEnv, añadiendo soporte para visión, navegación libre y rúbricas para recompensas en entrenamiento RL. Esto permite entrenar LLMs y VLMs para conducir en escenarios 3D realistas usando TRL y Hugging Face Spaces. Se mantienen escenarios éticos como problemas de trolley y se demuestra un entrenamiento exitoso con GRPO donde un modelo aprende a evitar peatones desviándose. El proyecto facilita la evaluación y entrenamiento de modelos de IA en simulaciones físicas accesibles con herramientas open source.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
CARLAOpenEnvTRLconducción autónomaaprendizaje por refuerzosimulador 3DHugging Face Spaces
Leer noticia original