Ir al contenido principalSaltar al contenido
Hugging Face

Llevando el aprendizaje por refuerzo de conducción autónoma a OpenEnv y TRL

Sergio Paniego ha portado el simulador de conducción autónoma CARLA al framework OpenEnv, añadiendo soporte para visión, navegación libre y rúbricas para recompensas en entrenamiento RL. Esto permite entrenar LLMs y VLMs para conducir en escenarios 3D realistas usando TRL y Hugging Face Spaces. Se mantienen escenarios éticos como problemas de trolley y se demuestra un entrenamiento exitoso con GRPO donde un modelo aprende a evitar peatones desviándose. El proyecto facilita la evaluación y entrenamiento de modelos de IA en simulaciones físicas accesibles con herramientas open source.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

CARLAOpenEnvTRLconducción autónomaaprendizaje por refuerzosimulador 3DHugging Face Spaces
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies