Google presenta un benchmark de modelos de IA para el desarrollo en Android
Google ha lanzado 'Android Bench', un leaderboard que evalúa el rendimiento de modelos de IA en tareas reales de desarrollo para Android, extraídas de repositorios públicos de GitHub. Las soluciones se verifican mediante pruebas unitarias e instrumentadas, revelando que Gemini 3.1 Pro lidera con el mejor puntaje, seguido de Claude Opus 4.6. Este benchmark ayuda a los equipos de ingeniería a identificar modelos que entienden las particularidades de la plataforma Android y mejoran la calidad de las aplicaciones. Google ha publicado la metodología, dataset y harness en GitHub para garantizar transparencia e integridad, evitando contaminación de datos.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.