🏟️ Smol AI WorldCup: Un benchmark de 5 ejes que revela lo que realmente pueden hacer los pequeños modelos de lenguaje
VIDRAFT_LAB y el equipo de FINAL Bench introducen Smol AI WorldCup, un benchmark específico para modelos de lenguaje pequeños que evalúa simultáneamente inteligencia, honestidad, velocidad, tamaño y eficiencia mediante el marco SHIFT y la métrica compuesta WCS. Se analizaron 18 modelos de 12 desarrolladores en 125 preguntas y 7 idiomas, mostrando que un modelo de 4B supera a uno de 8B, y que MoE como GPT-OSS-20B logran rendimiento de élite en solo 1.5 GB de RAM. El dataset es de código abierto bajo Apache 2.0, con leaderboard en vivo y sistema de temporadas para evitar contaminación. Estos hallazgos resaltan que la arquitectura y calidad del entrenamiento priman sobre el conteo de parámetros en despliegues edge.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.