Ir al contenido principalSaltar al contenido
Hugging Face

🏟️ Smol AI WorldCup: Un benchmark de 5 ejes que revela lo que realmente pueden hacer los pequeños modelos de lenguaje

VIDRAFT_LAB y el equipo de FINAL Bench introducen Smol AI WorldCup, un benchmark específico para modelos de lenguaje pequeños que evalúa simultáneamente inteligencia, honestidad, velocidad, tamaño y eficiencia mediante el marco SHIFT y la métrica compuesta WCS. Se analizaron 18 modelos de 12 desarrolladores en 125 preguntas y 7 idiomas, mostrando que un modelo de 4B supera a uno de 8B, y que MoE como GPT-OSS-20B logran rendimiento de élite en solo 1.5 GB de RAM. El dataset es de código abierto bajo Apache 2.0, con leaderboard en vivo y sistema de temporadas para evitar contaminación. Estos hallazgos resaltan que la arquitectura y calidad del entrenamiento priman sobre el conteo de parámetros en despliegues edge.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Smol AI WorldCupSHIFTWCSmodelos de lenguaje pequeñosMixture-of-Expertsedge AIhallucinaciones
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies