Ir al contenido principalSaltar al contenido
Hugging Face

JetBrains lanza Mellum2: un modelo de mezcla de expertos de 12B

JetBrains ha lanzado Mellum2, un modelo de mezcla de expertos (MoE) de 12 mil millones de parámetros, entrenado desde cero en lenguaje natural y código. Este modelo activa solo 2.5 mil millones de parámetros por token, lo que lo hace muy eficiente para inferencias de baja latencia y alto rendimiento. Mellum2 está optimizado para diversas tareas de lenguaje natural y desarrollo de software, como enrutamiento, RAG, resumen, subagentes y despliegues privados, ofreciendo un rendimiento competitivo con una inferencia más de dos veces más rápida que modelos de tamaño similar. Se distribuye bajo la licencia Apache 2.0 y su objetivo es mejorar la eficiencia y control de los sistemas de IA.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Mellum2JetBrainsmodelo de mezcla de expertosMoElenguaje naturalcódigoinferencia eficienteApache 2.0
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies