Ir al contenido principalSaltar al contenido
Hugging Face

IBM Granite 4.2: una nueva familia de modelos de lenguaje de razonamiento densos y.open source

IBM ha presentado Granite 4.2, su nueva familia de modelos de lenguaje de razonamiento densos y de solo decodificación, disponible en tres tamaños: 3B, 8B y 30B. Estos modelos se entrenan desde cero con aproximadamente 15 billones de tokens mediante una estrategia de cinco fases que incluye aprendizaje supervisado, ajuste con razonamiento en cadena de pensamiento y un pipeline de aprendizaje por refuerzo multietapa con entornos reales. Los modelos de 8B y 30B incorporan un bloque de RL agentico que enseña a utilizar herramientas como editores de código, terminales y búsqueda web dentro de entornos reales. Todos los modelos disponen de un interruptor de razonamiento activado/desactivado, un modo de esfuerzo reducido y llamadas a herramientas nativas. Granite 4.2 se lanza bajo licencia Apache 2.0 y soporta múltiples idiomas, destacando en benchmarks de razonamiento, codificación agentica y comprensión de instrucciones.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

IBM GraniteGranite 4.2modelos de lenguajeaprendizaje por refuerzoGRPOApache 2.0preentrenamiento
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies