Ir al contenido principalSaltar al contenido
Hugging Face

Modelos Granite 4.2 de IBM: cómo se construyeron

IBM presenta la familia Granite 4.2, su primera línea de modelos de lenguaje densos de solo decodificador centrados en el razonamiento, disponibles en tres tamaños: 3B, 8B y 30B. Cada modelo se preentrena desde cero con aproximadamente 15 billones de tokens mediante una estrategia en cinco fases que amplía la ventana de contexto hasta 512K tokens, seguida de un ajuste fino supervisado sobre datos de razonamiento y trayectorias agénticas. Posteriormente se aplica un pipeline de aprendizaje por refuerzo en múltiples etapas que incluye RL agéntica para los modelos de 8B y 30B, enseñándoles a operar herramientas en entornos reales y aislados. Todos los modelos incluyen un interruptor de pensamiento/no pensamiento, un modo de bajo esfuerzo y llamada nativa de herramientas, y se publican bajo licencia Apache 2.0.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

IBM GraniteGranite 4.2modelos de lenguajerazonamientoaprendizaje por refuerzoagentesApache 2.0
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies