Ir al contenido principalSaltar al contenido
Hugging Face

Granite 4.2 LLMs: Cómo están construidos

IBM ha presentado la familia de modelos Granite 4.2, la primera serie densa y basada únicamente en razonamiento, disponible en tres tamaños (3B, 8B y 30B). Cada modelo se entrenó desde cero con aproximadamente 15 billones de tokens mediante una estrategia de cinco fases que amplía el contexto hasta 512k tokens, seguida de un refinamiento supervisado y un proceso multi-etapa de aprendizaje por refuerzo. Los tamaños de 8B y 30B también pasan por una fase adicional de aprendizaje por refuerzo con agentes, permitiéndoles utilizar herramientas y actuar en entornos reales. Todos los modelos admiten un modo de pensamiento/desarrollo y un modo de bajo esfuerzo, y están licenciados bajo Apache 2.0.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Granite 4.2IBMmodelos de lenguajearquitecturaaprendizaje por refuerzoentrenamientoIA de razonamiento
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies