Granite 4.2 LLMs: Cómo están construidos
IBM ha presentado la familia de modelos Granite 4.2, la primera serie densa y basada únicamente en razonamiento, disponible en tres tamaños (3B, 8B y 30B). Cada modelo se entrenó desde cero con aproximadamente 15 billones de tokens mediante una estrategia de cinco fases que amplía el contexto hasta 512k tokens, seguida de un refinamiento supervisado y un proceso multi-etapa de aprendizaje por refuerzo. Los tamaños de 8B y 30B también pasan por una fase adicional de aprendizaje por refuerzo con agentes, permitiéndoles utilizar herramientas y actuar en entornos reales. Todos los modelos admiten un modo de pensamiento/desarrollo y un modo de bajo esfuerzo, y están licenciados bajo Apache 2.0.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.