GLM-5.3-Flash podría encargarse del 45 % de tus cargas de trabajo de IA
Un modelo misterioso llamado Ox Alpha apareció en OpenRouter con un precio gratuito y un rendimiento sorprendentemente bueno, procesando billones de tokens al día. Seis días después, Z.ai reveló que se trataba de GLM-5.3-Flash, un modelo de pesos abiertos (MIT) servido íntegramente con chips e infraestructura chinos y con un precio muy inferior al de sus competidores. Según Artificial Analysis, el modelo logra un índice de inteligencia de 57 por unos nueve céntimos por tarea, frente a los 67 céntimos de un GPT-5.6 Sol. El artículo argumenta que la economía del consumo por tokens favorece cada vez más a los modelos chinos de código abierto y propone dividir la carga de trabajo en tres niveles, asignando alrededor del 45 % del volumen a GLM-5.3-Flash. También advierte de la presión sobre los presupuestos empresariales de IA y pide contabilizar tokens y redefinir las estrategias de modelos por equipos.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.