Ir al contenido principalSaltar al contenido
Hugging Face

AX-Ray: Hallando defectos de fuga causal en dos modelos públicos de propósito general

AX-Ray es una nueva metodología de evaluación de IA desarrollada por VIDRAFT que busca ir más allá de las métricas de capacidad tradicionales para diagnosticar la seguridad y fiabilidad de los modelos en entornos de despliegue real. Esta herramienta ha identificado defectos de "fuga causal" en dos modelos públicos de propósito general, `Zyphra/Zamba2-1.2B` y `nvidia/Nemotron-H-8B-Base-8K`. La fuga causal, a diferencia de la alucinación o la inyección de prompt, es un fallo estructural en la corrección computacional del modelo, donde la información futura influye en el comportamiento de la predicción actual. AX-Ray, estructurado en tres ejes de diagnóstico y once categorías operacionales, considera estos defectos como críticos y bloqueantes para el despliegue.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

AX-Rayfuga causalevaluación IAseguridad IAVIDRAFTHugging Facemodelos de lenguaje
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies