Ir al contenido principalSaltar al contenido
Hugging Face

MARL: Middleware en tiempo de ejecución que reduce las alucinaciones de los LLM sin ajuste fino

MARL (Model-Agnostic Runtime Middleware for LLMs) es un middleware que inserta un pipeline de auto-verificación multi-etapa en tiempo de ejecución para reducir las alucinaciones en modelos de lenguaje grandes, sin modificar pesos del modelo. Solo requiere cambiar la base_url en código compatible con OpenAI API, funcionando con GPT, Claude, Gemini, Llama y más. Basado en el benchmark FINAL Bench, aborda la brecha metacognitiva (MA-ER Gap), permitiendo que la IA detecte y corrija sus errores mediante roles especializados: hipótesis, solver, auditor, verificador y sintetizador. Ofrece 9 motores de emergencia específicos de dominio y se integra en plataformas como ClawHub. Proporciona trazabilidad glass-box de todo el proceso de razonamiento.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

MARLmiddlewarealucinaciones LLMmetacogniciónFINAL BenchVIDraftauto-verificación
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies