MARL: Middleware en tiempo de ejecución que reduce las alucinaciones de los LLM sin ajuste fino
MARL (Model-Agnostic Runtime Middleware for LLMs) es un middleware que inserta un pipeline de auto-verificación multi-etapa en tiempo de ejecución para reducir las alucinaciones en modelos de lenguaje grandes, sin modificar pesos del modelo. Solo requiere cambiar la base_url en código compatible con OpenAI API, funcionando con GPT, Claude, Gemini, Llama y más. Basado en el benchmark FINAL Bench, aborda la brecha metacognitiva (MA-ER Gap), permitiendo que la IA detecte y corrija sus errores mediante roles especializados: hipótesis, solver, auditor, verificador y sintetizador. Ofrece 9 motores de emergencia específicos de dominio y se integra en plataformas como ClawHub. Proporciona trazabilidad glass-box de todo el proceso de razonamiento.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.