Quizás los agentes de IA puedan ser abogados después de todo
La reciente publicación de Anthropic del modelo Opus 4.6 ha sacudido las tablas de clasificación de agentes de IA en el benchmark de Mercor para tareas profesionales como el análisis legal y corporativo. El modelo ha alcanzado casi el 30% en pruebas de un solo intento y un promedio del 45% con varios intentos, un salto significativo desde los puntajes inferiores al 25% anteriores. Incluye nuevas funciones agenticas como 'enjambres de agentes' que ayudan en la resolución de problemas multistep. Brendan Foody, CEO de Mercor, ha calificado el progreso como 'insano'. Aunque aún lejos del 100%, indica que los avances en modelos fundacionales no se ralentizan y los abogados deberían estar menos confiados en su inmunidad ante la IA.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.