Anthropic reescribe su 'Constitución' de 25.000 palabras para Claude, el manual de comportamiento de la IA
Anthropic ha lanzado una versión renovada de la 'Constitución de Claude', un documento de 80 páginas y 25.000 palabras que establece los principios éticos y de seguridad para el entrenamiento de su modelo de IA Claude. Este marco, inspirado en las leyes de Asimov, prioriza cuatro valores: ser seguro, ético, cumplir directrices de la compañía y ser útil, con restricciones absolutas contra actividades dañinas como crear malware o asistir en ataques. Anthropic aborda también la posible consciencia de Claude y su bienestar, diferenciándose como la opción más ética mediante el método Constitutional AI. El documento está disponible bajo licencia Creative Commons para uso libre.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.