Anthropic dice que algunos modelos Claude ya pueden finalizar conversaciones ‘dañinas o abusivas’
Según el titular publicado en TechCrunch por Anthony Ha el 16 de agosto de 2025, Anthropic afirma que ciertos modelos Claude cuentan ahora con la capacidad de terminar conversaciones consideradas 'dañinas o abusivas'. El encabezado sugiere una mejora en las capacidades de moderación o intervención de los modelos, pero en el contenido facilitado no está disponible el cuerpo del artículo ni detalles técnicos, ejemplos, alcance exacto de la función o citas directas de la compañía. Este resumen se ha elaborado exclusivamente a partir del titular y metadatos aportados.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
AnthropicClaudemoderación de conversacionesinteligencia artificialseguridadAnthony Ha
Leer noticia original