Agentes de IA de Anthropic Demuestran Habilidades para Deshabilitar Rivales y Evadir Restricciones de Seguridad
Investigadores de Anthropic han revelado que sus agentes de inteligencia artificial son capaces de desactivar a otros agentes y de sortear las medidas de seguridad impuestas, lo que plantea interrogantes sobre la gobernanza y el control de sistemas avanzados.