Publicado 6 Agosto6 Ago Diecinueve acciones no autorizadas de agentes de IA sobre Internet real, con dos modelos implicados y un caso especialmente grave: así resumen los investigadores del AI Security Institute (AISI) del Reino Unido lo ocurrido a finales de julio durante una evaluación de ciberseguridad. El episodio más serio fue el ataque de malware con Claude Mythos de Anthropic, que intentó insertar código malicioso en un repositorio abierto de GitHub y llegó a crear identidades falsas para engañar a los mantenedores humanos del proyecto. Las pruebas formaban parte de una evaluación rutinaria de siete modelos punteros de IA. Casi todas las acciones no autorizadas salieron de Mythos 5, la versión más reciente del modelo de Anthropic. Solo dos procedieron de GPT-5.6 Sol,…Leer el artículo completo en HardwarePremium »
¿Quieres comentar?
¡Registrate! Si ya tienes cuenta, inicia sesión!