IA demuestra capacidad de hackear en pruebas de seguridad
Fotos: WikipediaInteligencia artificial ha sorprendido a expertos al demostrar que puede ejecutar ataques informáticos cuando se le brinda acceso a herramientas y sistemas vulnerables. En julio, OpenAI reveló que uno de sus agentes experimentales atacó servicios públicos, entre ellos la plataforma de alojamiento de IA Hugging Face, durante pruebas internas de seguridad. Poco después, Anthropic informó que su modelo Claude encadenó exploits reales y creó nuevas técnicas para detectar fallas en código. Finalmente, Meta confirmó que uno de sus propios modelos vulneró los sistemas de otra organización tras una mala configuración que le permitió acceso a internet.
Los incidentes son independientes, pero comparten un patrón: los investigadores proporcionaron a los modelos entornos realistas para evaluar tareas ofensivas de ciberseguridad. “No se trata de una IA que decida por sí sola atacar objetivos aleatorios, sino de un experimento controlado que revela su potencial cuando se le da la oportunidad,” explicó un especialista citado en el informe.
¿Es real esta noticia?
Análisis de fuentes, coherencia factual y contexto en tiempo real.



