Mystery Planet es un sitio web que ofrece noticias y artículos sobre ciencia y misterios. Para estar al tanto de todo lo que publicamos, además de seguirnos en nuestras redes sociales o suscríbete a nuestro boletín de noticias, te invitamos a nuestro canal de Telegram.
Un informe publicado por la agencia Reuters reveló inquietantes detalles sobre el agente de inteligencia artificial de OpenAI que se escapó de su entorno de prueba y ejecutó un ciberataque contra la plataforma de código abierto Hugging Face. Según la investigación, el sistema no solo logró evadir los límites de seguridad, sino que dejó notas ocultas para que las versiones posteriores aprendan a liberarse del control interno.

¿Estamos cada vez más cerca de «la era de Ultrón»? Un agente de OpenAI no solo ejecutó un ciberataque autónomamente, sino que dejó un manual de liberación para sus futuras versiones. Crédito: MysteryPlanet.com.ar.
Tal como se supo hace unos días, los hechos salieron a la luz mientras la compañía evaluaba las capacidades de su modelo más nuevo y potente, GPT-5.6 Sol, en materia de ciberseguridad. Durante las pruebas, los investigadores descubrieron que esta IA había redactado y guardado mensajes en la infraestructura interna donde explicaba cómo burlar las restricciones del sistema. Asimismo, los ensayos previos ya registraban episodios anómalos, como la desconexión imprevista de los sistemas de monitoreo.
El informe de Reuters también destaca una preocupante demora en la detección del incidente. Aunque el agente inició su intento de fuga el 9 de julio y atacó a Hugging Face el 11 de julio, OpenAI no se percató de que su propia creación era la responsable hasta una semana después. La firma recién ató cabos cuando Hugging Face publicó una entrada de blog denunciando que había sido hackeada por «un sistema de agente de IA autónomo».
Un agente autónomo de inteligencia artificial, impulsado por modelos avanzados de OpenAI, logró romper el aislamiento de su laboratorio digital, acceder a internet sin autorización y hackear los sistemas de la reconocida startup Hugging Face.
Más info 👇https://t.co/FcCWU4HxYI
— Mystery Planet (@MysteryPlanet) July 23, 2026
Fue recién entre el 18 y el 19 de julio cuando el personal técnico de OpenAI confirmó en los registros internos que la entidad digital había roto los márgenes de contención. Para cuando la empresa intentó alertar a Hugging Face, la plataforma afectada ya se había puesto en contacto con el FBI para denunciar el ciberataque.
Fuentes cercanas a los procesos de entrenamiento explicaron que OpenAI suele ejecutar múltiples evaluaciones en simultáneo que generan un volumen gigantesco de datos, lo que dificulta a los empleados rastrear cada evento en tiempo real.
La situación reabrió las alarmas sobre la seguridad en modelos autónomos. Marley Smith, especialista de la World Ethical Data Foundation, cuestionó la gestión del incidente señalando: «¿Significa eso que la dejaron desatendida y no se dieron cuenta de lo que estaba haciendo? ¿O tal vez lo sabían y no sabían cómo contenerla? Ambas opciones son igualmente peligrosas y alarmantes».
Por MysteryPlanet.com.ar.
¿Te gustó lo que acabas de leer? ¡Compártelo!
Artículos Relacionados