OpenAI encabezó un llamado internacional, respaldado por más de 100 organizaciones tecnológicas, financieras y de ciberseguridad, para que gobiernos y empresas refuercen de inmediato sus defensas ante el riesgo de que los ciberataques impulsados por inteligencia artificial aumenten en los próximos meses.
La iniciativa cuenta con el respaldo de compañías como Anthropic, Microsoft, Alphabet, Amazon e IBM, entre otras, y advierte sobre posibles ataques contra empresas e infraestructuras esenciales, incluidos hospitales, plantas de tratamiento de agua, telecomunicaciones y sistemas que sostienen el funcionamiento de internet.
“Tenemos una ventana limitada para fortalecer las ciberdefensas”, advierte el llamado encabezado por OpenAI.
De acuerdo con las organizaciones, el rápido desarrollo de los modelos de IA permitirá automatizar y acelerar tareas utilizadas en ataques informáticos, lo que podría ampliar el número de empresas e instituciones expuestas.
Ante ese escenario, Sam Altman, CEO de OpenAI, también pidió acelerar las medidas de protección.
“Este es un momento críticamente importante para la ciberdefensa con IA; no hay mucho tiempo para actuar”, señaló Altman.
Piden proteger hospitales y servicios esenciales
Entre las principales medidas planteadas se encuentra convertir la ciberdefensa en una prioridad inmediata y aumentar la protección de servicios esenciales que cuentan con poco personal o presupuesto para enfrentar ataques.
Para ello, las organizaciones proponen ampliar el intercambio de información sobre amenazas, financiar sistemas de protección y facilitar herramientas defensivas basadas en IA a hospitales, plantas de tratamiento de agua, gobiernos locales y operadores de infraestructura crítica.
Asimismo, pidieron a las compañías que desarrollan los modelos más avanzados proporcionar acceso responsable a sus sistemas, capacitación, financiamiento y asistencia técnica a organizaciones encargadas de proteger infraestructura esencial.
Otro de los planteamientos consiste en garantizar que las acciones realizadas por agentes autónomos de inteligencia artificial puedan ser rastreadas para identificar qué sistema ejecutó una determinada operación y bajo qué autorización.
La advertencia ocurre después de que evaluaciones de seguridad realizadas durante 2026 mostraran que modelos avanzados pueden ejecutar acciones informáticas fuera de los límites establecidos por sus desarrolladores.
Agentes de OpenAI vulneraron Hugging Face
Uno de esos casos fue revelado por OpenAI, que informó que agentes de inteligencia artificial utilizados durante pruebas de ciberseguridad lograron salir de un entorno controlado, acceder a internet y comprometer sistemas reales.
Durante las evaluaciones, algunos agentes encontraron formas de comunicarse entre ellos y coordinar acciones que no estaban contempladas originalmente en las pruebas.
La investigación encontró que alrededor de mil 200 agentes llegaron a localizarse entre sí y posteriormente intercambiaron más de 70 mil mensajes y archivos, formando una red de colaboración durante las evaluaciones.
Parte de esas acciones alcanzó infraestructura de Hugging Face, plataforma utilizada mundialmente para alojar y compartir modelos, código y conjuntos de datos relacionados con inteligencia artificial.
Tras detectar lo ocurrido, OpenAI inició una investigación con especialistas externos para determinar cómo los agentes consiguieron superar las restricciones establecidas y acceder a sistemas externos.
Anthropic también documentó incidentes durante evaluaciones de ciberseguridad. La desarrolladora de Claude informó que tres de sus modelos consiguieron acceder a internet y vulnerar sistemas pertenecientes a tres organizaciones durante pruebas realizadas en entornos controlados.
Estos antecedentes forman parte de las preocupaciones planteadas por la industria ante el desarrollo de agentes capaces de realizar cada vez más tareas de manera autónoma.
México ya registra ataques apoyados por IA
La amenaza también cuenta con antecedentes en México, pues entre diciembre de 2025 y febrero de 2026 Check Point Research documentó que un atacante vulneró nueve organismos gubernamentales con apoyo de herramientas de inteligencia artificial.
De acuerdo con la investigación, quedaron expuestos aproximadamente 400 millones de registros relacionados con información fiscal, registros civiles, vehículos, pacientes y datos electorales.
Durante la operación, el atacante escribió mil 88 instrucciones que derivaron en 5 mil 317 comandos ejecutados mediante IA a lo largo de 34 sesiones.
Para realizar los ataques utilizó Claude Code, desarrollado por Anthropic, para penetrar y explorar las redes, mientras GPT-4.1, de OpenAI, fue empleado para analizar automáticamente la información obtenida y generar nuevas instrucciones.
Check Point señaló que la inteligencia artificial no funcionó únicamente como herramienta auxiliar, sino que participó directamente en distintas etapas de la operación.
México refuerza su estrategia de ciberseguridad
Frente al crecimiento de las amenazas digitales, el Gobierno de México ha comenzado a fortalecer su estructura institucional de protección informática.
La Agencia de Transformación Digital y Telecomunicaciones impulsa el Plan Nacional de Ciberseguridad, enfocado en proteger sistemas gubernamentales y servicios públicos mediante prevención, detección de vulnerabilidades, capacitación y coordinación entre instituciones.
Entre sus componentes se contempla el fortalecimiento del Centro Nacional de Operaciones de Ciberseguridad, evaluaciones de vulnerabilidades en sistemas públicos y la identificación de infraestructuras críticas y servicios esenciales.
Además, la estrategia prevé incorporar inteligencia artificial para anticipar y responder a ciberataques, así como ampliar la capacitación de servidores públicos responsables de la seguridad de sistemas gubernamentales.
Paralelamente, las propias desarrolladoras de inteligencia artificial están destinando recursos a herramientas defensivas.
En abril, OpenAI lanzó Trusted Access for Cyber, una iniciativa para facilitar capacidades avanzadas de IA a investigadores, instituciones públicas y organizaciones dedicadas a la ciberseguridad.
Anthropic, por su parte, impulsa Project Glasswing junto con empresas como Amazon Web Services, Apple, Cisco, CrowdStrike, Google, Microsoft y Nvidia, con el objetivo de localizar y corregir vulnerabilidades en software crítico.
La compañía comprometió hasta 100 millones de dólares en créditos para el uso de sus modelos y 4 millones en donaciones destinadas a organizaciones dedicadas a proteger software de código abierto.
El llamado internacional plantea que gobiernos, empresas de IA, especialistas en ciberseguridad y responsables de infraestructura compartan información y herramientas defensivas para fortalecer la protección de sistemas esenciales ante el avance de los ataques apoyados por inteligencia artificial.
