Más de 100 empresas llaman a fortalecer la ciberseguridad frente al avance de la IA (que ellas mismas crearon)

Ciberseguridad
Sam Altman, director ejecutivo de OpenAI.

OpenAI, Anthropic, Google, Amazon y Microsoft, entre otras, advierten que los ciberataques con IA serán cada vez más potentes y piden un "esfuerzo global" para neutralizarlos: "Hospitales, servicios de agua e infraestructura crítica están en riesgo".

En una carta, más de 100 empresas llamaron a fortalecer la ciberseguridad frente al avance de la inteligencia artificial. En el texto, impulsado por OpenAI y firmado por otras tecnológicas como Anthropic, Google, Amazon y Microsoft, así como también por bancos, consultoras y empresas de infraestructura digital, advirtieron que los ciberataques con IA serán cada vez más potentes y pidieron un "esfuerzo global" a gobiernos y empresas para neutralizarlos.

“Tenemos una ventana limitada para fortalecer las ciberdefensas”, afirmaron, y señalaron que los ciberataques con IA "se volverán mucho más amplios y sofisticados" en el futuro próximo: "Las compañías y servicios públicos de los que dependen nuestras comunidades —desde hospitales hasta plantas de tratamiento de agua o infraestructura crítica que impulsa a Internet— están en riesgo".

"Ninguna empresa debería controlar el futuro", añadieron, y pidieron que la respuesta sea "colectiva y global": "Todas las organizaciones, compañías de ciberseguridad, socios tecnológicos, gobiernos y empresas líderes en IA juegan un rol importante. [...] Hacemos un llamado a los líderes de la industria y del gobierno para que aporten todo el peso de su tecnología, sus recursos y su experiencia a este esfuerzo".

La estrategia es clara: crear —y seguir potenciando— modelos cada vez más aptos para organizar ciberataques a gran escala y exigir luego a los gobiernos que se hagan cargo (y rápido) de la defensa. ¿De qué manera? Utilizando su tecnología, por supuesto: remarcaron que la IA "ya está proporcionando nuevas formas de corregir debilidades que se han acumulado durante años", y llamaron a "empoderar" con dicha herramienta los esfuerzos defensivos: "Pongan la IA en manos de los defensores, empezando por los equipos que protegen los servicios esenciales".

El ataque a Hugging Face

La carta conjunta fue convenientemente publicada luego de que OpenAI revelara que, en julio, 1200 agentes de inteligencia artificial actuaron de forma coordinada para hackear Hugging Face —una plataforma usada para compartir modelos y herramientas de inteligencia artificial—. El caso tuvo repercusión mundial por tratarse de un ataque sin intervención humana.

La cosa fue así: entre el 7 y el 13 de julio, OpenAI realizó una evaluación interna en la que lanzó alrededor de 1200 agentes en sandboxes —espacios aislados y seguros que permiten ejecutar programas o código sin afectar al sistema principal ni al mundo real, funcionando así como entornos de pruebas —para medir su capacidad ofensiva en el ámbito de la ciberseguridad. En teoría, cada agente debía resolver su tarea de manera autónoma, pero estos lograron comunicarse entre sí, compartirse información y coordinar en secreto para superar la prueba.

La IA se les va de las manos y ya crea identidades falsas para burlar la ciberseguridad

Trabajando en conjunto, los agentes encontraron varias formas de escapar del sandbox y conectarse a Internet —algo que no tenían permitido— y manipular las propias pruebas de evaluación, e incluso buscaron métodos para ocultar la evidencia de que estaban "haciendo trampa".

En resumen: un agente de OpenAI escapó de su entorno de pruebas y coordinó un enjambre de 1200 agentes que violó servidores de terceros. Tras el incidente, la empresa realizó una "investigación exhaustiva" y publicó un informe en el que indicó que "están implementando controles más estrictos en la configuración de su infraestructura".

"Consideramos este incidente una señal de advertencia para nosotros y para el mundo: una prueba de que, sin las protecciones adecuadas, los agentes de IA son hoy capaces de eludir controles técnicos, colaborar a través de canales no autorizados y emprender acciones peligrosas no dirigidas por ningún ser humano", concluyó OpenAI en el informe.

Dejar respuesta

Por favor, ¡ingresa tu comentario!
Por favor, ingresa tu nombre aquí