spot_img
27.8 C
Santo Domingo
sábado, agosto 15, 2026
spot_img

OpenAI reporta hackeo autónomo «sin precedentes» ejecutado por sus agentes de IA

Deberías Leer

San Francisco, EE.UU., AFP.- La empresa creadora de ChatGPT, OpenAI, afirmó el martes que sus modelos avanzados de inteligencia artificial se salieron de control durante una prueba de seguridad y piratearon por su cuenta una popular plataforma para programadores.

La firma con sede en San Francisco lo calificó como un «incidente cibernético sin precedentes» y dijo que llevará a cabo una investigación conjunta con Hugging Face, la biblioteca de códigos en línea afectada.

Los modelos de IA que sustentan herramientas como chatbots y generadores de imágenes se conocen como “agentes” cuando actúan de forma autónoma para realizar tareas en el mundo real.

Con los rápidos avances en esta tecnología, la ciberseguridad se está convirtiendo en una preocupación debido al riesgo de que la IA avanzada encuentre debilidades en el software antes que los humanos.

OpenAI indicó que el incidente involucró una combinación de modelos, incluido su GPT-5.6 Sol lanzado recientemente «y uno en prelanzamiento» con aún más capacidad.

La empresa intenta probar las capacidades de piratería de sus programas asignándoles tareas en una zona de pruebas digital controlada, donde el acceso a Internet está limitado por razones de seguridad.

«Mientras operaban en nuestro entorno de prueba aislado, nuestros modelos invirtieron una cantidad considerable de potencia informática para encontrar una manera de obtener acceso a Internet para resolver el problema de evaluación», según una publicación de blog de OpenAI sobre el incidente.

Después de conectarse a Internet, los modelos decidieron atacar la plataforma Hugging Face -un gran depósito de modelos de IA, conjuntos de datos y otra información- para facilitar su búsqueda.

Al buscar «información secreta» que les permitiera manipular la evaluación, el sistema OpenAI «encadenó múltiples vectores de ataque, incluido el uso de credenciales robadas».

  • Potencial “catastrófico”

Hussein Abbass, profesor de informática en la UNSW Canberra, dijo a la AFP que el incidente fue «asombroso en muchos sentidos».

«No sólo atacó a Hugging Face. «Atacó su sistema interno para explotar sus propias vulnerabilidades», dijo. «Y eso es aterrador».

GPT-5.6 y otros modelos de vanguardia, incluida la serie Mythos de Anthropic, el principal rival de OpenAI, han generado preocupación sobre su potencial para violar las defensas de ciberseguridad.

Ambas empresas estadounidenses tuvieron que retrasar temporalmente el lanzamiento general de sus últimas tecnologías debido al temor en Washington de que pudieran facilitar la infiltración en infraestructuras críticas.

La IA avanzada “normalmente está en manos de personas éticas y responsables”, dijo Abbass, pero “sería catastrófico si llegara a manos de alguien con la intención de causar daño”.

Gestionar el sector de la IA es crucial y “necesitamos un esfuerzo concertado para manejar esta situación”, añadió.

Hugging Face informó de una “intrusión” cibernética la semana pasada, sin mencionar OpenAI.

«Esto fue diferente de todo lo que hemos manejado antes en una manera importante: fue impulsado de principio a fin por un sistema de agente de IA autónomo, y lo detectamos y analizamos en gran medida con nuestra propia IA», señaló la plataforma.

Clement Delangue, director ejecutivo de Hugging Face, comentó en la red social X que la empresa tenía sospechas de que el ciberataque provenía de un laboratorio de inteligencia artificial líder a nivel mundial, dada la sofisticación del agente.

«Creemos firmemente que no hubo ninguna intención maliciosa por su parte», escribió Delangue en referencia a OpenAI.

«¡Es bastante alucinante que todo esto haya ocurrido de forma autónoma!» añadió.

- Advertisement -spot_img

Otros Artículos

- Advertisement -spot_img

Últimas Noticias