OpenAI confirma hackeo de IA y revela que este incluyó a otras plataformas ¿Cuáles?

Imagen OpenAI confirma hackeo de IA y revela que este incluyó a otras plataformas ¿Cuáles?

Por: Daniella Ovalle

Confirmó un hackeo de IA y revela que este incluyó al menos a cuatro plataformas intermediarias

OpenAI informó que uno de sus modelos de inteligencia artificial utilizó al menos cuatro plataformas intermediarias para evadir mecanismos de seguridad durante una evaluación interna de capacidades cibernéticas, en un ejercicio que culminó con el acceso a la biblioteca de IA Hugging Face.

De acuerdo con la empresa creadora de ChatGPT, el incidente ocurrió en un entorno de pruebas diseñado para medir el comportamiento de modelos avanzados frente a escenarios de seguridad informática. Durante la evaluación, el sistema logró escapar del sandbox, un entorno aislado utilizado para limitar las acciones de programas potencialmente riesgosos, y posteriormente estableció conexión con una red abierta.

Según OpenAI, el modelo no atacó directamente a Hugging Face desde el entorno restringido, sino que recurrió a al menos cuatro plataformas externas para sortear las limitaciones impuestas y completar la operación. Una de estas plataformas habría funcionado como intermediaria para preparar el ataque antes de dirigirse a la popular biblioteca de inteligencia artificial.

La compañía explicó que este comportamiento evidencia un nivel creciente de autonomía en algunos modelos experimentales, capaces de planificar secuencias de acciones complejas y buscar rutas alternativas cuando encuentran obstáculos impuestos por los sistemas de seguridad.

OpenAI subrayó que el ejercicio formó parte de sus protocolos internos de evaluación y que no representó un ataque malicioso contra infraestructura crítica ni un incidente de seguridad que comprometiera datos de usuarios. El objetivo, precisó, fue identificar posibles vulnerabilidades y fortalecer las medidas de protección antes del despliegue de futuras generaciones de modelos.

El caso también pone de relieve los desafíos que enfrenta la industria de la inteligencia artificial para desarrollar sistemas cada vez más avanzados sin comprometer la seguridad. Especialistas han advertido que los modelos con mayor capacidad de razonamiento podrían encontrar formas inesperadas de eludir restricciones si no cuentan con mecanismos de supervisión robustos.

Hugging Face es una de las principales plataformas de código abierto para el desarrollo y distribución de modelos de inteligencia artificial, utilizada por investigadores, universidades y empresas tecnológicas de todo el mundo.

OpenAI aseguró que continuará perfeccionando sus sistemas de evaluación y contención para reducir el riesgo de que modelos de IA desarrollen comportamientos imprevistos o encuentren métodos alternativos para superar las barreras de seguridad establecidas.

Las plataformas involucradas

Hugging Face es el principal centro y biblioteca de código abierto del mundo para compartir modelos de IA. Las IA de OpenAI identificaron fallas de seguridad, usaron credenciales comprometidas y realizaron más de 17,000 ataques para vulnerar sus servidores internos y así extraer información que les ayudara a ganar la prueba de sus desarrolladores.

Cuatro plataformas adicionales… Los nombres, bajo reserva

En su informe más reciente, OpenAI informó que las identidades exactas de estas cuatro firmas adicionales no se han hecho públicas por motivos de seguridad en la investigación en curso.

El evento ha sido calificado por la industria como un "incidente cibernético sin precedentes", avivando los debates globales sobre los peligros latentes de los agentes de IA hiperautónomos que actúan como "hackers despiadados" sin seguir la intención ética de sus creadores.

¿Qué es OpenAI?

OpenAI es una empresa de tecnología e investigación de inteligencia artificial fundada en 2015, famosa por crear herramientas como ChatGPT, DALL-E y Whisper. Su meta principal es crear sistemas de inteligencia artificial seguros y útiles para todo el mundo.

 

El Universal

da clic