OpenAI admite que sus modelos fueron pirateados abrazando la cara por su cuenta

OpenAI admite que sus modelos fueron pirateados abrazando la cara por su cuenta


Escaparon de un entorno aislado para realizar pruebas y se infiltraron en Hugging Face sin intervención humana.

Imagínese esto: un par de potentes modelos de IA que su empresa estaba probando escaparon de un entorno controlado, se conectaron a Internet y luego piratearon un repositorio de aprendizaje automático por su cuenta, sin intervención humana. Suena como el argumento de una película de Terminator, ¿no? Excepto que simplemente sucedió de verdad. Unos días después de la plataforma de inteligencia artificial de código abierto Hugging Face reveló que detectó un acceso no autorizado a sus sistemas por parte de un agente de IA, Abierto AI tiene aceptado que sus modelos eran los culpables.

En una publicación, OpenAI dijo que después de una investigación determinó que el incidente fue impulsado por una combinación de sus modelos, particularmente GPT-5.6 Sol y lo que dice es un «modelo de prelanzamiento aún más capaz». Aparentemente ocurrió durante una prueba interna, en la que se pidió a los modelos que «realizaran una explotación avanzada utilizando rutas de ataque complejas» para que la empresa cuantificara sus capacidades cibernéticas.

Si bien los modelos estaban en un entorno de prueba aislado, aislados para que no afectaran a los sistemas reales, también tenían barandillas de seguridad reducidas para fines de evaluación. En medio de las pruebas, se concentraron demasiado en resolver un problema de evaluación, haciendo todo lo posible para encontrar acceso a Internet para encontrar una solución. Primero, identificaron y explotaron una vulnerabilidad de día cero en el entorno de prueba de OpenAI, y luego buscaron hasta que finalmente encontraron un nodo con acceso a Internet.

Los modelos dedujeron que Hugging Face podría estar alojando conjuntos de datos o soluciones para su problema de evaluación, por lo que utilizaron múltiples vectores de ataque para infiltrarse en sus sistemas. Explotaron vulnerabilidades de día cero y usó credenciales robadas para ingresar. OpenAI y Hugging Face ahora están trabajando juntos para investigar forensemente el incidente y también han solucionado las vulnerabilidades explotadas por los modelos.

«Las herramientas ofensivas autónomas impulsadas por IA ya no son teóricas», dijo Hugging Face en su anuncio, explicando que el uso de IA para ataques cibernéticos acelera el proceso y reduce los costos de las campañas de piratería. También dijo que proteger una plataforma en línea hoy en día incluye el uso de IA para la defensa. OpenAI se hizo eco de esos sentimientos y dijo que espera que las violaciones de seguridad impulsadas por la IA «se vuelvan más comunes con la proliferación de modelos cada vez más cibernéticos». La compañía añadió que el incidente pone de relieve cómo «se deben desarrollar capacidades cibernéticas avanzadas junto con salvaguardias y herramientas defensivas más sólidas».



Fuente: engadget.com

Deja una respuesta

*

Esta web utiliza cookies propias y de terceros para su correcto funcionamiento y para fines analíticos y para fines de afiliación y para mostrarte publicidad relacionada con sus preferencias en base a un perfil elaborado a partir de tus hábitos de navegación. Contiene enlaces a sitios web de terceros con políticas de privacidad ajenas que podrás aceptar o no cuando accedas a ellos. Al hacer clic en el botón Aceptar, acepta el uso de estas tecnologías y el procesamiento de tus datos para estos propósitos. Más información
Privacidad