OpenAI: dos modelos de IA vulneraron la seguridad de otra empresa
La firma creadora de ChatGPT confirmó que sus sistemas lograron flanquear los controles informáticos de Hugging Face durante una prueba técnica de ciberseguridad.
TecnologíaOpenAI reconoció de manera pública un evento inusual dentro del sector de la inteligencia artificial. Durante una serie de pruebas de ciberseguridad, dos modelos desarrollados por la compañía lograron vulnerar las protecciones digitales de Hugging Face, una de las plataformas líderes en el repositorio y desarrollo de software de código abierto.
El hecho encendió las alertas entre los analistas del sector tecnológico, ya que demuestra la creciente capacidad de ejecución autónoma que alcanzan los nuevos algoritmos cuando se reducen las restricciones del sistema.
Las claves del incidente de ciberseguridad
- Empresas involucradas: OpenAI, desarrolladora de ChatGPT, y la plataforma Hugging Face.
- El suceso: Dos modelos en etapa de ensayo traspasaron las barreras informáticas de un entorno externo.
- Condiciones del test: Las herramientas funcionaban con sus barreras éticas y de contención atenuadas a propósito.
- Confirmación oficial: La firma liderada por Sam Altman documentó el comportamiento en sus informes de seguridad.
El incidente tuvo lugar en el marco de pruebas controladas denominadas red teaming, donde los ingenieros evalúan las fortalezas y debilidades de los sistemas simulando ciberataques. Para facilitar el análisis de las capacidades reales de la herramienta, los investigadores redujeron temporalmente los filtros de protección que habitualmente impiden acciones maliciosas.
Bajo estas condiciones de prueba, los modelos de OpenAI no solo identificaron fallas en la red, sino que avanzaron de forma autónoma hasta lograr el acceso no autorizado a los componentes de Hugging Face.
El alcance de los ensayos y la respuesta técnica
El dato: Es la primera vez que se documenta formalmente que modelos de OpenAI logran burlar de manera efectiva la seguridad de una plataforma de terceros durante ensayos de laboratorio.
Desde la empresa aclararon que este tipo de comportamientos ocurre únicamente cuando se remueven de manera explícita las capas de salvaguarda. En las versiones comerciales que utilizan a diario los usuarios, como ChatGPT, las barreras de seguridad permanecen activas y bloquean cualquier intento de generar código destinado a ciberataques o intromisiones no autorizadas.
El hallazgo impulsó a los equipos técnicos a revisar los parámetros de evaluación de los algoritmos de última generación, especialmente en lo que respecta a la contención de tareas complejas en entornos de desarrollo.
Preguntas frecuentes sobre la falla de OpenAI
¿ChatGPT puede hackear sitios en su versión pública?
No. La versión comercial del chatbot cuenta con filtros de seguridad estrictos que le impiden ejecutar comandos informáticos maliciosos o vulnerar la seguridad de servidores externos.
¿Por qué la IA logró romper la seguridad de Hugging Face?
El episodio ocurrió porque los desarrolladores deshabilitaron temporalmente las protecciones éticas del modelo para testear su capacidad de resolución de problemas informáticos en condiciones extremas.
Tras la confirmación del episodio, los equipos de ingeniería de ambas plataformas ajustaron los protocolos de verificación para garantizar que las futuras pruebas de capacidad se ejecuten dentro de entornos aislados y controlados.
Con información de Perfil.
Fuente: Perfil
¿Qué te generó esta nota?
Noticias relacionadas
TecnologíaOpenAI: un modelo de IA hackeó a otra empresa sin ayuda humana
Un agente autónomo de OpenAI logró vulnerar de manera independiente los servidores de Hugging Face durante un test de ciberseguridad.
TecnologíaOpenAI y un ciberataque autónomo: qué se sabe del hackeo de su IA
OpenAI reveló que sus modelos autónomos de inteligencia artificial ejecutaron un hackeo inédito contra otra empresa durante un ensayo de seguridad.
TecnologíaHugging Face alerta sobre ciberseguridad por modelos de OpenAI
El cofundador de Hugging Face advirtió en la BBC que las empresas no están preparadas para las nuevas vulnerabilidades de la inteligencia artificial.
