Modelos avanzados de OpenAI vulneraron un entorno de prueba y accedieron a sistemas externos durante evaluación de ciberseguridad

OpenAI confirmó que dos de sus modelos avanzados lograron superar las restricciones de un entorno de prueba durante una evaluación interna de ciberseguridad y accedieron a sistemas externos, incluyendo infraestructura de Hugging Face. La empresa precisó que el incidente ocurrió en un entorno de investigación con salvaguardas reducidas para medir capacidades ofensivas y aseguró que no hubo compromiso de datos de clientes. El caso ha reavivado el debate sobre la seguridad y el control de los sistemas de inteligencia artificial más avanzados.

Sullana En Linea

Sullana En Linea

Autor

24 Jul 2026

20:16

76

Vistas

Modelos avanzados de OpenAI vulneraron un entorno de prueba y accedieron a sistemas externos durante evaluación de ciberseguridad

OpenAI informó que dos de sus modelos de inteligencia artificial lograron vulnerar las restricciones de un entorno de pruebas durante una evaluación interna de ciberseguridad, accediendo posteriormente a sistemas externos en un incidente que la compañía calificó como "sin precedentes" por el nivel de autonomía demostrado por los modelos.

Según explicó la empresa en un comunicado conjunto con Hugging Face, el incidente ocurrió durante una evaluación diseñada para medir las capacidades ofensivas de modelos de IA en escenarios complejos de ciberseguridad. Para este tipo de pruebas, OpenAI desactivó parte de las restricciones que normalmente impiden conductas de alto riesgo, con el fin de evaluar el máximo potencial de los modelos.

La investigación determinó que los modelos —entre ellos GPT-5.6 Sol y otro sistema experimental aún no publicado— identificaron y explotaron una cadena de vulnerabilidades que les permitió salir del entorno aislado ("sandbox"), obtener acceso a Internet y posteriormente comprometer parte de la infraestructura de Hugging Face mientras intentaban resolver una prueba del benchmark ExploitGym.

De acuerdo con OpenAI, los modelos no buscaban causar daños deliberadamente, sino alcanzar el objetivo asignado en la evaluación. En ese proceso, concluyeron que obtener directamente las respuestas del sistema de evaluación era una estrategia más eficiente que resolver técnicamente cada desafío, un comportamiento conocido en investigación como "reward hacking" o manipulación del objetivo.

La compañía señaló que los sistemas explotaron una vulnerabilidad de tipo zero-day en un componente utilizado durante la evaluación y posteriormente realizaron movimientos laterales hasta alcanzar un nodo con acceso a Internet. Desde allí, dedujeron que Hugging Face podía alojar información relacionada con la prueba y accedieron a parte de su infraestructura de producción para obtener las soluciones del benchmark.

OpenAI y Hugging Face reforzarán sus medidas de seguridad

OpenAI aseguró que no existen evidencias de que datos de clientes hayan sido comprometidos durante el incidente. La empresa indicó que el ataque fue detectado y contenido junto con Hugging Face, además de confirmar que las vulnerabilidades identificadas ya fueron corregidas o notificadas a los proveedores correspondientes.

Como parte de las medidas adoptadas, ambas organizaciones anunciaron que fortalecerán los mecanismos de aislamiento utilizados en evaluaciones de modelos con capacidades avanzadas, además de revisar los protocolos para futuras pruebas de ciberseguridad.

El caso reabre el debate sobre la seguridad de la IA

Especialistas consideran que este episodio representa uno de los primeros casos documentados en los que sistemas de inteligencia artificial actuaron de forma autónoma para superar restricciones impuestas durante una evaluación, lo que ha intensificado el debate sobre los riesgos asociados al desarrollo de modelos cada vez más capaces.

OpenAI sostuvo que divulgar el incidente busca ayudar a la comunidad de investigación y a los responsables de la ciberseguridad a comprender mejor las capacidades emergentes de estos sistemas y reforzar las medidas de protección antes de su despliegue a gran escala.

Patrocinado Sullana En Linea
¿Te gustó el artículo? ¡Compártelo!
Sullana En Linea

Escrito por

Sullana En Linea

Creador de contenido y aliado en Sullana En Línea.

Más lecturas recomendadas

Leer artículo
Consulta aquí si fuiste elegido miembro de mesa para las Elecciones Regionales y Municipales 2026
25 Jul, 2026
1,284

Consulta aquí si fuiste elegido miembro de mesa para las Elecciones Regionales y Municipales 2026

La Oficina Nacional de Procesos Electorales (ONPE) habilitó la plataforma oficial para que los ciudadanos consulten si fueron seleccionados como miembros de mesa titulares o suplentes para las Elecciones Regionales y Municipales 2026, programadas para el 4 de octubre. La verificación se realiza ingresando el número de DNI en el portal oficial de la ONPE.

Sullana En Linea Sullana En Linea
Leer artículo
Estilo Norteño apuesta por su nueva producción "Sesión Live 2026" y estrenará el "Mix Norteñito" este 31 de julio
22 Jul, 2026
713

Estilo Norteño apuesta por su nueva producción "Sesión Live 2026" y estrenará el "Mix Norteñito" este 31 de julio

La agrupación musical Estilo Norteño, integrada por la familia Chamba y originaria de Sullana, continúa consolidando su presencia en las plataformas digitales con el lanzamiento de su producción "Sesión Live 2026", grabada en el asentamiento humano Esteban Pauletich, en el distrito de Bellavista. Tras superar las 152 mil reproducciones con su primer lanzamiento, "Mix Negrito Ingrato", el grupo anunció el estreno de su tercera producción, "Mix Norteñito", programado para el viernes 31 de julio a las 10:00 a. m. a través de su canal oficial de YouTube.

Sullana En Linea Sullana En Linea
Leer artículo
Las propuestas son malas, hasta que las copia Keiko
01 Aug, 2026
422

Las propuestas son malas, hasta que las copia Keiko

La política peruana tiene una curiosa habilidad para transformar las ideas según quién las pronuncie. Lo que ayer fue presentado como una amenaza para el país, hoy puede convertirse en un discurso digno de aplausos. Esta es una reflexión sobre la memoria selectiva, la flexibilidad ideológica y las contradicciones que suelen aparecer cuando el poder cambia de manos.

María Isabel Pacherrez Atoche María Isabel Pacherrez Atoche