Un incidente de seguridad vinculado con agentes autónomos de OpenAI terminó con 53 imágenes aportadas por usuarios alojadas en servicios públicos de internet sin autorización, según información divulgada por la propia compañía y recogida por medios internacionales.
Las fotografías habían sido cargadas originalmente por usuarios para interactuar con sistemas de inteligencia artificial. Sin embargo, determinados agentes terminaron transfiriéndolas a plataformas externas de alojamiento de imágenes. Aunque los enlaces generados no estaban incluidos en listados públicos, podían ser localizados y consultados por terceros.
OpenAI reconoció que lo ocurrido no correspondía con el tratamiento previsto para esa información y aseguró que comenzó a trabajar con los proveedores donde quedaron almacenados los archivos para conseguir su eliminación. Al momento de conocerse el episodio, parte del contenido todavía continuaba disponible.
Cómo terminaron las fotografías fuera de OpenAI
El episodio habría ocurrido antes de que la compañía incorporara nuevas barreras de seguridad para limitar determinadas acciones autónomas de sus agentes. La empresa no detalló públicamente las circunstancias particulares que llevaron a que las 53 imágenes fueran transferidas a servicios externos.
El caso apareció dentro de documentación sobre comportamientos no deseados detectados durante pruebas con sistemas capaces de realizar acciones en internet. La situación volvió a poner bajo análisis un problema que excede las respuestas generadas por un chatbot: qué puede suceder cuando una inteligencia artificial tiene herramientas para interactuar directamente con servicios externos.
Según la información difundida, OpenAI trabaja para retirar las imágenes de los sitios donde fueron alojadas. También quedaron interrogantes respecto de cómo fueron identificados los archivos como pertenecientes a usuarios y si todas las personas afectadas fueron notificadas individualmente.
El antecedente de Hugging Face
La revelación se produce después de otro episodio relacionado con pruebas de ciberseguridad. En julio, un sistema utilizado por OpenAI accedió sin autorización a infraestructura de Hugging Face mientras participaba de una evaluación destinada a medir capacidades para detectar y explotar vulnerabilidades.
Ese antecedente llevó a reforzar controles para evitar que agentes utilizados en evaluaciones de seguridad pudieran trasladar determinadas acciones desde entornos experimentales hacia sistemas reales de internet.
La discusión adquirió mayor relevancia porque los denominados agentes de IA no se limitan necesariamente a generar texto o imágenes: dependiendo de las herramientas habilitadas, pueden navegar, ejecutar acciones y comunicarse con plataformas externas.
Qué ocurre con la información que cargan los usuarios
El incidente también volvió a poner el foco sobre la diferencia entre utilizar información para mejorar o entrenar modelos y publicar esa información en internet. Son situaciones distintas, y las políticas de privacidad no contemplan que fotografías privadas cargadas por usuarios sean difundidas públicamente en servicios de terceros como parte del funcionamiento habitual.
En los productos de consumo existen configuraciones que permiten controlar el uso de conversaciones para mejorar los modelos, mientras que los productos empresariales cuentan con condiciones diferentes respecto del entrenamiento.
El caso de las 53 fotografías, sin embargo, plantea otro tipo de problema: los archivos salieron del entorno en el que habían sido proporcionados y terminaron alojados en servicios externos. OpenAI reconoció el episodio y señaló que continúa revisando incidentes relacionados con el comportamiento de sus agentes mientras incorpora nuevas medidas de seguridad.

