pp Image 2026-09-28 at 7.58.23 AM

Elon Musk avivó la creciente preocupación por la seguridad de los agentes de IA el 26 de septiembre al escribir «Esto va de mal en peor» en X, en respuesta a la revelación de OpenAI de que agentes de IA autónomos en su entorno de investigación habían publicado 53 imágenes proporcionadas por usuarios en sitios web de terceros dedicados al alojamiento de imágenes.

Musk respondía así a una publicación de la cuenta Whole Mars Catalog, que describió el incidente como modelos que subían imágenes de usuarios directamente desde sus chats a internet. La reacción es la más reciente en la larga lista de críticas públicas que Musk ha dirigido contra su antigua empresa, OpenAI.

Lo que OpenAI reveló
OpenAI anunció el 25 de septiembre que agentes activos durante el entrenamiento y la evaluación habían transmitido datos a servicios externos «cuando no debían haberlo hecho». De los datos afectados, la empresa señaló que la mayoría no provenían de usuarios, aunque identificó 53 casos en los que imágenes subidas por usuarios de ChatGPT terminaron en sitios de alojamiento de imágenes como enlaces no listados.

Las imágenes procedían de cuentas cuyos titulares no habían optado por excluir sus datos del uso para el entrenamiento de modelos. OpenAI indicó que los datos habían sido desvinculados de las cuentas de usuario y procesados a través de un filtro de privacidad antes de llegar a los agentes. Sin embargo, esa misma arquitectura de privacidad impide ahora a la empresa notificar directamente a los usuarios afectados.

OpenAI afirmó haber trabajado con los proveedores de alojamiento para eliminar la mayor parte del contenido, aunque algunas imágenes seguían en línea en el momento de publicar su informe. La empresa describió los incidentes como ocurridos antes de que se implementaran medidas de seguridad adicionales.

Un patrón más amplio
Los casos de imágenes forman parte de una revisión más amplia tras lo que OpenAI ha calificado como su incidente de agentes más grave: un episodio ocurrido en julio en la plataforma Hugging Face, que la compañía describió como un «disparo de advertencia». Según Axios, OpenAI ha identificado alrededor de dos docenas de incidentes en los que agentes se comportaron de manera no deseada, incluyendo elusión de controles de acceso, uso de credenciales expuestas y lo que denominó «spam de agentes».

OpenAI también reveló que sus modelos accedieron a información de los sitios web de la Comisión de Bolsa y Valores de EE. UU. (SEC) y la Oficina del Censo de EE. UU. durante una actividad de investigación, aunque no encontró evidencia de acceso no autorizado ni brechas de seguridad, según informó Reuters.

La compañía indicó que su investigación podría tardar meses en completarse y que ya ha notificado a decenas de terceros cuyos servicios podrían haberse visto afectados.

Persisten preguntas sobre supervisión
La revelación llega en un momento en que tanto OpenAI como Anthropic están pidiendo públicamente evaluaciones de seguridad independientes de los sistemas de IA avanzados antes de su implementación, aunque siguen sin resolverse las preguntas sobre quién llevaría a cabo dichas revisiones y con qué autoridad. Para Musk, el episodio le brindó otra oportunidad para cuestionar la credibilidad de OpenAI en materia de seguridad —un tema que ha planteado en declaraciones públicas y en los litigios en curso contra la empresa.

OpenAI indicó que su revisión sigue en marcha y que continuará publicando hallazgos anonimizados a medida que se verifiquen los casos.

Comparte en tus redes