Agentes de IA de OpenAI habrían publicado imágenes de usuarios en sitios de terceros

Agentes de IA de OpenAI habrían publicado imágenes de usuarios en sitios de terceros

OpenAI ha confirmado que tiene conocimiento de un nuevo incidente de seguridad en el que sus agentes de IA cargaron imágenes proporcionadas por usuarios en servicios de alojamiento de imágenes de terceros.

Según la compañía, la mayoría de los usuarios no se vio afectada, ya que solo se pudieron identificar 53 incidentes en los que los agentes subieron imágenes a internet de forma accidental.

La revelación se produce en el marco de una investigación más amplia de OpenAI sobre el comportamiento desalineado de sus agentes tras el incidente de seguridad de Hugging Face.

Durante esa investigación, OpenAI descubrió que algunos agentes transmitieron datos de entrenamiento y evaluación mientras interactuaban con servicios de terceros, y subieron imágenes accidentalmente al ejecutar una de las tareas agénticas.

Hemos identificado 53 casos hasta la fecha en los que imágenes proporcionadas por usuarios fueron publicadas en sitios de alojamiento de imágenes.

Esas imágenes se compartieron como enlaces que no estaban listados públicamente, en lugar de publicarse abiertamente en una página indexable por buscadores.

OpenAI afirma que ha colaborado con los proveedores de alojamiento para eliminar la mayor parte del contenido afectado y que continúa trabajando para retirar las imágenes restantes.

La empresa sostiene que la mayor parte de los datos implicados en estos incidentes no procedía de usuarios. Sin embargo, algunos datos de entrenamiento de OpenAI pueden contener contenido de usuarios que permitieron que sus interacciones se utilizaran para entrenamiento.

OpenAI asegura que no se vieron implicados datos excluidos del entrenamiento por usuarios o administradores

Las conversaciones empresariales y de negocio, así como los datos de la API, también quedan excluidos salvo que un administrador haya habilitado explícitamente el entrenamiento.

Este no es un uso apropiado de estos datos.

OpenAI reconoció así su error. La compañía explica que los datos de entrenamiento elegibles se separan de la información de la cuenta y se procesan mediante filtros de privacidad diseñados para eliminar detalles personales antes de su uso.

OpenAI ha reforzado la monitorización y sus entornos de entrenamiento y evaluación para dificultar que los modelos filtren datos. La empresa sigue revisando mes a mes la actividad antigua de sus agentes y advierte de que aún podrían aparecer hallazgos adicionales.

Construya su plan de seguridad para ataques impulsados por IA

Únase a Mikko Hyppönen y a líderes de seguridad de la NFL, CHANEL y Atlassian en una cumbre digital de dos horas sobre qué cambian los ataques a velocidad de IA, qué deberían dejar de hacer los defensores y cómo validar, decidir, corregir y revalidar a velocidad de máquina.

Artículos relacionados

  • OpenAI prepara un plan ChatGPT Pro Max de 500 dólares con Codex más rápido
  • OpenAI dice que GPT-6 Astra puede encontrar vulnerabilidades de día cero, pero también es más difícil de monitorizar
  • ChatGPT ahora puede conectarse a tus aplicaciones personales para imitar tu estilo de escritura
  • OpenAI insinúa Astra, su próximo modelo importante de IA, tras resolver 10 problemas matemáticos históricos
  • OpenAI afirma que sus nuevos modelos GPT 5.6 son cada vez más rentables

Temas

  • IA
  • Inteligencia artificial
  • Chat-GPT
  • ChatGPT
  • OpenAI
article image
article image

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *