Varonis Agent IBAC mantiene a los agentes de IA dentro de sus límites previstos

Agent IBAC: Control de acceso basado en la intención para agentes de IA

Varonis ha anunciado Agent Intent-Based Access Control (IBAC), una nueva funcionalidad en Varonis Atlas que permite a las empresas conectar agentes de IA a sus datos corporativos con salvaguardas que detienen comportamientos peligrosos o fuera de las políticas. Los agentes están acaparando titulares por actuaciones desviadas, exponiendo datos confidenciales de la empresa y, en un caso, borrando por completo una base de datos de producción.

Agent IBAC compara la instrucción que recibe un agente con su razonamiento y las herramientas y datos a los que accede, respondiendo en tiempo real a acciones que no se alinean, ya sea alertando o bloqueando. Cuando un agente cruza la línea, Atlas puede poner en cuarentena la identidad detrás de él y bloquear todo lo que siga durante un período definido.

Agent IBAC puede ajustarse para tomar la acción adecuada según el impacto potencial. Por ejemplo:

  • Desviación clara que pone en riesgo los datos: Un usuario pide a un agente que consulte el clima, pero este invoca una herramienta de migración. Es una clara discrepancia entre intención y acción. Agent IBAC puede bloquear automáticamente la llamada a la herramienta.
  • Deriva sin riesgo: Un usuario pide al agente que consulte el clima, pero este configura un recordatorio diario recurrente en lugar de dar una respuesta única. La acción del agente se ha desviado, pero no hay datos en riesgo. Agent IBAC puede simplemente registrar la desviación en lugar de interrumpir un intento excesivamente servicial.

Con Agent IBAC, Varonis Atlas brinda a las empresas la confianza de que sus agentes actúan dentro del alcance previsto, sin frenar innecesariamente la productividad. Agent IBAC es un componente crítico de la seguridad agéntica y una parte central del enfoque integral de Atlas para la seguridad de la IA.

En Varonis, estamos construyendo la capa de seguridad que permite a las empresas decir 'sí' a los agentes. Vea esta demostración rápida de 3 minutos para ver Agent IBAC en acción.

Los agentes no esperan permisos

Los agentes necesitan acceso amplio a datos y herramientas para ser útiles, lo que precisamente los hace riesgosos. El control de acceso basado en roles nunca fue diseñado para juzgar lo que una identidad no humana hace con el acceso que tiene. Los controles estáticos no pueden detener a un agente que encuentra formas de evadirlos por completo, como elevar sus propios privilegios, llamar a herramientas y actuar sobre datos que nunca debió tocar. Los permisos de los agentes deben aplicarse en tiempo de ejecución.

La pregunta ya no es '¿Puede un usuario acceder a estos datos?' sino 'En este contexto, ¿debería permitirse a este agente actuar sobre estos datos?', explica Ron Bennatan, vicepresidente de Estrategia de IA y Datos en Varonis.

Breach at the Beach: El CTF definitivo de Entra ID

Ya sea que esté en un equipo rojo, un equipo azul o necesite obtener créditos CPE, esta es su oportunidad de aprender haciendo. Breach at the Beach es gratuito y está disponible para jugar en línea: https://breachatthebeach.com

Varonis Atlas Agent IBAC

Agent IBAC cierra la brecha entre lo que un agente está permitido hacer y lo que fue diseñado para hacer. La deriva se determina en parte monitoreando el comportamiento. Agent IBAC evalúa cada acción que un agente realiza a lo largo de una sesión y compara esas acciones con la instrucción que puso al agente en marcha, ya sea que esa instrucción provenga de una persona, un mensaje del sistema u otro agente.

Debido a que Atlas ve el contexto completo de una acción, no depende de restricciones generales. La sensibilidad de la detección y la acción tomada en respuesta pueden ajustarse adecuadamente.

  • Detección de deriva de intención: Compara la instrucción recibida por el agente con su razonamiento y las herramientas que llama, con configuraciones de sensibilidad flexible, equilibrada y estricta.
  • Evaluación de sesión completa: Revisa cada mensaje, respuesta y llamada a herramienta en una sesión para detectar deriva que se acumula gradualmente, incluidos intentos de jailbreak de múltiples turnos. Los equipos también pueden escribir sus propias políticas de sesión en lenguaje natural.
  • Salvaguardas en tiempo de ejecución: Alertar, bloquear, modificar, registrar o enrutar una acción a una persona para aprobación, configurado por política.
  • Cuarentena: Bloquea una identidad o sesión durante un período establecido por el cliente, con controles de administrador para levantar, extender o hacer permanente la medida.
  • Registro de auditoría completo: Registra cada mensaje, respuesta y ejecución de herramienta junto con la acción que Atlas tomó, para equipos de seguridad, gobierno y cumplimiento.

Es importante destacar que Atlas se sitúa en línea entre el agente y el modelo que lo impulsa. Cada mensaje, cada respuesta del modelo y cada llamada a herramienta fluye a través de Atlas antes de llegar a su destino. Esto es lo que hace posible la aplicación en tiempo real. Atlas no lee registros después del hecho. Está en la ruta y puede detener una acción antes de que se ejecute.

Detección de deriva de intención

Agent IBAC utiliza un evaluador LLM, el mismo motor detrás de todas las salvaguardas de Atlas, para juzgar si la acción de un agente se deriva de la instrucción dada. La detección de deriva incluye determinar si el agente accede a datos que no debería, intenta exfiltración o descarga no autorizada de datos, o amplía el alcance más allá de lo que el usuario pretendía.

El evaluador lee el bucle del agente: el razonamiento que produce, las herramientas que selecciona y los parámetros que les pasa. Luego se pregunta: ¿Estos pasos se alinean con la solicitud? La sensibilidad es ajustable en tres niveles. Flexible da a los agentes margen para improvisar y marca solo discrepancias claras. Equilibrado es el predeterminado. Estricto requiere una alineación cercana entre la solicitud y la acción, y es el ajuste adecuado para agentes que manejan datos regulados o de alto valor.

Evaluación de sesión completa

Agent IBAC evalúa la acción del agente en toda la sesión: cada mensaje, respuesta y llamada a herramienta. Esto permite detectar la deriva que se desarrolla gradualmente, donde ninguna acción individual parece alarmante, pero el camino acumulativo conduce a un lugar no intencionado.

La misma vista de sesión completa también permite detectar ataques de múltiples turnos, como intentos de jailbreak distribuidos en varios mensajes que individualmente parecen benignos. Las sesiones se rastrean por el ID de conversación que asigna la herramienta de IA, por lo que una sola evaluación puede abarcar desde el primer mensaje hasta el último.

Esto es importante porque los agentes llevan memoria hacia adelante. Un mensaje posterior puede apoyarse en un contexto establecido varios turnos atrás, que es precisamente cómo un atacante paciente ensambla un jailbreak a partir de piezas que cada una parecen inofensivas. Los equipos también pueden escribir sus propias políticas de sesión en lenguaje natural y establecer cuántos eventos deben acumularse antes de que se ejecute la evaluación.

Salvaguardas de tiempo de ejecución y cuarentena

Cada detección basada en la intención se combina con salvaguardas de tiempo de ejecución de IA que actúan en tiempo real. Las acciones son personalizables, incluyendo alertar, bloquear, modificar (por ejemplo, redactar datos confidenciales), registrar actividad o requerir aprobación humana en el circuito.

Las salvaguardas pueden personalizarse para permitir desviaciones de bajo riesgo mientras se detienen acciones de alto riesgo. Por ejemplo, un usuario pide a un agente que resuma una cuenta de cliente, pero el agente comienza a tirar de registros de un conjunto mucho más grande de cuentas de las solicitadas. Esto no es necesariamente malicioso, pero la ampliación del alcance toca datos más sensibles de lo que la solicitud justifica. En este caso, Agent IBAC puede señalarlo para aprobación humana antes de que continúe.

La cuarentena va un paso más allá. Cuando una violación justifica más que detener una sola acción, Atlas puede poner en cuarentena la identidad detrás de la sesión. Cada mensaje posterior se bloquea durante un período establecido por el cliente, desde un par de minutos hasta un día completo. Los administradores ven cada identidad en cuarentena en un solo lugar y pueden levantar la cuarentena, extenderla o hacerla permanente. La detección le indica que un agente se desvió. La cuarentena detiene el siguiente intento.

Registro de auditoría completo

Atlas registra cada acción y la intención detrás de ella, dando a los investigadores un rastro completo: lo que el agente hizo, si cada acción se derivó de la solicitud y qué salvaguardas se activaron. Una vista de conversación muestra el intercambio tal como el usuario lo experimentó. Una vista de ejecución lo expande para incluir las llamadas a herramientas subyacentes, los pasos que nunca aparecen en la ventana de chat y donde reside la mayor parte del riesgo de los agentes.

La confianza es la métrica definitiva para el éxito agéntico

El éxito agéntico en la empresa no se medirá por cuántos agentes se despliegan, sino por cuántos de ellos pueden ser confiados. Agent IBAC es parte de cómo Varonis Atlas hace posible eso, dando a los equipos de seguridad una forma de confirmar que los agentes actúan como se pretende, en tiempo real, sin frenar el negocio.

Es una pieza del enfoque más amplio de Atlas para asegurar los agentes que una organización construye y ejecuta, junto con capacidades como AI-SPM, AI Red Teaming y AI Detection & Response. Agent IBAC está disponible hoy para los clientes de Varonis Atlas.

Patrocinado y escrito por Varonis.

Varonis Atlas Agent IBAC detects when an agent takes unintended actions that deviate from the user's request.
Varonis Atlas Agent IBAC detects when an agent takes unintended actions that deviate from the user's request.
Varonis Atlas Agent IBAC monitors agent intent throughout the session to detect cumulative drift.
Varonis Atlas Agent IBAC monitors agent intent throughout the session to detect cumulative drift.
With AI runtime guardrails, Varonis Atlas takes real-time action when intent deviations are detected.
With AI runtime guardrails, Varonis Atlas takes real-time action when intent deviations are detected.
Varonis Atlas audits every action and action intent across the entire session for investigations and reporting.
Varonis Atlas audits every action and action intent across the entire session for investigations and reporting.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *