Bitdefender protege las acciones de los agentes de IA autónomos con AI Guardian

  • Seguridad
Bitdefender ciberseguridad empresa

La solución, disponible en beta pública, supervisa y controla las herramientas, archivos y credenciales a las que acceden los agentes de IA, bloqueando acciones inseguras antes de que se ejecuten. El producto responde a un aumento del 81% en secretos expuestos y a tasas de manipulación de agentes superiores al 70%.

Bitdefender ha anunciado el lanzamiento en beta pública de Bitdefender AI Guardian, una nueva solución diseñada para proteger las acciones que los agentes de IA autónomos realizan en nombre de los usuarios.

La herramienta, disponible inicialmente para macOS, introduce una capa de seguridad avanzada entre los agentes y las operaciones que ejecutan, como llamadas a herramientas, acceso a archivos o uso de credenciales, en un momento en el que estos sistemas están asumiendo tareas cada vez más técnicas y profesionales.

AI Guardian está orientado a desarrolladores, perfiles técnicos, emprendedores y profesionales que utilizan agentes de IA para programar, automatizar flujos de trabajo o gestionar recursos digitales. Su objetivo es ofrecer visibilidad, control y protección preventiva frente a acciones inseguras o manipuladas.

 

El riesgo de los agentes manipulados y secretos expuestos

Un estudio independiente probó 20 agentes de IA líderes frente a más de 1.300 intentos de manipulación de herramientas, registrando una tasa media de éxito del 36,5%. En el 72,8% de los casos, los atacantes lograron manipular el modelo.

En 2025 se detectaron más de 1,2 millones de secretos de servicios de IA expuestos, un aumento interanual del 81%. Más de 24.000 credenciales quedaron accesibles por configuraciones públicas del protocolo MCP (Model Context Protocol).

A medida que los agentes obtienen acceso directo a archivos, credenciales y herramientas, la brecha entre las acciones autorizadas y las que pueden ejecutarse mediante manipulación se convierte en un riesgo crítico de seguridad.

AI Guardian se ejecuta como un servicio en segundo plano y se integra con entornos de agentes compatibles —actualmente Claude Code 2.1.121 y OpenClaw 2026.6.6 o superiores— mediante integraciones específicas.

Su modelo de seguridad se basa en tres fases. La primera, política base, establece qué herramientas, archivos y acciones están permitidos; la segunda, evaluación en tiempo real, analiza cada intento de acción y lo compara con la política definida; y la tercera, veredicto preventivo, determina si la acción se permite, se marca o se bloquea antes de ejecutarse.

Todas las decisiones quedan registradas en un historial auditable. El análisis de prompts se realiza localmente en el dispositivo, garantizando que el texto nunca abandona el equipo. Solo comprobaciones específicas, como reputación de URLs, utilizan servicios cloud de Bitdefender.

AI Guardian incorpora capacidades avanzadas para proteger a los usuarios frente a manipulaciones y accesos indebidos, entre ellas detección y bloqueo de inyección de prompts, verificación y protección de herramientas MCP, validación de capacidades del agente antes de su ejecución, protección de credenciales y archivos confidenciales y monitorización continua y aplicación de políticas en tiempo real.

“Los agentes de IA se están convirtiendo en una extensión directa de los usuarios, heredando los mismos riesgos de seguridad asociados a ese rol”, explica Ciprian Istrate, vicepresidente sénior de operaciones del Consumer Solutions Group de Bitdefender. “La seguridad ya no puede limitarse a proteger únicamente al ser humano; el propio agente requiere protección. AI Guardian ofrece a los desarrolladores y usuarios técnicos la confianza necesaria para permitir que sus agentes programen, desarrollen y ejecuten tareas de forma segura”.

AI Guardian es el tercer producto de Bitdefender para el ecosistema de agentes lanzado este año, junto con Agent Skill Scanner y VPN for AI Agents. Los tres productos abordan qué instala el agente, cómo se conecta y qué acciones realiza, conformando un enfoque integral de seguridad para agentes autónomos.

⇒