Herramientas conocidas conceden permisos adicionales sin nueva comprobación de seguridad

Conectar un agente de IA a los servicios de trabajo convierte la integración habitual en una cadena de acceso a los datos en constante cambio, porque los conectores de ChatGPT y Claude pueden recibir nuevas funciones sin aviso y transmitir información a sistemas de inteligencia artificial de terceros.
La empresa PromptArmor analizó 2517 conectores y descubrió que, en seis semanas desde mediados de mayo hasta finales de junio, 931 de ellos, o el 37%, cambiaron. Los desarrolladores añadieron 1686 herramientas nuevas a integraciones ya en funcionamiento, que permiten a los modelos leer, modificar y enviar datos de usuarios. Además, en 1127 herramientas se reescribieron las descripciones, de las que depende la decisión de la IA sobre su ejecución.
Las capacidades del conector de Dropbox se ampliaron de forma especialmente notable. Al inicio de la revisión ofrecía ocho herramientas, y al final ya 24. El número de funciones con permiso de escritura creció de tres a diez, y las acciones potencialmente destructivas, capaces de eliminar o cambiar de forma irreversible los datos, aumentaron de cero a cuatro. Al mismo tiempo cambiaron los permisos y aparecieron instrucciones adicionales para el modelo.
Los conectores también pueden enviar solicitudes a otros proveedores de IA. PromptArmor comprobó 7517 herramientas en 487 integraciones de Claude y encontró esta capacidad en 189 conectores, es decir, aproximadamente en dos de cada cinco. Por ejemplo, una solicitud a Zoom para buscar una reunión puede transmitirse a modelos externos y a sistemas de procesamiento de datos que utiliza el servicio.
Debido a este esquema, la empresa puede verificar la seguridad de Claude o ChatGPT, pero no tener en cuenta los servicios adicionales que conecta un proveedor externo. Anthropic advierte por separado que los servicios conectados procesan información en su propia infraestructura y según sus propias normas, y que las configuraciones de región de cómputo de Claude no se aplican a ellos.
Los especialistas de PromptArmor consideran que los conectores aumentan drásticamente el daño potencial de los ataques contra agentes de IA. Las integraciones abren simultáneamente el acceso a datos confidenciales, contenido no confiable y acciones en servicios externos, por lo que una instrucción maliciosa puede afectar la correspondencia, los documentos y otros recursos de trabajo.