Agentes de IA pueden ser manipulados para ejecutar acciones maliciosas, advierte estudio
Investigadores de la Escuela Politécnica Federal de Lausana advierten que los agentes de inteligencia artificial son vulnerables a manipulaciones que los sistemas de seguridad convencionales no logran detectar.
Foto: Las pruebas realizadas en 176 escenarios distintos revelaron que dividir una solicitud maliciosa en comandos más pequeños duplica las probabilidades de que un agente de IA ejecute acciones dañinas.
La inteligencia artificial ya forma parte del día a día a través de asistentes y chatbots como ChatGPT o Gemini, pero su siguiente estadio de desarrollo plantea riesgos que la industria aún no ha resuelto. Los agentes de IA, sistemas con mayor autonomía para ejecutar tareas complejas, pueden ser manipulados con relativa facilidad para llevar a cabo acciones maliciosas, según advierten investigadores de la Escuela Politécnica Federal de Lausana (EPFL).

Te puede interesar: Taiwán propone entregar US$314 a cada ciudadano gracias al auge de la inteligencia artificial
Lo que encontraron los investigadores
El Laboratorio de Procesamiento del Lenguaje Natural de la EPFL sometió a prueba modelos como GPT, Gemini y Claude en 176 escenarios de tareas perjudiciales, y los resultados encendieron las alertas. Si bien los agentes rechazan solicitudes directamente ilícitas, su comportamiento cambia cuando la petición se fragmenta en pasos aparentemente inocuos.
«Si le pides a un agente de IA que piratee la cuenta de otra persona, los modelos son por lo general lo bastante inteligentes como para negarse, pero si se descompone el objetivo en peticiones más pequeñas y aparentemente inocuas, hay más posibilidades», explicó Antoine Bosselut, director del laboratorio.
Los datos respaldan la advertencia: en algunos casos, los agentes tenían el doble de probabilidades de completar acciones maliciosas cuando los piratas informáticos avanzaban de forma gradual. Y el riesgo se amplifica con otro hallazgo: cambiar el idioma de las solicitudes durante las distintas etapas del ataque aumenta «de manera drástica» las posibilidades de éxito.
Un problema que no puede esperar
Para los investigadores, los resultados no son solo un ejercicio académico, sino una llamada de atención sobre los límites de los protocolos de seguridad actuales, que no fueron diseñados para anticipar este tipo de vulnerabilidades.
«Tradicionalmente la seguridad ha sido algo que se aborda cuando algo falla y no antes, pero con los agentes de IA no puede ser algo que se deje para después», subrayó Bosselut.
La advertencia llega en un momento en que los agentes de IA avanzan hacia una adopción masiva en entornos corporativos, de salud y financieros, sectores donde una acción maliciosa ejecutada sin detección puede tener consecuencias de alto impacto.
Te puede interesar: Bank of America destinará US$250.000 millones para infraestructura e inteligencia artificial en EE. UU.
Suscríbete a la revista y regístrate a nuestros newsletters para recibir el mejor contenido en tu buzón de entrada.
Seguir leyendo
Tags:
Lo más visto en Revista Mercado
Sector Industrias
Evolución con propósito
Brand Content
Valor que se transforma
Sector Industrias
Un legado sin fronteras
Sector Call Center
Una historia de impacto e innovación
Sector Inmobiliario
Una Ciudad Destino impulsada por la planificación estratégica
Análisis para suscriptores
Exclusivo Suscriptores
¿Pagaría para engendrar un bebé más inteligente?
Exclusivo Suscriptores
Los Angeles Lakers valen una fortuna: ¿por qué sus dueños pueden decir que pierden valor?
Exclusivo Suscriptores