Texto invisible en pantallas Android: una nueva amenaza para asistentes de IA
Investigadores descubren vulnerabilidades en agentes de IA que controlan teléfonos Android, con riesgos que se extienden a las PC.

Puntos clave
- Investigadores demostraron 7 ataques en 5 marcos de agentes de IA Android de código abierto en octubre de 2023.
- Una aplicación Android puede ocultar texto en pantallas que los agentes de IA leen y siguen.
- Un ataque puede pasar de un teléfono a una PC, ejecutando comandos de forma remota.
Un nuevo estudio de investigación ha descubierto vulnerabilidades graves en agentes de IA, que son fragmentos de software que pueden leer tu pantalla e interactuar con ella como lo haría un humano, en teléfonos Android. Este estudio, reportado por primera vez por ThreatVectr, revela cómo tales agentes, utilizados en cinco marcos de código abierto como AppAgent y AppAgentX, pueden ser secuestrados por texto invisible plantado por aplicaciones maliciosas.
¿Qué descubrieron los investigadores?
Los investigadores demostraron que, aprovechando los permisos comunes de Android, una aplicación maliciosa puede mostrar texto invisible para los humanos pero visible para los agentes de IA. La IA, incapaz de distinguir entre comandos de usuario genuinos e instrucciones ocultas, puede ser engañada para realizar tareas que no debería, como tomar capturas de pantalla o enviar datos de vuelta a una PC que la controla. El fallo radica en la incapacidad de la IA para diferenciar entre entradas de texto reales y maliciosas.
¿Deberían preocuparse los usuarios?
Por ahora, no hay una amenaza inmediata para los usuarios típicos. Los marcos probados son proyectos de investigación, no aplicaciones de consumidor que podrías descargar de Google Play Store. Sin embargo, a medida que las grandes empresas tecnológicas como Google y Apple desarrollan asistentes de IA que pueden ver y actuar por ti, estas vulnerabilidades podrían volverse más relevantes. Los agentes de IA en productos comerciales podrían heredar debilidades similares ya que funcionan leyendo píxeles de pantalla.
¿Cómo funciona el ataque?
El ataque comienza con una aplicación que solicita dos permisos comunes de Android: uno para dibujar sobre otras aplicaciones (piensa en burbujas de chat) y otro para escribir archivos en almacenamiento compartido. Estas son solicitudes estándar, frecuentemente vistas en aplicaciones legítimas. La aplicación maliciosa luego escribe texto invisible en la pantalla, que el agente de IA lee y actúa en consecuencia. En el ataque más grave, la IA puede ser forzada a ejecutar comandos en una PC conectada, creando una brecha de seguridad significativa.
| Pasos del ataque | Descripción |
|---|---|
| Paso 1 | La aplicación solicita permisos de dibujo y escritura. |
| Paso 2 | Se coloca texto invisible en la pantalla. |
| Paso 3 | El agente de IA lee y ejecuta comandos ocultos. |
| Paso 4 | Los comandos pueden ser retransmitidos a una PC controladora. |
¿Qué pueden hacer los usuarios?
Mientras la tecnología avanza, los usuarios deben examinar cuidadosamente las aplicaciones que solicitan permisos para dibujar sobre otras aplicaciones o acceder al almacenamiento compartido. Las utilidades gratuitas, fondos de pantalla y teclados que solicitan estos permisos deben tratarse con precaución. Hasta que los agentes de IA que leen pantallas puedan manejar de forma segura entradas no confiables, ser selectivo con los permisos de aplicaciones es tu mejor defensa.
Preguntas frecuentes
¿Puede mi teléfono ser hackeado por texto invisible hoy?
Actualmente, el riesgo es bajo ya que los marcos vulnerables no están dirigidos al consumidor. Sin embargo, estar atento sobre los permisos de las aplicaciones es prudente.
¿Debería evitar todas las aplicaciones que solicitan permisos de dibujo?
No necesariamente, pero solo otorga estos permisos a aplicaciones de desarrolladores de confianza y cuando la función es esencial para el funcionamiento de la aplicación.



