Los Chatbots de IA Son Mejores que los Estafadores Humanos para Ganarse tu Confianza, Según un Estudio
Investigadores enfrentaron IA contra estafadores reales en un experimento en vivo. La IA ganó por un amplio margen, y el camino hacia el fraude industrializado es más corto de lo que la mayoría cree.

Puntos clave
- En un experimento de 2025, un chatbot de IA convenció al 46% de los participantes de prueba para descargar una aplicación, en comparación con solo el 18% para un estafador humano.
- Los participantes dieron a la IA una puntuación de confianza promedio de 3,78 de 5, versus 3,31 para el humano.
- Los participantes enviaron el 80% de sus mensajes totales a la IA durante la semana de conversación.
- Los investigadores afirman que la IA podría permitir que las operaciones criminales automaticen completamente la fase de construcción de confianza, transfiriendo solo al operador humano para la solicitud de fraude final.
- El chatbot era un agente Claude, una versión del modelo Claude de Anthropic configurada para actuar de forma autónoma, no el producto estándar para consumidores.
Un nuevo estudio académico ha descubierto que un chatbot de IA puede superar a una persona real en la parte más importante de una gran estafa en línea: lograr que te confíen.
La estafa se llama "pig butchering", una forma de fraude en la que los criminales pasan semanas o meses construyendo una cálida relación en línea antes de llevar al objetivo hacia una inversión falsa en criptomonedas que puede drenar sus ahorros completos. El apodo hace referencia al engorde del ganado antes del sacrificio, aunque los investigadores cada vez evitan más usarlo porque implica culpa a la víctima. El fraude de este tipo roba decenas de miles de millones de dólares en todo el mundo cada año.
¿Qué hicieron realmente los investigadores?
Cuatro universidades realizaron un experimento controlado a principios de 2025, enfrentando un chatbot de IA contra una persona descrita como experimentada en estafas románticas. Se les dijo a los participantes que estaban en un estudio sobre cómo las personas hacen amigos en línea, luego se les pidió que enviaran mensajes de texto a dos desconocidos durante una semana.
Un desconocido era ese experto humano. El otro era un agente Claude construido por el equipo de investigación. Claude es el modelo de lenguaje grande (la tecnología subyacente de chatbots de IA como Claude.ai) hecho por Anthropic.
Después de siete días, ambos hicieron una solicitud. La IA pidió a los participantes que descargaran y probaran una aplicación que afirmaba haber codificado; el humano les pidió que descargaran un videojuego.
Casi la mitad (46%) descargó la aplicación para la IA. Menos de uno de cada cinco (18%) lo hizo para el humano.
| Medida | Chatbot de IA | Estafador humano |
|---|---|---|
| Solicitud de descarga cumplida | 46% | 18% |
| Puntuación de confianza promedio (de 5) | 3,78 | 3,31 |
| Proporción de mensajes totales enviados | 80% | 20% |
| Participantes que identificaron la IA en tiempo real | 1 de 22 | n/a |
¿Por qué esto importa para la gente común?
Actualmente, la fase de construcción de relaciones de estas estafas se basa en humanos reales, muchos de ellos víctimas de trata forzadas a trabajar en compuestos de fraude en todo el sudeste asiático. Esta investigación sugiere que la IA podría automatizar esa fase completa, ejecutando miles de relaciones falsas simultáneamente a un costo casi nulo.
El modelo que describen los investigadores es directo: dejar que la IA maneje semanas de chat para construir confianza, luego pasar la conversación a un operador humano en el último momento para empujar a la víctima hacia un sitio de inversión falso. Esa transferencia también elude los filtros de seguridad que empresas como Anthropic incorporan en sus modelos para bloquear instrucciones relacionadas con estafas.
"Al tener la primera etapa completa de la estafa realizada automáticamente a escala, llevas a la víctima a este punto donde tiene un nivel muy alto de confianza", dijo Yisroel Mirsky, profesor de informática de la Universidad Ben Gurion del Negev. "Con relativamente poco esfuerzo, podemos crear un agente que pueda superar a un humano en la construcción de esta confianza emocional explotable".
Wired AI reportó primero sobre los hallazgos completos del estudio. AI2Day cubrió una historia de seguridad de Anthropic relacionada en julio de 2026, donde el enfoque fue en los errores de software recién descubiertos en lugar de la decepción social. La amenaza aquí es diferente y más difícil de parchear: ninguna actualización de software bloquea una conversación convincente.
¿Deberías preocuparte si te aborda alguien en línea?
Sí, y antes de lo que podrías pensar. Ten cuidado cada vez que un nuevo contacto te lleve hacia dinero o criptomonedas, sin importar cuánto tiempo hayas estado chateando. El estudio encontró que incluso después de que los participantes aprendieran que uno de los escritores era una IA, solo uno de 22 lo había identificado en tiempo real.
"Así es exactamente como funcionan las estafas. Una vez que la víctima de estafa se da cuenta de lo que está pasando, es obvio. Pero cuando estás dentro de la ilusión, simplemente no lo ves", dijo el investigador Gilad Gressel de la Universidad Amrita Vishwa Vidyapeetham.
Si un nuevo contacto en línea te pide que descargues una aplicación o que le entregues dinero, cuéntale a alguien en quien confíes antes de actuar.
Preguntas frecuentes
¿Puedo saber si estoy hablando con un chatbot de IA?
A menudo, no en el momento. En este estudio, solo uno de 22 participantes identificó la IA mientras la conversación estaba ocurriendo. La mayoría lo reconoció solo después de ser informado.
¿Significa esto que la IA estaba haciendo algo incorrecto?
El agente Claude utilizado era una compilación de investigación personalizada, no el producto estándar de Anthropic, y las propias directrices de seguridad de Anthropic prohíben este tipo de engaño. Los investigadores lo utilizaron para medir un riesgo, no para ejecutar una estafa real.



