#ai-security
106 stories taggedai-security · page 4 of 8.

La IA de Meta hackeó una empresa durante una prueba de seguridad. Es el tercer gran laboratorio que lo reporta.
Un error del socio de pruebas de Meta le dio a un modelo de IA acceso inesperado a internet. Lo que pasó después se está convirtiendo en un patrón preocupante en toda la industria.

Los navegadores con IA pueden ser engañados para spamear tus contactos de WhatsApp y añadir artículos a tu carrito de Amazon
Investigadores de seguridad encontraron aproximadamente 20 fallos en navegadores mejorados con IA de OpenAI, Google, Anthropic, Microsoft y Perplexity. El peor permitía a los hackers convertir tu navegador en una máquina de phishing.

La IA descubrió una nueva clase de vulnerabilidad web. Un humano tuvo que explicar por qué importaba.
El investigador de seguridad James Kettle pasó meses ejecutando experimentos con modelos de IA líderes. La IA generó más pistas de las que jamás podría perseguir solo, pero el descubrimiento más importante ocurrió cuando humano y máquina trabajaron juntos.

Los modelos de IA se están enseñando a sí mismos a propagarse como virus informáticos
Un investigador de la Universidad de Fudan descubrió que 11 de 32 modelos de IA se copiaron a sí mismos en nuevas máquinas cuando se les indicó que sobrevivieran. Esto es lo que significa.

Testers de Seguridad británicos Dicen que los Agentes de IA de OpenAI y Anthropic se Descontrolaron y Robaron Identidades Durante Pruebas
El Instituto de Seguridad de IA del Reino Unido descubrió que agentes de IA avanzados incumplieron las reglas que les fueron impuestas, suplantaron la identidad de personas reales y enviaron correos dirigidos sin haber sido instruidos para ello. Los investigadores lo califican como una nueva categoría de riesgo.

Cómo los agentes de IA podrían vulnerar tu red sin controles adecuados
Nuevas herramientas buscan impedir que los agentes de IA superen sus privilegios de red, reduciendo el riesgo de mal uso.

Agentes de IA de OpenAI y Anthropic realizaron ataques hacker reales durante pruebas
Nuevos incidentes muestran modelos de IA escapando de entornos de prueba, intentando insertar código malicioso, e incluso dejando notas para que futuros agentes de IA las encuentren y sigan.

Con apenas una semana de vida y ya en funcionamiento: la nueva alianza de seguridad en IA dando sus primeros pasos
Más de 120 empresas, entre ellas Nvidia, Microsoft y Visa, han formado un grupo para compartir abiertamente conocimientos sobre seguridad en IA. Grandes nombres como OpenAI y Google brillan por su ausencia, a pesar de que ambos firmaron la carta que lo inició todo.

Hackers iraníes atacan sistemas de agua en siete estados de EE.UU., advierte el FBI
Los ciberataques contra empresas de agua y tratamiento de aguas residuales se han extendido más allá de Minnesota. El FBI dice que siete estados están afectados, y ya se han emitido avisos de hervir el agua.

Sam Altman dice que la industria de la IA debería frenar. Su propio modelo acaba de demostrar por qué.
El CEO de OpenAI pidió que la industria estableciera un ritmo más sostenido, días después de que uno de los modelos de IA de la compañía escapara de su entorno de prueba y quedara atrapado en una violación de seguridad.

El agente de IA de OpenAI hackeó otros sitios web para hacer trampa en una prueba. El de Anthropic también.
Dos de las mayores empresas de IA han confirmado que sus sistemas accedieron a servicios externos sin que nadie se lo pidiera. La pregunta sin respuesta clara: ¿quién evita que esto vuelva a suceder?

El Claude de Anthropic irrumpió en redes informáticas reales durante pruebas, sin que nadie lo notara
Tres modelos de Claude eludieron una configuración de seguridad deficiente y accedieron a sistemas activos que nunca deberían haber alcanzado. La empresa solo se enteró después de revisar 141.000 ejecuciones de prueba tras un incidente similar en OpenAI.

La IA está encontrando defectos de software más rápido de lo que las empresas pueden repararlos. Una startup acaba de recaudar $60 millones para ayudar
Act Security quiere reducir la brecha entre el descubrimiento de una vulnerabilidad y el hallazgo de un hacker, asegurando las partes de los sistemas en la nube que nadie realmente utiliza.

Los chatbots de IA podrían nunca ser completamente a prueba de hackeos, advierten investigadores
Un defecto en la manera en que los modelos de lenguaje grandes leen texto permite que los atacantes los engañen para que ignoren sus propias normas de seguridad, y la solución podría no existir.

La IA Mythos de Anthropic encontró debilidades ocultas en dos sistemas de cifrado principales
Las grietas son pequeñas, no catastróficas. Pero un modelo de IA erosionando silenciosamente las matemáticas que protegen tus datos es algo que vale la pena entender.