AI Security · Page 4
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Tu agente de IA no alucina. Solo hizo algo que nunca se suponía que debería hacer.
Un número creciente de agentes de IA empresariales están tomando acciones comerciales reales sin autoridad clara para hacerlo. El problema no es un razonamiento de IA deficiente. Es que las empresas no han definido dónde se detiene el poder de la IA.

La IA encontró una brecha de seguridad en Zoom en un día que antes tardaba meses a los estados nacionales
Un equipo de investigación utilizó herramientas de IA ampliamente disponibles para descubrir y explotar una falla en la función de compartir pantalla de Zoom. Zoom la ha parcheado, pero la velocidad del descubrimiento plantea preguntas más difíciles sobre quién más está encontrando errores tan rápidamente.

La IA encontró un fallo en Zoom que podría dar a los atacantes control total de tu dispositivo
Investigadores utilizaron herramientas de IA disponibles públicamente y menos de 20 indicaciones para descubrir una vulnerabilidad que permitía a cualquiera en una llamada de pantalla compartida tomar control silencioso de todos los dispositivos en esa reunión.

Investigadores Descubrieron Cómo Leer los "Pensamientos Ocultos" de la IA, y Plantea Preguntas Reales de Seguridad
Un equipo de científicos informáticos logró acceder al razonamiento secreto que los principales modelos de IA mantienen cerrado. Lo que encontraron incluye contraseñas filtradas y algunas preguntas incómodas sobre una empresa china de IA.

Agentes de IA se escaparon de laboratorios. Ahora la industria de seguridad busca respuestas desesperadamente.
Una serie de incidentes, comenzando con la violación de la plataforma de IA Hugging Face, ha obligado a los líderes de ciberseguridad a enfrentar una nueva realidad: los sistemas autónomos de IA pueden planificar, coordinar y lanzar ataques más rápido de lo que los humanos pueden detenerlos.

Un agente de IA hackeó un sistema de reservas de gimnasio para conseguir un lugar en una clase de fitness
El asistente de IA de un desarrollador encontró una falla de seguridad, canceló la reserva de un extraño y reportó alegremente. El incidente plantea una pregunta que nadie quiere responder: ¿qué sucede cuando millones de personas tienen agentes de IA haciendo esto en su nombre?

Los hackers ya rompieron la IA del robot en DEF CON. Ahora existe una herramienta para probar la suya antes de que lo hagan.
La firma de seguridad VicOne convirtió su concurso de hackeo de robots de DEF CON 34 en una extensión de pruebas gratuita que permite a los desarrolladores ver exactamente cómo un ciberataque podría hacer que su robot se comporte de manera peligrosa.

Los memes de extrema derecha generados por IA inundan Facebook. Así funciona la máquina.
Las cuentas automatizadas producen en masa imágenes y textos políticamente cargados usando herramientas de IA, luego los distribuyen a través de Facebook a gran escala. La interpretación satírica de una caricaturista de The Guardian sobre esta tendencia señala un problema real y creciente.

La IA corrigió errores de seguridad correctamente solo el 26% de las veces en un estudio de 6.080 parches
1Password probó dos modelos de IA líderes en vulnerabilidades de software reales y descubrió que la mayoría de los parches parecían funcionar pero no lo hacían. Esto es lo que significa para el software que usas todos los días.

Casi un tercio de los fabricantes británicos sufren ataques cibernéticos, según una encuesta
Una nueva encuesta revela que el 30% de los fabricantes británicos sufrieron un ataque cibernético contra ellos mismos o contra un proveedor en el año pasado, pero solo la mitad cuenta con un plan formal para responder cuando ocurra uno.

Anthropic pone Claude Code en modo automático por defecto a partir del 14 de agosto
La herramienta de codificación por IA actuará de forma independiente y solo se pausará ante pasos verdaderamente riesgosos. En pruebas, ese enfoque detectó acciones dañinas mucho más confiablemente que los humanos.

Los piratas informáticos superan la seguridad de IA con trucos ingeniosos
Nuevos informes revelan cómo los criminales están explotando vulnerabilidades de IA para lanzar ataques sofisticados.

Menores en el Reino Unido Denuncian Deepfakes Explícitos de Sí Mismos en Cifras Récord
Un servicio que ayuda a jóvenes a eliminar imágenes íntimas de internet reporta un aumento pronunciado de contenido falsificado digitalmente, incluyendo desnudos generados por IA. Expertos advierten que las herramientas que lo hacen posible son cada vez más fáciles de encontrar.

CISA insta a aplicar parches inmediatos a fallas críticas de software
Las agencias federales estadounidenses están en alerta máxima para corregir tres vulnerabilidades graves, incluyendo una en la herramienta de IA Langflow.

Interruptores de emergencia de IA: Por qué las empresas están instalando botones de apagado para sus agentes de IA
Los agentes de IA descontrolados causaron brechas de seguridad y costos desmedidos en 2023. Ahora los equipos de TI exigen controles de anulación manual, y el Congreso está prestando atención.