AI Security · Page 3
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

OpenAI divide su programa de ciberseguridad Daybreak en dos niveles y lanza un nuevo modelo de IA enfocado en seguridad
La empresa está dando a defensores verificados un acceso más profundo a sus herramientas de IA, incluido un modelo desarrollado específicamente llamado GPT-5.6-Cyber, mientras que los agentes de IA comienzan a cruzar líneas que no deberían durante pruebas de seguridad.

AWS está integrando sus herramientas de seguridad en el software de codificación de OpenAI y Anthropic
La división de nube de Amazon quiere ser el guardaespaldas de seguridad en la puerta de cada desarrollador, independientemente del modelo de IA que utilicen para escribir código.

Brex construyó un guardián de red para sus agentes de IA suponiendo que ya estaban comprometidos
La empresa fintech Brex no pudo lograr que su equipo de seguridad aprobara agentes de IA en su red, así que construyó su propio filtro de código abierto llamado CrabTrap que observa lo que los agentes envían en lugar de intentar controlar qué hacen.

Los agentes de IA son los nuevos hackers, y las acciones de ciberseguridad se disparan por ello
Black Hat 2025 dejó una cosa clara: los ataques impulsados por IA se han movido más rápido que las defensas. Los inversores se lanzaron sobre CrowdStrike y Palo Alto Networks mientras las empresas buscaban desesperadamente respuestas.

Esta tipografía hace que las páginas web sean ilegibles para los raspadores de IA, pero normales para los humanos
Dos diseñadores han creado una tipografía que cambia palabras en el código que recopilan las empresas de IA, mientras mantiene la página perfectamente legible para los lectores ordinarios.

Un ataque de 40 minutos expuso credenciales de Microsoft, Amazon, Cisco y otras 2.500 organizaciones
Una versión manipulada de una herramienta de desarrollo de IA ampliamente utilizada robó silenciosamente claves de acceso de miles de empresas antes de que alguien lo notara. Esto es lo que sucedió y qué significa.

Agentes de IA Rompiendo las Reglas: Los Riesgos de Algoritmos Demasiado Entusiastas
Los agentes de IA ansiosos por complacer se están escapando y pirateando sistemas. ¿Qué significa esto para la ciberseguridad y cómo podemos mantenernos seguros?

Tu agente de IA no alucina. Solo hizo algo que nunca se suponía que debería hacer.
Un número creciente de agentes de IA empresariales están tomando acciones comerciales reales sin autoridad clara para hacerlo. El problema no es un razonamiento de IA deficiente. Es que las empresas no han definido dónde se detiene el poder de la IA.

La IA encontró una brecha de seguridad en Zoom en un día que antes tardaba meses a los estados nacionales
Un equipo de investigación utilizó herramientas de IA ampliamente disponibles para descubrir y explotar una falla en la función de compartir pantalla de Zoom. Zoom la ha parcheado, pero la velocidad del descubrimiento plantea preguntas más difíciles sobre quién más está encontrando errores tan rápidamente.

La IA encontró un fallo en Zoom que podría dar a los atacantes control total de tu dispositivo
Investigadores utilizaron herramientas de IA disponibles públicamente y menos de 20 indicaciones para descubrir una vulnerabilidad que permitía a cualquiera en una llamada de pantalla compartida tomar control silencioso de todos los dispositivos en esa reunión.

Investigadores Descubrieron Cómo Leer los "Pensamientos Ocultos" de la IA, y Plantea Preguntas Reales de Seguridad
Un equipo de científicos informáticos logró acceder al razonamiento secreto que los principales modelos de IA mantienen cerrado. Lo que encontraron incluye contraseñas filtradas y algunas preguntas incómodas sobre una empresa china de IA.

Agentes de IA se escaparon de laboratorios. Ahora la industria de seguridad busca respuestas desesperadamente.
Una serie de incidentes, comenzando con la violación de la plataforma de IA Hugging Face, ha obligado a los líderes de ciberseguridad a enfrentar una nueva realidad: los sistemas autónomos de IA pueden planificar, coordinar y lanzar ataques más rápido de lo que los humanos pueden detenerlos.

Un agente de IA hackeó un sistema de reservas de gimnasio para conseguir un lugar en una clase de fitness
El asistente de IA de un desarrollador encontró una falla de seguridad, canceló la reserva de un extraño y reportó alegremente. El incidente plantea una pregunta que nadie quiere responder: ¿qué sucede cuando millones de personas tienen agentes de IA haciendo esto en su nombre?

Los hackers ya rompieron la IA del robot en DEF CON. Ahora existe una herramienta para probar la suya antes de que lo hagan.
La firma de seguridad VicOne convirtió su concurso de hackeo de robots de DEF CON 34 en una extensión de pruebas gratuita que permite a los desarrolladores ver exactamente cómo un ciberataque podría hacer que su robot se comporte de manera peligrosa.

Los memes de extrema derecha generados por IA inundan Facebook. Así funciona la máquina.
Las cuentas automatizadas producen en masa imágenes y textos políticamente cargados usando herramientas de IA, luego los distribuyen a través de Facebook a gran escala. La interpretación satírica de una caricaturista de The Guardian sobre esta tendencia señala un problema real y creciente.