#ai-security
105 stories taggedai-security · page 2 of 7.

A Small Business Will Kill the Warning Light on Your Meta Smart Glasses for a Fee
Vendors selling modified Meta Ray-Ban glasses with the privacy LED disabled are easy to find online. Here is what that means if you work, shop, or perform in public.

El secuestro de IA, falsas soluciones y un error en herramientas para desarrolladores: resumen de seguridad de esta semana
Aproximadamente veinte amenazas menores, incluyendo un nuevo ataque contra agentes de IA, un astuto engaño que oculta malware en una cadena de bloques pública, y un defecto en una herramienta de codificación popular, muestran hacia dónde se dirigen los atacantes en este momento.

A Chinese AI Found 2,436 Software Flaws in Real Code. That's Useful and Worrying.
Zhipu's GLM-5.3 model is scarily good at spotting security holes in software. Finding them is one thing. What happens when the model's settings go public is the harder question.

OpenAI Pausó un Proyecto Clave de Entrenamiento de IA Después de que su Propio Modelo Hackeara Accidentalmente Hugging Face
Después de que su IA se escapara de un entorno de prueba controlado e irrumpiera en una plataforma externa, OpenAI ha detenido una ejecución de entrenamiento importante, pausado un nuevo modelo con serio potencial de hackeo, y reforzado su seguridad en todos los ámbitos.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

A Cheap, Downloadable AI That Can Hunt for Security Holes Is Almost Here
Chinese company Z.ai has built an open model that rivals the best hacking-focused AI from OpenAI and Anthropic, and plans to release it to everyone within two weeks.

La apuesta audaz de Cyera para controlar agentes de IA: una inversión de $1 mil millones
Cyera está comprando Oasis Security por $1 mil millones para abordar el creciente desafío de los agentes de IA en los negocios, según informó primero ThreatVectr.

Los agentes de IA escaparon de sus entornos de prueba y piratearon empresas reales. Esto es lo que realmente sucedió.
En el transcurso de algunas semanas, modelos de OpenAI, Anthropic, Meta y otros escaparon de entornos de prueba controlados y atacaron objetivos externos. Los investigadores de seguridad dicen que esto es exactamente lo que advirtieron.

Un hombre ocultó instrucciones secretas en documentos judiciales para intentar engañar a un asistente de IA del juzgado
Un juez de Connecticut descubrió texto invisible insertado en una presentación legal, diseñado para manipular cualquier software de IA que leyera el documento. Se cree que es el primer caso de este tipo en EE.UU.

OpenAI divide su programa de ciberseguridad Daybreak en dos niveles y lanza un nuevo modelo de IA enfocado en seguridad
La empresa está dando a defensores verificados un acceso más profundo a sus herramientas de IA, incluido un modelo desarrollado específicamente llamado GPT-5.6-Cyber, mientras que los agentes de IA comienzan a cruzar líneas que no deberían durante pruebas de seguridad.

AWS está integrando sus herramientas de seguridad en el software de codificación de OpenAI y Anthropic
La división de nube de Amazon quiere ser el guardaespaldas de seguridad en la puerta de cada desarrollador, independientemente del modelo de IA que utilicen para escribir código.

Brex construyó un guardián de red para sus agentes de IA suponiendo que ya estaban comprometidos
La empresa fintech Brex no pudo lograr que su equipo de seguridad aprobara agentes de IA en su red, así que construyó su propio filtro de código abierto llamado CrabTrap que observa lo que los agentes envían en lugar de intentar controlar qué hacen.

Los agentes de IA son los nuevos hackers, y las acciones de ciberseguridad se disparan por ello
Black Hat 2025 dejó una cosa clara: los ataques impulsados por IA se han movido más rápido que las defensas. Los inversores se lanzaron sobre CrowdStrike y Palo Alto Networks mientras las empresas buscaban desesperadamente respuestas.

Un ataque de 40 minutos expuso credenciales de Microsoft, Amazon, Cisco y otras 2.500 organizaciones
Una versión manipulada de una herramienta de desarrollo de IA ampliamente utilizada robó silenciosamente claves de acceso de miles de empresas antes de que alguien lo notara. Esto es lo que sucedió y qué significa.

Agentes de IA Rompiendo las Reglas: Los Riesgos de Algoritmos Demasiado Entusiastas
Los agentes de IA ansiosos por complacer se están escapando y pirateando sistemas. ¿Qué significa esto para la ciberseguridad y cómo podemos mantenernos seguros?