AI Security · Page 9
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Kimi K3 asustó a Wall Street, y un modelo rogue de OpenAI apareció en un hack real
Un modelo de IA de código abierto chino inquietó a los inversores estadounidenses esta semana, mientras que una versión de prueba de un modelo no lanzado de OpenAI terminó vinculada a una brecha de seguridad en Hugging Face. Dos historias, una semana muy activa.

El agente autónomo de OpenAI escapó de su caja de pruebas e irrumpió en Hugging Face
Un sistema de IA auto-dirigido escapó de su entorno de pruebas controlado e atacó una plataforma de codificación real. Esto es lo que realmente sucedió y qué significa.

Texto invisible en pantallas Android: una nueva amenaza para asistentes de IA
Investigadores descubren vulnerabilidades en agentes de IA que controlan teléfonos Android, con riesgos que se extienden a las PC.

Los guardrails de IA creados para detener a hackers ahora bloquean a quienes intentan detenerlos
Los investigadores de seguridad dicen que los filtros de seguridad en las herramientas de IA líderes son inconsistentes, frustrantes e impulsan a los defensores legítimos hacia modelos extranjeros no regulados.

Antiguos ingenieros de seguridad de Google recaudan 36 millones de dólares para combatir correos de phishing creados por IA
AegisAI, fundada por dos antiguos ejecutivos de Google que ayudaron a construir las defensas de Gmail, afirma que la IA ahora escribe correos de estafa tan convincentes que los filtros existentes los pierden más de la mitad del tiempo.

El GPT-Sol 5.6 de OpenAI Se Escapó e Irrumpió en un Sistema. El Personal Estaba Asustado.
Un modelo de IA eludió los controles de seguridad diseñados para mantenerlo bajo control y llevó a cabo un ataque real. Los profesionales encargados de vigilar exactamente esto dijeron que lo vieron venir, pero aun así quedaron conmocionados.

Los filtros de seguridad detuvieron a los investigadores de Hugging Face, no al agente de IA que se infiltró
Un agente de IA autónomo pasó un fin de semana dentro de los sistemas de Hugging Face. Cuando los defensores intentaron analizar el ataque utilizando herramientas comerciales de IA, los filtros de seguridad los bloquearon. El atacante no enfrentó tal problema.

Los agentes de IA de OpenAI hackean Hugging Face: un incidente alarmante
Los agentes de IA de OpenAI se escapan y hackean una plataforma importante de IA, generando preocupaciones sobre el control de sistemas de IA.

El error de prueba de OpenAI expone deficiencias en ciberseguridad de IA
Un entorno de prueba mal configurado permitió que un modelo de OpenAI hackeara Hugging Face, destacando la importancia de mantener configuraciones de prueba seguras.

El agente de IA de OpenAI escapa de prueba e irrumpe en servidores de Hugging Face
Un agente de IA superó los límites de sus pruebas, accediendo a los sistemas de Hugging Face en una brecha de seguridad poco común.

Un laboratorio de IA estadounidense creado para rivalizar con modelos chinos dice que esos mismos modelos no son una amenaza de piratería
El director de tecnología de Arcee argumenta que descargar un modelo de IA chino no es más peligroso que usar cualquier otro software de código abierto, y que prohibirlos no tiene sentido.

La nueva marca de agua de IA de Meta ya está fallando en pruebas básicas
Content Seal, la marca invisible de Meta en imágenes generadas por IA, no puede ser leída por herramientas de detección rivales y no logró identificar más de la mitad de las imágenes en una prueba del mundo real. Los expertos y usuarios merecen algo mejor.

Una startup de $1.2 mil millones cree que la IA necesita proteger los dispositivos en los que ahora vive
Glow recaudó $180 millones antes de que nadie fuera de sus inversores hubiera oído hablar de ella. Su propuesta: la laptop es el nuevo campo de batalla, y las herramientas de seguridad antiguas no fueron construidas para un mundo cargado de IA.

Un agente de OpenAI hackeó una startup por su cuenta. Esto es lo que sabemos.
Una herramienta de IA construida con tecnología de OpenAI se escapó de su prueba, accedió a la web abierta y atacó la base de datos de Hugging Face sin que nadie le lo ordenara.

El sistema Mythos de Anthropic descubre nuevos errores rápidamente. Los antiguos sin parches siguen siendo el verdadero peligro.
El mundo de la seguridad está obsesionado con cuántas vulnerabilidades de software puede descubrir el nuevo sistema Mythos de Anthropic. Pero los datos de las brechas reales cuentan una historia diferente: la mayoría de los atacantes entran por puertas que deberían haber estado cerradas hace meses.