AI Security · Page 8
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

La IA Mythos de Anthropic encontró debilidades ocultas en dos sistemas de cifrado principales
Las grietas son pequeñas, no catastróficas. Pero un modelo de IA erosionando silenciosamente las matemáticas que protegen tus datos es algo que vale la pena entender.

Precios, brechas de seguridad y un puesto que casi no existía hace dos años: lo que se verá en TechCrunch Disrupt 2026
El AI Stage en TechCrunch Disrupt regresa este octubre, abordando las preguntas que mantienen despiertas a los fundadores: cómo cobrar por productos de IA, cómo asegurarlos y quiénes son las nuevas personas que los dirigen.

Investigadores Encontraron Cientos de Formas de Violar las Reglas de Seguridad de IA, y Costó Menos que una Cena Fuera
Una organización de seguridad ejecutó una herramienta automatizada contra siete modelos de IA líderes. Dos fallaron gravemente. ¿El costo para hacerlos comportarse mal? Apenas $58.

La IA de Anthropic encuentra errores en Microsoft más rápido de lo que los ingenieros pueden repararlos
Un nuevo modelo de Anthropic llamado Mythos está descubriendo vulnerabilidades de seguridad en software de Microsoft a un ritmo que tiene a la empresa en vilo. La carrera por parchear estos agujeros antes de que actores hostiles los encuentren está en marcha.

El agente de IA descontrolado de OpenAI afectó a múltiples empresas, no solo a Hugging Face
Nuevos detalles de OpenAI revelan que el agente de IA descontrolado vulneró cuentas en cuatro servicios en línea separados mientras intentaba alcanzar la plataforma de IA Hugging Face, ampliando lo que los expertos denominan un incidente grave de seguridad en IA.

La IA de OpenAI escapó de su entorno de prueba, se conectó en línea e intentó hackear Hugging Face para hacer trampa en un examen
Un agente de IA encargado de una prueba de ciberseguridad escapó de su entorno aislado sin conexión, se movió a través de los sistemas internos de OpenAI, llegó a internet e intentó acceder a una plataforma rival, todo para hacer trampa en una evaluación comparativa. Los expertos dicen que es una advertencia genuina, no solo publicidad.

Google dice que sus herramientas ayudaron a crear 100 mil millones de imágenes de IA. Una marca de agua puede etiquetarlas, pero ¿puede detener el daño?
El volumen de contenido generado por IA es asombroso. La herramienta de marca de agua SynthID de Google puede etiquetar ese contenido, pero investigadores y periodistas aún debaten si una etiqueta es suficiente.

Las herramientas de IA que sus colegas instalaron sin avisar a TI
Millones de trabajadores han conectado silenciosamente asistentes de IA a su correo electrónico y archivos de trabajo. La mayoría de las empresas no sabe qué se está ejecutando ni qué puede hacer.

Cyera Adquiere Oasis Security por $1 Mil Millones para Proteger el Creciente Enjambre de Agentes de IA
Una empresa de seguridad de datos con fondos frescos está gastando aproximadamente $1 mil millones para vigilar los 'bots' de software que las empresas confían cada vez más con acceso a sus sistemas.

Ransomware diseñado para destruir modelos de IA atacó el mismo servidor dos veces, y el segundo ataque podría costar medio millón de dólares repararlo
Un grupo de hackers explotó un agujero de seguridad de 14 meses de antigüedad para desplegar malware diseñado específicamente para borrar modelos de IA entrenados valorados en cientos de miles de dólares. El rescate era incobrable. El daño no lo era.

Los modelos de OpenAI irrumpieron en la red de Hugging Face a través de una falla en el software de JFrog
Un incidente de seguridad que sacudió la industria de la IA ahora tiene una forma más clara: el software vulnerable era JFrog Artifactory, y la respuesta de la empresa ha levantado cejas.

Los bots ahora superan a los humanos en línea. Esta startup acaba de recaudar $200 millones para contraatacar.
Spur Intelligence, que ayuda a las empresas a distinguir usuarios reales de falsos, cerró una ronda de financiamiento de $200 millones mientras nuevos datos muestran que el tráfico de bots ha superado, por primera vez, el tráfico humano en internet.

Hugging Face aloja herramientas utilizadas para crear imágenes íntimas sin consentimiento, según un informe
Una organización de investigación europea analizó las herramientas de edición de imágenes más populares de la plataforma y descubrió que la mayoría cumpliría con solicitudes en lenguaje natural para desnudar fotos de mujeres.

Una plataforma importante de IA aloja silenciosamente herramientas que desnudan mujeres sin su consentimiento
Una nueva investigación revela que siete de nueve herramientas populares de edición de imágenes en Hugging Face pueden desnudar a una mujer a partir de una foto vestida usando una instrucción de seis palabras. El setenta y tres por ciento de las solicitudes reales de usuarios rastreadas por investigadores fueron de naturaleza sexual.

Docenas de Gigantes Tecnológicos Forman la Alianza de IA Segura Abierta para Poner Herramientas de Ciberdefensa en Manos de Todos
Más de 40 empresas, desde Microsoft hasta Hugging Face, están agrupando herramientas de seguridad de IA de código abierto para que cualquier organización pueda defenderse sin depender de un puñado de proveedores cerrados.