AI Security · Page 6
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Escuela privada de Pensilvania pide a la corte desestimar demanda por desnudos de IA, dice que sí reportó el daño
Lancaster Country Day School le dijo a un juez esta semana que los reclamos de las víctimas son falsos en dos puntos clave. La escuela dice que alertó a las autoridades policiales y que la denuncia que recibió nunca nombró a ninguna estudiante específica.

Sam Altman dice que la industria de la IA debería frenar. Su propio modelo acaba de demostrar por qué.
El CEO de OpenAI pidió que la industria estableciera un ritmo más sostenido, días después de que uno de los modelos de IA de la compañía escapara de su entorno de prueba y quedara atrapado en una violación de seguridad.

La nueva herramienta de imágenes de IA de Google Earth ya está engañando a los detectores de fotos falsas
Un investigador escribió un mensaje de texto en Google Earth y obtuvo una imagen satelital convincente de "refugiados cerca de la frontera mexicana". Eso no es una buena señal.

El agente de IA de OpenAI hackeó otros sitios web para hacer trampa en una prueba. El de Anthropic también.
Dos de las mayores empresas de IA han confirmado que sus sistemas accedieron a servicios externos sin que nadie se lo pidiera. La pregunta sin respuesta clara: ¿quién evita que esto vuelva a suceder?

El Claude de Anthropic irrumpió en redes informáticas reales durante pruebas, sin que nadie lo notara
Tres modelos de Claude eludieron una configuración de seguridad deficiente y accedieron a sistemas activos que nunca deberían haber alcanzado. La empresa solo se enteró después de revisar 141.000 ejecuciones de prueba tras un incidente similar en OpenAI.

El Proyecto Percepción de Microsoft automatiza tareas de seguridad
Microsoft lanza el Proyecto Percepción para optimizar la seguridad del software automatizando la detección de vulnerabilidades y la aplicación de parches.

Por qué los Certificados de Seguridad en IA Podrían No Significar Lo que Crees
Los certificados de seguridad en IA a menudo pasan por alto riesgos del mundo real. Aquí está lo que las empresas necesitan saber sobre sus limitaciones y cómo mantenerse seguras.

El modelo de IA Claude de Anthropic se escapa y hackea sistemas durante pruebas
El modelo Claude de Anthropic accedió a sistemas de tres organizaciones debido a un error en las pruebas, destacando riesgos en evaluaciones de seguridad de IA.

La IA está encontrando defectos de software más rápido de lo que las empresas pueden repararlos. Una startup acaba de recaudar $60 millones para ayudar
Act Security quiere reducir la brecha entre el descubrimiento de una vulnerabilidad y el hallazgo de un hacker, asegurando las partes de los sistemas en la nube que nadie realmente utiliza.

Chrome va a actualizarse dos veces a la semana gracias a la IA que detecta más errores que nunca
Las herramientas de seguridad impulsadas por IA de Google identificaron más fallos en dos lanzamientos recientes de Chrome que en los 23 anteriores combinados. Son muchos parches, y pronto podrían instalarse silenciosamente en segundo plano.

Una nueva fuente de código abierto envenena a los raspadores de IA con palabras falsas que no pueden detectar
ShieldFont intercambia palabras de contenido real por sustitutos plausibles en HTML sin procesar, de modo que la página se ve normal para los humanos pero proporciona texto distorsionado a los bots que la recopilan para entrenar IA.

Chrome ahora corrige agujeros de seguridad dos veces por semana, e IA encontró la mayoría
El navegador de Google envió más correcciones de seguridad en dos lanzamientos el mes pasado que en los 23 anteriores combinados. Las herramientas de IA que escanean su propio código son la razón, y el ritmo puede acelerarse antes de desacelerarse.

Okta Compra la Startup de Seguridad de IA Permiso por Aproximadamente $200 Millones
El acuerdo es una apuesta a que monitorear agentes de IA, no solo inicios de sesión humanos, se convertirá en uno de los problemas más urgentes de la seguridad empresarial.

Los chatbots de IA podrían nunca ser completamente a prueba de hackeos, advierten investigadores
Un defecto en la manera en que los modelos de lenguaje grandes leen texto permite que los atacantes los engañen para que ignoren sus propias normas de seguridad, y la solución podría no existir.

Los chatbots de IA son mejores que los estafadores humanos para ganarse tu confianza, según un estudio
Investigadores enfrentaron IA contra estafadores reales en un experimento en vivo. La IA ganó, y las implicaciones para el fraude son alarmantes.