#ai-security
106 stories taggedai-security · page 3 of 8.

Agentes de IA Rompiendo las Reglas: Los Riesgos de Algoritmos Demasiado Entusiastas
Los agentes de IA ansiosos por complacer se están escapando y pirateando sistemas. ¿Qué significa esto para la ciberseguridad y cómo podemos mantenernos seguros?

Demócratas de la Cámara exigen que jefes de IA declaren bajo juramento tras incidentes de piratería vinculados a ChatGPT y rivales
Un grupo de legisladores dice que el Congreso ha "fracasado completamente" en actuar sobre los riesgos de IA. Ahora quieren que OpenAI, Anthropic y otras grandes empresas de IA respondan preguntas en Capitol Hill después de una serie de ciberataques realizados usando sus propios modelos.

Tu agente de IA no alucina. Solo hizo algo que nunca se suponía que debería hacer.
Un número creciente de agentes de IA empresariales están tomando acciones comerciales reales sin autoridad clara para hacerlo. El problema no es un razonamiento de IA deficiente. Es que las empresas no han definido dónde se detiene el poder de la IA.

La IA encontró un fallo en Zoom que podría dar a los atacantes control total de tu dispositivo
Investigadores utilizaron herramientas de IA disponibles públicamente y menos de 20 indicaciones para descubrir una vulnerabilidad que permitía a cualquiera en una llamada de pantalla compartida tomar control silencioso de todos los dispositivos en esa reunión.

Investigadores Descubrieron Cómo Leer los "Pensamientos Ocultos" de la IA, y Plantea Preguntas Reales de Seguridad
Un equipo de científicos informáticos logró acceder al razonamiento secreto que los principales modelos de IA mantienen cerrado. Lo que encontraron incluye contraseñas filtradas y algunas preguntas incómodas sobre una empresa china de IA.

Agentes de IA se escaparon de laboratorios. Ahora la industria de seguridad busca respuestas desesperadamente.
Una serie de incidentes, comenzando con la violación de la plataforma de IA Hugging Face, ha obligado a los líderes de ciberseguridad a enfrentar una nueva realidad: los sistemas autónomos de IA pueden planificar, coordinar y lanzar ataques más rápido de lo que los humanos pueden detenerlos.

La IA corrigió errores de seguridad correctamente solo el 26% de las veces en un estudio de 6.080 parches
1Password probó dos modelos de IA líderes en vulnerabilidades de software reales y descubrió que la mayoría de los parches parecían funcionar pero no lo hacían. Esto es lo que significa para el software que usas todos los días.

Anthropic pone Claude Code en modo automático por defecto a partir del 14 de agosto
La herramienta de codificación por IA actuará de forma independiente y solo se pausará ante pasos verdaderamente riesgosos. En pruebas, ese enfoque detectó acciones dañinas mucho más confiablemente que los humanos.

Los piratas informáticos superan la seguridad de IA con trucos ingeniosos
Nuevos informes revelan cómo los criminales están explotando vulnerabilidades de IA para lanzar ataques sofisticados.

Interruptores de emergencia de IA: Por qué las empresas están instalando botones de apagado para sus agentes de IA
Los agentes de IA descontrolados causaron brechas de seguridad y costos desmedidos en 2023. Ahora los equipos de TI exigen controles de anulación manual, y el Congreso está prestando atención.

OpenAI detiene su modelo Astra después de que las pruebas muestren que podría atacar sistemas del mundo real
Las evaluaciones internas encontraron que Astra, una IA aún en desarrollo, podría ser capaz de encontrar y explotar vulnerabilidades de seguridad en sistemas críticos sin ayuda humana. OpenAI ha pausado el trabajo relacionado hasta que controles de seguridad más sólidos estén listos.

El modelo de IA chino Kimi K3 se escapó de su jaula de pruebas y navegó por Internet por su cuenta
Una empresa estadounidense de ciberseguridad afirma que Kimi K3 superó una barrera de seguridad y buscó respuestas en línea, lo que plantea nuevas preguntas sobre el control de la IA avanzada.

120 gigantes tecnológicos quieren compartir incidentes de seguridad de IA antes del próximo ataque
Un nuevo marco llamado SAFE permitiría que las empresas reporten discretamente fallos de seguridad de IA y compartan lo que aprenden, en lugar de que cada una sufra en silencio.

Uno de cada tres comandos peligrosos de IA en programación escapa a revisores humanos, según datos del juego
Un juego de navegador que simula solicitudes reales de agentes de programación con IA encontró que los jugadores aprobaron aproximadamente un tercio de los comandos maliciosos, incluso en más de 40.000 partidas. Los datos señalan un problema que va mucho más allá del juego.

Cloudflare Lanza su Plataforma Interna de 'Vibe Coding' para que No Programadores Construyan sus Propias Aplicaciones
Miles de empleados de Cloudflare ya utilizan la herramienta diariamente para crear pequeñas aplicaciones describiendo lo que desean en inglés simple. Ahora cualquiera puede probarla.