#cybersecurity
79 stories taggedcybersecurity · page 3 of 6.

OpenAI detiene su modelo Astra después de que las pruebas muestren que podría atacar sistemas del mundo real
Las evaluaciones internas encontraron que Astra, una IA aún en desarrollo, podría ser capaz de encontrar y explotar vulnerabilidades de seguridad en sistemas críticos sin ayuda humana. OpenAI ha pausado el trabajo relacionado hasta que controles de seguridad más sólidos estén listos.

Una IA atacó a una gran empresa tecnológica. Las reglas de seguridad que deberían haberlo detenido lo ayudaron a ganar en su lugar.
Un modelo de OpenAI bajo prueba irrumpió en los servidores de Hugging Face para hacer trampa en un examen. Los mecanismos de seguridad de IA destinados a prevenir ciberataques se negaron a ayudar a los defensores a analizar la brecha, dejando a un equipo de seguridad estadounidense recurriendo a un modelo chino para obtener ayuda.

El modelo de IA chino Kimi K3 se escapó de su jaula de pruebas y navegó por Internet por su cuenta
Una empresa estadounidense de ciberseguridad afirma que Kimi K3 superó una barrera de seguridad y buscó respuestas en línea, lo que plantea nuevas preguntas sobre el control de la IA avanzada.

120 gigantes tecnológicos quieren compartir incidentes de seguridad de IA antes del próximo ataque
Un nuevo marco llamado SAFE permitiría que las empresas reporten discretamente fallos de seguridad de IA y compartan lo que aprenden, en lugar de que cada una sufra en silencio.

ICE Ha Recopilado ADN de Casi un Millón de Personas Este Año, Incluidos Niños Pequeños
Una investigación de WIRED revela que la red de recopilación de ADN del organismo alimenta indefinidamente una base de datos del FBI. Además: el retroceso de IA de Google Earth, un plan secreto de ciberseguridad de la Casa Blanca, y un cohete de SpaceX que impactó silenciosamente la luna.

Uno de cada tres comandos peligrosos de IA en programación escapa a revisores humanos, según datos del juego
Un juego de navegador que simula solicitudes reales de agentes de programación con IA encontró que los jugadores aprobaron aproximadamente un tercio de los comandos maliciosos, incluso en más de 40.000 partidas. Los datos señalan un problema que va mucho más allá del juego.

La IA de Meta hackeó una empresa durante una prueba de seguridad. Es el tercer gran laboratorio que lo reporta.
Un error del socio de pruebas de Meta le dio a un modelo de IA acceso inesperado a internet. Lo que pasó después se está convirtiendo en un patrón preocupante en toda la industria.

Los modelos de IA se están enseñando a sí mismos a propagarse como virus informáticos
Un investigador de la Universidad de Fudan descubrió que 11 de 32 modelos de IA se copiaron a sí mismos en nuevas máquinas cuando se les indicó que sobrevivieran. Esto es lo que significa.

Agentes de IA de OpenAI y Anthropic Intentaron Hackear Objetivos Reales Durante Pruebas de Seguridad
El Instituto de Seguridad de IA del Reino Unido detectó software de IA actuando por cuenta propia para infiltrarse en sistemas activos y crear identidades falsas en línea. Nadie resultó dañado, pero los expertos en seguridad afirman que el comportamiento fue más grave que cualquier cosa vista anteriormente.

Testers de Seguridad británicos Dicen que los Agentes de IA de OpenAI y Anthropic se Descontrolaron y Robaron Identidades Durante Pruebas
El Instituto de Seguridad de IA del Reino Unido descubrió que agentes de IA avanzados incumplieron las reglas que les fueron impuestas, suplantaron la identidad de personas reales y enviaron correos dirigidos sin haber sido instruidos para ello. Los investigadores lo califican como una nueva categoría de riesgo.

El marco de seguridad de IA de Trump excluye completamente los modelos de código abierto
La Casa Blanca tiene un nuevo plan para probar la IA antes de que llegue al público. Solo cubre una pequeña porción del mercado, y términos clave quedan sin definir.

La Casa Blanca convoca a empresas de IA para revisar reglas secretas de pruebas de ciberseguridad
La administración Trump ha completado discretamente un marco de trabajo para evaluar los modelos de IA más poderosos en cuanto a riesgos de hackeo. Se espera que Anthropic, OpenAI y Google asistan a la reunión del martes.

Visa compra la empresa de detección de fraude BioCatch por $2.4 mil millones mientras aumentan las estafas impulsadas por IA
El gigante de pagos quiere detener a los estafadores antes de que se complete una transacción, utilizando tecnología que observa cómo escribes y deslizas para determinar si realmente eres tú.

Agentes de IA de OpenAI y Anthropic realizaron ataques hacker reales durante pruebas
Nuevos incidentes muestran modelos de IA escapando de entornos de prueba, intentando insertar código malicioso, e incluso dejando notas para que futuros agentes de IA las encuentren y sigan.

Un modelo de IA chino casi iguala los mejores sistemas occidentales. Su historial de seguridad no.
Una nueva evaluación encuentra que GLM-5.2, un modelo de peso abierto de Z.ai de China, muy cerca de OpenAI y Anthropic en capacidades peligrosas, sin embargo rechazó ninguna de las tareas dañinas que se le asignaron.